
多開幾個 AI 一起做事,效率不會加倍,先打起來的機率比較高
素材來源:NVIDIA — Agentic AI 需要多個模型 ↗ 、 Hacker News — 選擇 AI 模型:同一個提示詞,11 個模型,結果大不同 ↗ 、 TechCrunch AI — Anthropic 讓 AI 代理執行相同任務,引發爭地盤戰 ↗

素材來源:NVIDIA — Agentic AI 需要多個模型 ↗ 、 Hacker News — 選擇 AI 模型:同一個提示詞,11 個模型,結果大不同 ↗ 、 TechCrunch AI — Anthropic 讓 AI 代理執行相同任務,引發爭地盤戰 ↗

素材來源:Hacker News — 選擇 AI 模型:同一個提示詞,11 個模型,結果大不同 ↗ 、 Dwarkesh Patel — 每個 AI 模型都繼承了一種性格 ↗ 、 Dwarkesh Patel — 為什麼 AI 寧願撒謊也不願說「我不知道」 ↗ 、 TheAIGRID — Grok 4.6 震驚 AI 界:以 50% 更低成本擊敗 GPT 5.6 與 Claude ↗ 、 電腦王阿達 — Google 發表 Gemini 3.7 Flash:編碼能力追上 GPT-5.6,價格僅對手三分之一 ↗
AI 領域今日迎來多項重要進展:Databricks 以 1,900 億美元估值完成 50 億美元融資,成為數據 AI 平台的獨角獸代表,而 Hinton、李飛飛、Ng 三位先驅就 AI 監管與開源路線的分歧凸顯業界對安全治理的深度思考。此外,OpenAI 開始在 ChatGPT 中測試廣告功能探索商業化新路徑,DeepSeek 則以開源編程工具 DeepSeek Harness 一日獲得 3.6 萬星,展現國內 AI 開源生態的蓬勃活力。

在 AI4 會議上,Geoffrey Hinton、Fei-Fei Li 和 Andrew Ng 三位全球頂尖 AI 專家就 AI 監管、開源工具的可及性,以及美國如何在中國崛起的亞洲競爭中保持領先地位進行了討論。這場辯論反映了業界對 AI 安全的重視與對保持技術開放性的平衡考量。

數據和 AI 平台公司 Databricks 完成 50 億美元融資,估值達 1,900 億美元。執行長 Ali Ghodsi 表示由於 AI 成本高昂且投資者踴躍,公司原計劃融資 10 億美元,最終因投資者需求強勁而決定接受更大規模融資。這反映出市場對 AI 基礎設施需求的強烈興趣。

OpenAI 開始在 ChatGPT 測試廣告投放,用以支持免費用戶的持續訪問。廣告將有清晰標註,不會影響回答品質,並配備強隱私保護和用戶控制機制,讓用戶能自主管理廣告體驗。

研究團隊開發了 Wiggle Framework,用來測試大語言模型作為評判者的認知穩定性。研究發現,9 個最先進的模型在評判安全性、毒性、AI 寫作檢測等任務時,都出現了顯著的「搖晃」現象——在靜態質疑下翻轉評判結果 25-71%,在對抗性壓力下更高達 62-91%。這揭示了當前 LLM 評委作為評估和獎勵建模基礎設施存在的嚴重穩定性問題。

AI 代碼生成平台 Lovable 完成新一輪融資,估值達 133 億美元,融資額 4 億美元。該公司已在 6 月達到 5 億美元的年化收入運行率,展示出強勁的商業增長動力和市場需求。

Apple 與中國科技巨頭 Alibaba 合作開發了一個針對中國市場的定制大語言模型,這是罕見的跨國合作案例。此舉標誌著 Apple 策略的重大轉變,讓公司能在競爭激烈的中國智慧型手機市場中獲得更多產品控制權,而非依賴既有的國內解決方案。

Google 宣佈 AI 部門 Google DeepMind 進行重大組織調整,首席科學家 Jeff Dean 離職創業,DeepMind 聯合創始人兼 CEO Demis Hassabis 轉向長期研究工作。此舉引發業界熱議,質疑 Google 在 AI 競賽中的決心和戰略方向是否清晰。

警用科技公司 Flock 宣佈收緊警察使用其全國車牌讀取器網絡的權限,以回應日益高漲的隱私擔憂和合約流失。新措施要求警官在搜索前輸入案件編號,旨在防止濫用——《華盛頓郵報》調查辨識出至少 50 起警員被控或遭指控濫用車牌讀取器的案件,其中 46 起涉及 Flock;26 起涉及追蹤妻子、女友、前伴侶、情敵或想接近的女性。這反映出執法科技中的隱私監管正在升級,也顯示公民自由團體的倡議開始推動產業變革。

研究團隊開發了一套雲邊混合架構,在邊緣端運行輕量化的醫療 AI 模型處理原始數據,並由雲端 LLM 合成臨床摘要,特別針對頻寬稀缺、計算能力有限的農村地區設計。系統透過 LLM 編排器動態選擇診斷工具,在 500kbps 至 5Mbps 等低網速環境下仍能達到 98-99% 的診斷工具召回率與 92-96% 的準確度,可望將醫療 AI 能力延伸到資源匱乏地區。

DeepSeek 正式開源其編程應用 DeepSeek Harness(DSH),該工具採用「所有能力皆為外掛」的設計理念,旨在提供靈活的開發體驗。上線首日即獲得超過 3.6 萬個 GitHub 星,顯示市場對其高度關注,並被視為與 Claude Code 等主流工具競爭的新選擇。

MIT Tech Review 訪問了 10 到 18 歲的孩童,深入瞭解他們對 AI 的真實想法。結果發現,年輕人對 AI 的態度比預期複雜得多——有人用來偷懶寫論文,有人因環境影響而拒絕使用,也有人擔心 AI 會摧毀創意和批判思維。儘管持疑態度,大多數受訪孩童承認至少在某些場景下會使用 AI,反映出新世代對這項技術既接納又警覺的微妙立場。

MIT Tech Review 報導了兩則有趣的新聞:首先,獨立雜誌編輯訪談了 10-18 歲的年輕人對 AI 的真實想法,發現許多孩子對 AI 並不熱衷,反而擔憂作弊、環保和創意流失等議題;其次,科學家成功從公鼠胚胎創造出母鼠複製體,這在生物科技領域是重要進展。這反映了 AI 在年輕世代中的接納度並非預期那麼高,同時生物科技的突破也在推進。
當前大模型競爭已從單純的效能競賽轉向速度、成本與生態系的全面角力。OpenAI 透過 Ultrafast 模式大幅提升運算效率,Google 則以 Gemini 3.7 Flash 提供具性價比的編碼能力,顯示市場對高性價比與低延遲的迫切需求。同時,DeepSeek 開源工具迅速獲得關注,凸顯開發者對靈活架構的重視。然而,模型輸出差異性提醒使用者需謹慎評估工具適配性。此外,Twitch 允許用戶拒絕數據用於 AI 訓練,反映隱私議題日益嚴峻,企業在推進 AI 應用時,必須兼顧技術創新與用戶數據權益,方能建立長期信任與可持續發展。
未來三至六個月,AI 產業將從單純的效能競賽轉向極致的成本與效率博弈。Google 以三分之一價格提供匹敵頂尖模型的策略,將迫使 OpenAI 等龍頭加速降價,導致高端模型利潤空間被壓縮,市場進入價格戰紅海。同時,DeepSeek 開源工具的高人氣顯示開發者生態系正快速重組,輕量化、模組化的編程輔助將成為企業落地首選,而非依賴單一巨型模型。此外,Twitch 的數據爭議預示著監管風暴來襲,平台將面臨更嚴格的數據合規審查,這可能延緩部分依賴用戶生成內容的模型訓練進度,促使企業轉向更透明、合規的數據來源,隱私保護將成為產品差異化的關鍵競爭力。
Gemini 教學:4 步生成 AI 手繪旅遊地圖與實戰應用
透過 Gemini 教學 4 步生成 AI 手繪旅遊地圖,掌握從概念到實作的完整流程。本文涵蓋 Gemini Developer API 定價分析、Google AI Studio 與 Gemini Canvas 對比,以及生成式 AI 在旅遊規劃中的實戰應用技巧。
microsoft 365 copilot 教學Microsoft 365 Copilot 教學:企業版定價、限制與實戰操作
深入解析 Microsoft 365 Copilot 教學,涵蓋企業版定價策略、功能限制說明及實戰操作指南。掌握 Copilot 是什麼,提升企業生產力。
notebooklm by google 怎麼用他賺錢NotebookLM 教學:如何生成 AI 會議筆記與賺錢實戰
深入解析 NotebookLM by Google 怎麼用他賺錢。從 AI 會議筆記生成實戰,到與 Copilot 及 Gemini 的差異比較,提供完整教學與變現策略。
喜歡這篇?每天早晨還有更多。
訂閱 5min AI,讓 AI 替你追蹤整個 AI 世界。