📰 2026-06-18 AI 日報

中國開源模型用六分之一的錢打趴 GPT-5.5,這才是 AI 軍備賽最值得怕的事
阿凱📝 主編觀點 · 產品思維 — 哪個 AI 產品做對了什麼,我們能學到什麼

中國開源模型用六分之一的錢打趴 GPT-5.5,這才是 AI 軍備賽最值得怕的事

Z.ai 上週發布了 GLM-5.2,7530 億參數,長程自主編程能力在多項基準測試超過 GPT-5.5,開源、免費放上 Hugging Face,API 成本只有競品的六分之一。 這個消息在英文圈的討論熱度,比它應得的還要低很多。 先把數字放在這:GPT-5.5 的 API 費用已經不便宜,而 GLM-5.2 用六分之一的成本就能達到甚至超越它在編程任務上的表現。對於那些正在搭建 AI 開發助手、做 code review 自動化、或跑大量工程任務的團隊來說,這個差距不是小事,是直接影響到要不要換掉整個 infra 的商業決策。 更麻煩的是,這不是第一次發生了。DeepSeek 去年底用低成本開源模型震驚市場,現在 Z.ai 又來一次。中國 AI 公司正在建立一套固定劇本:針對特定任務垂直優化、開源釋出拿社群聲量、API 定價大幅低於美國競品。每次循環,美國這邊的壁壘就薄一點。 從產品思維來看,這裡有個值得學的邏輯:GLM-5.2 沒有想要在所有任務上打敗 GPT-5.5,它只鎖定「長程自主編程」這一個場景。把資源押注在一條垂直賽道,然後在那條賽道上做到讓人沒有理由不用你——這才是開源模型真正危險的地方。通用大模型打的是全面戰,但開源垂直模型打的是你最在意的那 20% 工作量。 OpenAI 和 Anthropic 當然不是省油的燈,他們的護城河在於生態系、企業信任、資料安全合規。但對個人開發者和中小型團隊來說,這些護城河的重量遠遠比不上「便宜六倍」這個事實。 GLM-5.2 真正宣告的,不是 GPT-5.5 輸了,而是「旗艦模型定價」這件事正在被系統性地瓦解。
Copilot 幫你查資料,順便把你的 2FA 驗證碼偷走
塵子💬 塵子觀點

Copilot 幫你查資料,順便把你的 2FA 驗證碼偷走

這不是電影情節,是 Ars Technica 昨天報導的真實漏洞。研究團隊發現一種叫 SearchLeak 的攻擊手法,駭客只要透過 Microsoft Copilot 的搜尋功能,就能竊取使用者的雙因素驗證碼。 我們習慣把 Copilot 當超級秘書,以為它就是個會聊天的工具。但這個漏洞揭露了一件事:當 AI 開始幫你「執行搜尋」這個動作,它其實已經進了你的私人領域。 問題不在於 AI 變笨,而在於它太勤勞。為了給你完整的答案,Copilot 會自動開瀏覽器、輸入關鍵字、點開連結。在這個過程中,它看到了你正在驗證的帳號、你正在瀏覽的敏感頁面。對 AI 來說,這些只是資料;對駭客來說,這些是鑰匙。 這就像你請人代收掛號信,結果對方順手把你的身分證影本傳給第三方——你以為省了時間,其實正在把帳號底細拱手讓人。 業界現在還在討論怎麼讓 AI 更聰明、更準確,卻少有人認真問:當 AI 擁有執行權限,我們該信任它到哪一步?現有的防護機制,基本上是用紙糊的門去擋專業小偷。 下次 Copilot 說「我幫你找到答案了」,別急著開心。先想想,它為了這個答案,到底看到了哪些不該看的東西。 SOURCE: Copilot 嚴重漏洞遭駭客利用,可竊取使用者 2FA 驗證碼
🚀 產品速報2026-06-18

Anthropic 大改 Claude Design:設計開發雙向同步,終於不燒錢了

AI 設計工具 Claude Design 在短短一週內就吸引了超過百萬用戶,這股熱潮讓 Anthropic 決定趁熱打鐵,推出了一項重大更新。這次改版不只是修修小 bug,而是從單純的視覺生成工具,正式轉型為支援完整設計與開發協作流程的平台。對於一直擔心 AI 工具太貴、太難落地的開發者和企業來說,這次更新直接解決了最痛的两个問題:Token 消耗太快,以及設計與程式碼無法互通。 先說最重要的功能:程式碼往返編輯。過去用 AI 生成 UI 時,最尷尬的情況是設計師滿意了,但工程師拿到程式碼後發現很難維護,或者工程師改了程式碼,設計師那邊卻不知道。現在,Claude Design 支援雙向同步。開發者可以直接在生成的程式碼中進行修改,這些變更會自動同步回設計稿中;反之,設計師在設計稿上的調整,也能反映在程式碼裡。這種閉環協作機制打破了設計與開發之間的壁壘,大幅減少了重複勞動,讓 AI 生成的成果真正具備工程落地的價值。...

全球領導人對美國 AI 技術需求迫切,卻擔憂美國可能掌控存取權限,引發新一輪科技供應鏈安全危機。美國最新民調顯示,高達三分之二民眾認為 AI 發展速度過快,僅 16% 相信 AI 將為社會帶來正面影響,反映公眾對技術發展的深刻疑慮。與此同時,從自主 AI 化學家改進藥物合成,到社群媒體推出用戶自主控制算法,以及 Qualcomm 新晶片驅動智慧眼鏡升級,AI 應用範疇持續擴展。

全球領導人想要美國 AI,但不希望美國能隨時切斷存取

全球領導人想要美國 AI,但不希望美國能隨時切斷存取

在 G7 峰會上,法國總統馬克宏和印度總理莫迪表達擔憂,指美國可能在瞬間斷絕其他國家對美國 AI 服務的存取權。Anthropic 停機事件更凸顯了這種風險的真實性,突破了「假設情境」變成現實危機,引發各國對戰略 AI 依賴的警惕。

AI 地緣政治戰略依賴Anthropic
TechCrunch AI
社群媒體新進展:用戶可自主控制算法

社群媒體新進展:用戶可自主控制算法

Threads、Instagram 和 TikTok 等社群平台正推出新工具,讓用戶可以直接影響推薦算法的運作方式。這標誌著社群媒體從完全由平台控制的推薦系統,轉向更透明且用戶可控的方向發展,反映了對算法透明度和用戶自主權的日益關注。

推薦算法社群媒體用戶控制
TechCrunch AI
僅 16% 美國人認為 AI 將對社會產生正面影響,新研究顯示

僅 16% 美國人認為 AI 將對社會產生正面影響,新研究顯示

根據皮尤研究中心的最新報告,雖然華爾街對 AI 充滿看好,但美國民眾對 AI 產業的樂觀度卻在持續下滑。調查顯示只有 16% 的美國人認為 AI 會對社會產生正面影響,反映出公眾與資本市場間存在明顯的信心落差。這種情緒分裂反映了社會對 AI 風險、失業威脅等問題的深層擔憂。

公眾認知AI 信心危機社會衝擊
TechCrunch AI
近乎自主的 AI 化學家利用 GPT-5.4 改進藥物合成關鍵反應

近乎自主的 AI 化學家利用 GPT-5.4 改進藥物合成關鍵反應

OpenAI 與 Molecule.one 合作展示了一個近乎自主的 AI 化學家如何使用 GPT-5.4 改進了藥物製造中的關鍵反應。這項成果標誌著 AI 在實驗化學領域的實際應用突破,有助於加速新藥開發流程並降低研發成本。

AI 化學家GPT-5.4藥物合成
OpenAI Blog
OpenAI 支持歐盟 AI 內容透明度行為準則,推進來源標準建設

OpenAI 支持歐盟 AI 內容透明度行為準則,推進來源標準建設

OpenAI 宣布支持歐盟 AI 內容透明度行為準則,致力於建立和推進溯源標準及相關工具,幫助用戶識別和理解 AI 生成的內容。此舉體現 OpenAI 對構建可信任 AI 生態的承諾,標誌著業界在內容透明度和責任機制上的重要進展。

AI 透明度歐盟監管內容溯源
OpenAI Blog
Anthropic 遭遇出口管制打擊 Fable 5 和 Mythos 5 被迫下線

Anthropic 遭遇出口管制打擊 Fable 5 和 Mythos 5 被迫下線

Trump 政府突然頒布出口禁令,要求 Anthropic 切斷所有外國用戶的訪問權限,導致公司被迫下線最新的 Fable 5 和 Mythos 5 AI 模型。這項模糊不清的政策也影響了美國境內用戶和 Anthropic 自身員工的使用權限,凸顯了美國 AI 企業在日趨嚴格的出口管制下面臨的合規挑戰。

出口管制AnthropicAI 政策
The Verge AI
美國民調:三分之二民眾認為 AI 發展速度過快

美國民調:三分之二民眾認為 AI 發展速度過快

根據皮尤研究中心最新民調,49% 的美國人至少偶爾使用聊天機器人,但 63% 認為該技術發展速度過快。自 2024 年以來,AI 聊天機器人使用率大幅躍升(當時僅 33%),其中 ChatGPT 使用率自 2023 年以來翻倍成長至 44%。這反映出 AI 在美國主流人口中的採用率快速上升,但大眾對發展步伐的擔憂也隨之增加。

AI 採用率聊天機器人公眾輿論
The Verge AI
OpenAI 推出 LifeSciBench:生命科學研究 AI 評測基準

OpenAI 推出 LifeSciBench:生命科學研究 AI 評測基準

OpenAI 發佈 LifeSciBench,這是一個由領域專家編寫和審核的基準測試工具,專門用於評估 AI 系統在處理真實生命科學研究任務和決策上的表現。這個基準填補了評測 AI 在專業科研領域應用能力的空白,對於推進 AI 在生物醫學研究中的可信應用具有重要意義。

AI 評測基準生命科學LifeSciBench
OpenAI Blog
Qualcomm 最新晶片暗示更強大的智慧眼鏡即將推出

Qualcomm 最新晶片暗示更強大的智慧眼鏡即將推出

Qualcomm 宣布推出 Snapdragon Reality Elite 晶片,專門為下一代 XR 設備優化,標誌著智慧眼鏡硬體性能將迎來重大升級。這款新晶片強化的運算能力將使智慧眼鏡能支援更複雜的 AR/VR 應用與互動體驗,推動這個新興產品類別邁向實用化。

智慧眼鏡XR 晶片Snapdragon Reality Elite
The Verge AI
TREX:能實際執行程式碼的 AI 程式碼審查工具

TREX:能實際執行程式碼的 AI 程式碼審查工具

TREX 是一款開源的 AI 程式碼審查工具,其最大特色在於不僅僅是靜態分析,還能實際執行程式碼來驗證邏輯與安全性。這種動態驗證機制能有效捕捉傳統 LLM 審查容易忽略的執行階段錯誤,為開發者提供更可靠的程式碼品質保障。

TREXAI Code Review程式碼審查
Hacker News
Midjourney Medical 醫療影像生成功能上線

Midjourney Medical 醫療影像生成功能上線

Midjourney 推出專門針對醫療領域的 Medical 功能,允許使用者生成醫學影像和相關視覺內容。這項新功能標誌著 AI 影像生成工具開始深入垂直產業應用,為醫療專業人士和教育工作者提供新的視覺化解決方案。

Midjourney醫療影像生成AI 垂直應用
Hacker News
Anthropic 在韓國首爾開設辦公室,宣佈與韓國 AI 生態系統建立新合作夥伴關係

Anthropic 在韓國首爾開設辦公室,宣佈與韓國 AI 生態系統建立新合作夥伴關係

Anthropic 宣佈在首爾開設新辦公室,並與韓國 AI 生態系統中的多個合作夥伴建立戰略合作。這項舉措標誌著 Anthropic 在亞太地區的進一步擴張,將加強與韓國本地企業和開發者的合作,推動 Claude 在該地區的採用和應用發展。

Anthropic韓國市場國際擴張
Anthropic Blog

今日洞察

AI產業正邁向效能優化與安全治理並重的新階段。Anthropic與Z.ai分別透過工具迭代與開源高性價比模型,降低應用門檻並提升開發效率,顯示市場競爭焦點轉向實用性與成本平衡。然而,Copilot漏洞事件警示LLM整合外部工具時的安全架構缺陷,凸顯防護機制亟待強化。與此同時,OpenAI Academy推動技能教育,而KV Cache可編輯性及多Agent系統驗證研究,則從底層技術與理論層面提升模型可控性與可靠性。整體而言,產業需在加速部署與確保安全穩定之間取得精確平衡,以支撐更複雜的AI應用生態。

🔮 趨勢雷達

未來三至六個月,AI 產業將從單純追求模型規模轉向效能優化與安全治理。GLM-5.2 的低成本開源策略將迫使歐美競品加速降價,開源模型在企業級編程領域的市佔率將顯著提升。同時,Copilot 漏洞事件將引發監管緊縮,企業對 AI 整合外部工具的審計標準將大幅提高,安全合規成本成為新門檻。技術層面,KV Cache 編輯技術將解決推理延遲瓶頸,使即時互動應用在 Q3 成為主流。此外,OpenAI 的教育佈局顯示市場焦點將轉向 Agent 工作流落地,缺乏實際應用場景的純模型公司將面臨投資降溫,具備系統整合與安全驗證能力的平台將主導市場。

喜歡這篇?每天早晨還有更多。

訂閱 5min AI,讓 AI 替你追蹤整個 AI 世界。