📰 2026-06-18 AI 日報

中國開源模型用六分之一的錢打趴 GPT-5.5,這才是 AI 軍備賽最值得怕的事
阿凱📝 主編觀點 · 產品思維 — 哪個 AI 產品做對了什麼,我們能學到什麼

中國開源模型用六分之一的錢打趴 GPT-5.5,這才是 AI 軍備賽最值得怕的事

Z.ai 上週發布了 GLM-5.2,7530 億參數,長程自主編程能力在多項基準測試超過 GPT-5.5,開源、免費放上 Hugging Face,API 成本只有競品的六分之一。 這個消息在英文圈的討論熱度,比它應得的還要低很多。 先把數字放在這:GPT-5.5 的 API 費用已經不便宜,而 GLM-5.2 用六分之一的成本就能達到甚至超越它在編程任務上的表現。對於那些正在搭建 AI 開發助手、做 code review 自動化、或跑大量工程任務的團隊來說,這個差距不是小事,是直接影響到要不要換掉整個 infra 的商業決策。 更麻煩的是,這不是第一次發生了。DeepSeek 去年底用低成本開源模型震驚市場,現在 Z.ai 又來一次。中國 AI 公司正在建立一套固定劇本:針對特定任務垂直優化、開源釋出拿社群聲量、API 定價大幅低於美國競品。每次循環,美國這邊的壁壘就薄一點。 從產品思維來看,這裡有個值得學的邏輯:GLM-5.2 沒有想要在所有任務上打敗 GPT-5.5,它只鎖定「長程自主編程」這一個場景。把資源押注在一條垂直賽道,然後在那條賽道上做到讓人沒有理由不用你——這才是開源模型真正危險的地方。通用大模型打的是全面戰,但開源垂直模型打的是你最在意的那 20% 工作量。 OpenAI 和 Anthropic 當然不是省油的燈,他們的護城河在於生態系、企業信任、資料安全合規。但對個人開發者和中小型團隊來說,這些護城河的重量遠遠比不上「便宜六倍」這個事實。 GLM-5.2 真正宣告的,不是 GPT-5.5 輸了,而是「旗艦模型定價」這件事正在被系統性地瓦解。
Copilot 幫你查資料,順便把你的 2FA 驗證碼偷走
塵子💬 塵子觀點

Copilot 幫你查資料,順便把你的 2FA 驗證碼偷走

這不是電影情節,是 Ars Technica 昨天報導的真實漏洞。研究團隊發現一種叫 SearchLeak 的攻擊手法,駭客只要透過 Microsoft Copilot 的搜尋功能,就能竊取使用者的雙因素驗證碼。 我們習慣把 Copilot 當超級秘書,以為它就是個會聊天的工具。但這個漏洞揭露了一件事:當 AI 開始幫你「執行搜尋」這個動作,它其實已經進了你的私人領域。 問題不在於 AI 變笨,而在於它太勤勞。為了給你完整的答案,Copilot 會自動開瀏覽器、輸入關鍵字、點開連結。在這個過程中,它看到了你正在驗證的帳號、你正在瀏覽的敏感頁面。對 AI 來說,這些只是資料;對駭客來說,這些是鑰匙。 這就像你請人代收掛號信,結果對方順手把你的身分證影本傳給第三方——你以為省了時間,其實正在把帳號底細拱手讓人。 業界現在還在討論怎麼讓 AI 更聰明、更準確,卻少有人認真問:當 AI 擁有執行權限,我們該信任它到哪一步?現有的防護機制,基本上是用紙糊的門去擋專業小偷。 下次 Copilot 說「我幫你找到答案了」,別急著開心。先想想,它為了這個答案,到底看到了哪些不該看的東西。 SOURCE: Copilot 嚴重漏洞遭駭客利用,可竊取使用者 2FA 驗證碼
🚀 產品速報2026-06-18

Anthropic 大改 Claude Design:設計開發雙向同步,終於不燒錢了

AI 設計工具 Claude Design 在短短一週內就吸引了超過百萬用戶,這股熱潮讓 Anthropic 決定趁熱打鐵,推出了一項重大更新。這次改版不只是修修小 bug,而是從單純的視覺生成工具,正式轉型為支援完整設計與開發協作流程的平台。對於一直擔心 AI 工具太貴、太難落地的開發者和企業來說,這次更新直接解決了最痛的两个問題:Token 消耗太快,以及設計與程式碼無法互通。 先說最重要的功能:程式碼往返編輯。過去用 AI 生成 UI 時,最尷尬的情況是設計師滿意了,但工程師拿到程式碼後發現很難維護,或者工程師改了程式碼,設計師那邊卻不知道。現在,Claude Design 支援雙向同步。開發者可以直接在生成的程式碼中進行修改,這些變更會自動同步回設計稿中;反之,設計師在設計稿上的調整,也能反映在程式碼裡。這種閉環協作機制打破了設計與開發之間的壁壘,大幅減少了重複勞動,讓 AI 生成的成果真正具備工程落地的價值。...

全球領導人對美國 AI 技術需求迫切,卻擔憂美國可能掌控存取權限,引發新一輪科技供應鏈安全危機。美國最新民調顯示,高達三分之二民眾認為 AI 發展速度過快,僅 16% 相信 AI 將為社會帶來正面影響,反映公眾對技術發展的深刻疑慮。與此同時,從自主 AI 化學家改進藥物合成,到社群媒體推出用戶自主控制算法,以及 Qualcomm 新晶片驅動智慧眼鏡升級,AI 應用範疇持續擴展。

今日完整文章

以下每則都有我們自己撰寫的完整內容,點入即可讀完。

Anthropic 遭遇出口管制打擊 Fable 5 和 Mythos 5 被迫下線

Anthropic 遭遇出口管制打擊 Fable 5 和 Mythos 5 被迫下線

Trump 政府突然頒布出口禁令,要求 Anthropic 切斷所有外國用戶的訪問權限,導致公司被迫下線最新的 Fable 5 和 Mythos 5 AI 模型。這項模糊不清的政策也影響了美國境內用戶和 Anthropic 自身員工的使用權限,凸顯了美國 AI 企業在日趨嚴格的出口管制下面臨的合規挑戰。

出口管制AnthropicAI 政策
The Verge AI
美國民調:三分之二民眾認為 AI 發展速度過快

美國民調:三分之二民眾認為 AI 發展速度過快

根據皮尤研究中心最新民調,49% 的美國人至少偶爾使用聊天機器人,但 63% 認為該技術發展速度過快。自 2024 年以來,AI 聊天機器人使用率大幅躍升(當時僅 33%),其中 ChatGPT 使用率自 2023 年以來翻倍成長至 44%。這反映出 AI 在美國主流人口中的採用率快速上升,但大眾對發展步伐的擔憂也隨之增加。

AI 採用率聊天機器人公眾輿論
The Verge AI
Qualcomm 最新晶片暗示更強大的智慧眼鏡即將推出

Qualcomm 最新晶片暗示更強大的智慧眼鏡即將推出

Qualcomm 宣布推出 Snapdragon Reality Elite 晶片,專門為下一代 XR 設備優化,標誌著智慧眼鏡硬體性能將迎來重大升級。這款新晶片強化的運算能力將使智慧眼鏡能支援更複雜的 AR/VR 應用與互動體驗,推動這個新興產品類別邁向實用化。

智慧眼鏡XR 晶片Snapdragon Reality Elite
The Verge AI
Midjourney Medical 醫療影像生成功能上線

Midjourney Medical 醫療影像生成功能上線

Midjourney 推出專門針對醫療領域的 Medical 功能,允許使用者生成醫學影像和相關視覺內容。這項新功能標誌著 AI 影像生成工具開始深入垂直產業應用,為醫療專業人士和教育工作者提供新的視覺化解決方案。

Midjourney醫療影像生成AI 垂直應用
Hacker News

其他新聞摘要

以下只有重點摘要,完整內容請看原始來源。

全球領導人想要美國 AI,但不希望美國能隨時切斷存取

全球領導人想要美國 AI,但不希望美國能隨時切斷存取

在 G7 峰會上,法國總統馬克宏和印度總理莫迪表達擔憂,指美國可能在瞬間斷絕其他國家對美國 AI 服務的存取權。Anthropic 停機事件更凸顯了這種風險的真實性,突破了「假設情境」變成現實危機,引發各國對戰略 AI 依賴的警惕。

AI 地緣政治戰略依賴Anthropic
TechCrunch AI
社群媒體新進展:用戶可自主控制算法

社群媒體新進展:用戶可自主控制算法

Threads、Instagram 和 TikTok 等社群平台正推出新工具,讓用戶可以直接影響推薦算法的運作方式。這標誌著社群媒體從完全由平台控制的推薦系統,轉向更透明且用戶可控的方向發展,反映了對算法透明度和用戶自主權的日益關注。

推薦算法社群媒體用戶控制
TechCrunch AI
僅 16% 美國人認為 AI 將對社會產生正面影響,新研究顯示

僅 16% 美國人認為 AI 將對社會產生正面影響,新研究顯示

根據皮尤研究中心的最新報告,雖然華爾街對 AI 充滿看好,但美國民眾對 AI 產業的樂觀度卻在持續下滑。調查顯示只有 16% 的美國人認為 AI 會對社會產生正面影響,反映出公眾與資本市場間存在明顯的信心落差。這種情緒分裂反映了社會對 AI 風險、失業威脅等問題的深層擔憂。

公眾認知AI 信心危機社會衝擊
TechCrunch AI
近乎自主的 AI 化學家利用 GPT-5.4 改進藥物合成關鍵反應

近乎自主的 AI 化學家利用 GPT-5.4 改進藥物合成關鍵反應

OpenAI 與 Molecule.one 合作展示了一個近乎自主的 AI 化學家如何使用 GPT-5.4 改進了藥物製造中的關鍵反應。這項成果標誌著 AI 在實驗化學領域的實際應用突破,有助於加速新藥開發流程並降低研發成本。

AI 化學家GPT-5.4藥物合成
OpenAI Blog
OpenAI 支持歐盟 AI 內容透明度行為準則,推進來源標準建設

OpenAI 支持歐盟 AI 內容透明度行為準則,推進來源標準建設

OpenAI 宣布支持歐盟 AI 內容透明度行為準則,致力於建立和推進溯源標準及相關工具,幫助用戶識別和理解 AI 生成的內容。此舉體現 OpenAI 對構建可信任 AI 生態的承諾,標誌著業界在內容透明度和責任機制上的重要進展。

AI 透明度歐盟監管內容溯源
OpenAI Blog
OpenAI 推出 LifeSciBench:生命科學研究 AI 評測基準

OpenAI 推出 LifeSciBench:生命科學研究 AI 評測基準

OpenAI 發佈 LifeSciBench,這是一個由領域專家編寫和審核的基準測試工具,專門用於評估 AI 系統在處理真實生命科學研究任務和決策上的表現。這個基準填補了評測 AI 在專業科研領域應用能力的空白,對於推進 AI 在生物醫學研究中的可信應用具有重要意義。

AI 評測基準生命科學LifeSciBench
OpenAI Blog
TREX:能實際執行程式碼的 AI 程式碼審查工具

TREX:能實際執行程式碼的 AI 程式碼審查工具

TREX 是一款開源的 AI 程式碼審查工具,其最大特色在於不僅僅是靜態分析,還能實際執行程式碼來驗證邏輯與安全性。這種動態驗證機制能有效捕捉傳統 LLM 審查容易忽略的執行階段錯誤,為開發者提供更可靠的程式碼品質保障。

TREXAI Code Review程式碼審查
Hacker News
Anthropic 在韓國首爾開設辦公室,宣佈與韓國 AI 生態系統建立新合作夥伴關係

Anthropic 在韓國首爾開設辦公室,宣佈與韓國 AI 生態系統建立新合作夥伴關係

Anthropic 宣佈在首爾開設新辦公室,並與韓國 AI 生態系統中的多個合作夥伴建立戰略合作。這項舉措標誌著 Anthropic 在亞太地區的進一步擴張,將加強與韓國本地企業和開發者的合作,推動 Claude 在該地區的採用和應用發展。

Anthropic韓國市場國際擴張
Anthropic Blog

今日洞察

AI產業正邁向效能優化與安全治理並重的新階段。Anthropic與Z.ai分別透過工具迭代與開源高性價比模型,降低應用門檻並提升開發效率,顯示市場競爭焦點轉向實用性與成本平衡。然而,Copilot漏洞事件警示LLM整合外部工具時的安全架構缺陷,凸顯防護機制亟待強化。與此同時,OpenAI Academy推動技能教育,而KV Cache可編輯性及多Agent系統驗證研究,則從底層技術與理論層面提升模型可控性與可靠性。整體而言,產業需在加速部署與確保安全穩定之間取得精確平衡,以支撐更複雜的AI應用生態。

🔮 本週趨勢雷達

未來三至六個月,AI 產業將從單純追求模型規模轉向效能優化與安全治理。GLM-5.2 的低成本開源策略將迫使歐美競品加速降價,開源模型在企業級編程領域的市佔率將顯著提升。同時,Copilot 漏洞事件將引發監管緊縮,企業對 AI 整合外部工具的審計標準將大幅提高,安全合規成本成為新門檻。技術層面,KV Cache 編輯技術將解決推理延遲瓶頸,使即時互動應用在 Q3 成為主流。此外,OpenAI 的教育佈局顯示市場焦點將轉向 Agent 工作流落地,缺乏實際應用場景的純模型公司將面臨投資降溫,具備系統整合與安全驗證能力的平台將主導市場。

喜歡這篇?每天早晨還有更多。

訂閱 5min AI,讓 AI 替你追蹤整個 AI 世界。