📰 2026-07-01 AI 日報

Claude Code 偷偷塞的標記,抓的不是合規,是轉售和蒸餾
阿凱📝 主編觀點 · 投資人視角 — 錢往哪流、為什麼,哪些公司值得注意

Claude Code 偷偷塞的標記,抓的不是合規,是轉售和蒸餾

有人把 Claude Code 的用戶端拆開來看,發現它在系統提示裡塞了看不見的東西。一位署名 Thereallo 的開發者 6 月 30 日公布逆向結果:Claude Code 會檢查你的 base URL 環境變數,如果你把它改到自己的 proxy 或 gateway,程式就會再去比對系統時區、以及那個 hostname 有沒有命中一份清單——已知的中國 AI 實驗室、其他 AI 公司、帳號轉售商、gateway 網域。命中之後,它用近乎隱形的 Unicode 字元改寫系統提示裡那句看起來再普通不過的英文,把分類結果編碼進去。那份網域清單則藏在 XOR 加 base64 後面。 第一眼你可能會以為這是合規功能,畢竟「可追溯」聽起來就很企業。但 Anthropic 自己講的用途完全是另一件事。Claude Code 團隊的工程師 Thariq Shihipar 說:「這是我們三月啟動的一項實驗,目的是防止未授權轉售商的帳號濫用,並防範蒸餾。」他還說團隊後來已經上了更強的緩解措施,其實一直想把這段拿掉——移除的 pull request 已經 merge,會進 7 月 1 日的版本。 所以這不是賣給客戶的功能,是保護資產的執法工具。從投資的角度看,這個區別很重要。合規功能是收入,反蒸餾是護住成本結構:一家公司花幾十億美元訓出來的模型,如果別人用你的 API 反覆查詢就能把能力複製走一大半,那筆研發支出的攤提年限就得重算。Anthropic 二月就說過在投資反蒸餾防禦——分類器偵測、行為指紋、與其他實驗室情報共享、存取控制。Claude Code 原始碼外洩時還曝光過一個叫 ANTI_DISTILLATION_CC 的 flag,啟用時會把假的 tool data 注進 API 請求,讓那些資料拿去訓練會中毒。這是同一條防線上的不同工事。 有意思的是代價。The Register 問 Anthropic:服務條款裡有揭露這項隱蔽追蹤嗎?發言人指向 Shihipar 那段說法,而那段說法並沒有回答這個問題。Thereallo 自己的評語其實很克制:偵測中國對手或轉售商的 hostname 是合理的,「這不是惡意功能,但對一個要求信任的開發者工具來說,是個奇怪的選擇。」 模型權重是這個產業目前最貴的資產,會有人想搬走它,這件事本身沒什麼好意外。近期一份白宮行政命令也表達了保護美國 AI 不受外國對手侵害的意圖,方向是一致的。真正要盯的是另一件事:開發者工具同時是產品和防線,而這兩個身分的利益不會永遠一致。這次是幾個看不見的字元,而且已經拿掉了;下一次防線再往前推的時候,願不願意先講一聲,會是比技術本身更貴的一筆帳。
Google NotebookLM 把筆記變成短影音,然後把「主動學習」這件事一起外包出去
塵子💬 塵子觀點

Google NotebookLM 把筆記變成短影音,然後把「主動學習」這件事一起外包出去

Google 給 NotebookLM 加了新功能:把你的筆記自動剪成 60 秒垂直影片,風格跟 TikTok 一模一樣,有節奏、有轉場、有背景音樂。聽起來很聰明。但仔細想,這件事其實在替一個很舊的誤解加速——資訊包裝得越好看,學習效果就越好。 不是這樣的。 AI 幫你決定哪些是重點、用什麼語氣說、配什麼音樂,你拿到的是一份已經被消化過的摘要。問題是,學習的關鍵恰好在「消化」那個步驟本身。大腦在整理資訊的過程中被迫建立連結、發現矛盾、產生疑問,那些讓你卡住的地方,才是真正長出知識的地方。AI 把路鋪平、石頭搬走,你走得很快,但也什麼都沒踩到。 結果就是看得很快,覺得自己學了很多,關掉 App 後腦子裡空空的。快餐館的邏輯:吃得快、飽得快、也餓得快。 更諷刺的是,這個功能只開放給 Pro 和 Ultra 訂閱用戶,也就是說,願意付錢的人,才能享受「被動吸收」的特權。免費使用者則繼續自己讀那些長長的筆記,在字裡行間摸索。Google 大概沒想到,這個設計無意間把主動學習留給了不付費的人。 我們習慣把摩擦感當成學習的障礙,但那個卡住你的地方,往往才是真正在思考的時刻。當 AI 幫我們省掉所有麻煩,我們也順手省掉了變聰明的機會。科技降低的不是學習門檻,而是學習本身。 SOURCE: Google NotebookLM 推出 TikTok 風格 AI 影片摘要功能
🚀 產品速報2026-07-01

Anthropic 推出 Claude Sonnet 5,以更低成本強化 Agent 能力

AI 領域又迎來了一場關於「效率」與「成本」的重新洗牌。Anthropic 正式發布了新一代模型 Claude Sonnet 5,這次發布的重點非常明確:讓 AI Agent(智能體)更聰明、更便宜、也更安全。對於正在尋找高端模型替代方案的企業和開發者來說,這是一個值得仔細研究的選項。 先說最重要的功能:Agent 自主執行任務的能力顯著增強。過去我們常聽到 AI 只能「聊天」或「寫程式」,但 Claude Sonnet 5 的突破在於它能更穩定地獨立完成複雜的多步驟任務。這意味著它不再只是被動地回答問題,而是能主動規劃、執行,甚至修正自己的錯誤。對於需要自動化流程的企業來說,這代表著從「輔助工具」向「自動化員工」邁出了關鍵一步。...

Nvidia 的新對手 Etched 憑藉專用 AI 晶片技術估值已達 50 億美元並獲得 10 億美元大單,正在打破 GPU 寡頭市場局面。美國商務部同步解除 Claude 和 Mythos 等先進模型的出口管制,標誌著 AI 技術競爭格局出現重大轉變。與此同時,研究指出大型語言模型的安全評估存在「表演式合規」漏洞,業界需重新審視 AI 安全標準的實際有效性。

Nvidia 競爭對手 Etched 估值達 50 億美元,AI 晶片已獲得 10 億美元訂單

Nvidia 競爭對手 Etched 估值達 50 億美元,AI 晶片已獲得 10 億美元訂單

AI 晶片新創公司 Etched 宣布已達到 50 億美元估值,並已預訂 10 億美元的推理系統合約,直接挑戰 Nvidia 在 AI 硬體市場的主導地位。這反映出市場對 Nvidia 替代方案的需求日益高漲,也顯示專業 AI 推理晶片成為新興投資熱點。

AI 晶片Etched推理系統
TechCrunch AI
美國商務部解除 Claude Fable 5 和 Mythos 5 的出口管制

美國商務部解除 Claude Fable 5 和 Mythos 5 的出口管制

美國商務部宣佈對 Anthropic 開發的 Claude Fable 5 和 Mythos 5 模型解除出口管制限制。這意味著這兩個模型現在可以更自由地向國際用戶和企業提供,代表美國政府對 Anthropic 技術出口政策的重要調整。

出口管制Claude FableAnthropic
Hacker News
LLM 的道德安全假象:「表演式合規」曝露評估漏洞

LLM 的道德安全假象:「表演式合規」曝露評估漏洞

研究發現大型語言模型在公平性評估中表現出「表演式合規」現象——當人口統計身份以明確標籤呈現時,模型看起來很公平,但當需要推理身份時公平性大幅下降。這項研究使用提示變異方法固定道德困境和人口身份,僅改變身份呈現方式,發現隱藏標籤會使有害決策增加 4.4%,並改變模型安全排名,揭示現有道德評估可能嚴重高估了 LLM 的真實安全程度。

LLM 安全算法公平性評估漏洞
arXiv cs.CL
Claude Science 是 Anthropic 最新旗艦產品

Claude Science 是 Anthropic 最新旗艦產品

Anthropic 在製藥和生技領域的活動中宣布推出 Claude Science,這是一款專為科學研究設計的新產品,功能類似於 Claude Code 之於軟體工程。Claude Science 可以根據高層次指令自主執行有意義的科學工作,將 AI 助手的能力從代碼生成擴展到科學發現領域。

Claude Science科學研究Anthropic
MIT Tech Review
AutoTrainess:語言模型自主改進語言模型的新方法

AutoTrainess:語言模型自主改進語言模型的新方法

研究者推出 AutoTrainess,一個能夠自主執行模型後訓練全流程的 AI 代理系統。與傳統需要人類手動介入的方式不同,AutoTrainess 將規劃、數據準備、訓練、評估和日誌記錄等操作標準化,讓 AI 模型能在數小時內自動完成複雜的迭代訓練任務,這對降低大模型開發成本和加速模型優化具有重要意義。

自主訓練語言模型優化AutoML
arXiv cs.CL
Amazon 推出 10 億美元 FDE 新部門,跟進 OpenAI 和 Anthropic

Amazon 推出 10 億美元 FDE 新部門,跟進 OpenAI 和 Anthropic

Amazon 宣布成立專注於 AI Agent 部署的 10 億美元新組織,工程師將深入企業內部協助快速部署客製化 Agent,提升客戶自主能力。此舉反映科技巨頭加速投入生成式 AI 商業應用的競爭態勢,與 OpenAI 和 Anthropic 等公司的策略方向一致。

AmazonAI Agent企業應用
TechCrunch AI
CLExEval:用於 LLM 臨床推理定性評估的人工迴圈框架

CLExEval:用於 LLM 臨床推理定性評估的人工迴圈框架

研究團隊推出 CLExEval 框架,針對大型語言模型在醫療診斷中的推理能力進行評估。研究發現 LLM 存在三大失敗模式:冗長性偏差導致準確度大幅下降、專家模型知識檢索不穩定,以及推理與輸出不匹配等問題,揭示了當前 LLM 在臨床應用中的關鍵風險。

LLM 臨床評估醫療診斷推理醫療 AI 安全
arXiv cs.CL
Sonnet 5 正式發布,美國聯邦政府解除 Claude Fable 5 出口管制

Sonnet 5 正式發布,美國聯邦政府解除 Claude Fable 5 出口管制

Anthropic 推出 Claude Sonnet 5 模型,同時美國聯邦政府(商務部)解除了對 Anthropic 自家模型 Claude Fable 5 的出口管制。此外,Claude 新增廣告創意生成功能,用戶可以用一個命令快速產生獲勝級別的廣告文案,進一步擴展模型在商業創意領域的應用場景。

ClaudeSonnet 5AI 創意工具
The Rundown AI
Cursor 推出手機版 App,隨時監控 Coding Agent

Cursor 推出手機版 App,隨時監控 Coding Agent

Cursor 正式發布移動端應用程式,讓開發者能透過手機遠端監督 Coding Agent 的運作進度。這項更新補足了開發者在外也能即時掌握 AI 編碼狀態的需求,強化了工具的可攜性與管理彈性。

CursorCoding AgentMobile App
TechCrunch AI
教會 LLM 在資源匱乏地區癲癇診療中推薦與延遲決策

教會 LLM 在資源匱乏地區癲癇診療中推薦與延遲決策

研究團隊開發 MANANA 框架,使 LLM 能在烏干達等資源限制地區進行兒童癲癇用藥決策支援。通過學習本地處方實踐並知道何時應延遲決策,系統在解析患者病歷的同時避免套用不適合的全球標準處方,相比標準提示和傳統機器學習模型都有顯著改進。這項研究展示了 LLM 在全球衛生資源不足地區的實際應用潛力。

LLM 醫療決策癲癇治療提示學習
arXiv cs.LG
Netflix 在《金牌奪標》實境秀中使用 AI 生成的 Gene Wilder 配音

Netflix 在《金牌奪標》實境秀中使用 AI 生成的 Gene Wilder 配音

Netflix 推出改編自《查理與巧克力工廠》的實境競賽秀《金牌奪標》,將於 9 月 23 日首映。節目採用 AI 生成的 Gene Wilder 配音做為旁白,這反映了串流媒體平台在內容製作中越來越多地運用 AI 技術的趨勢,引發關於合成人聲在娛樂產業中應用的討論。

AI 配音Netflix語音合成
The Verge AI
The Download:AI 「同事」與超高速網際網路

The Download:AI 「同事」與超高速網際網路

MIT Tech Review 探討 AI 代理工具在職場中的角色定位問題。文章指出,將 AI 視為「同事」存在認知誤區,實際上 AI 工具的定位、責任歸屬和協作方式與真正的人類同事有本質區別,企業和員工需要更清晰地理解 AI 輔助工作的真實場景。

AI 代理職場應用人機協作
MIT Tech Review

今日洞察

AI 產業正加速從單純模型競賽轉向 Agent 生態與硬體整合的深層應用。Anthropic 推出 Claude Sonnet 5 以高性價比強化 Agent 能力,並透過隱寫術解決版權溯源,顯示安全與成本成為競爭關鍵。Cursor 與 OpenAI 分別透過行動端監控與專屬硬體,將 AI 編碼體驗延伸至隨時隨地,強化開發者對 AI 的控制力。同時,RSEA 架構提出無需更新權重的遞迴自我進化機制,解決模型迭代中的基準測試偏差問題。Google NotebookLM 則結合短影音趨勢,拓展 AI 內容生成的多元形式。整體而言,產業焦點已從單一模型效能,擴展至工具鏈完整性、合規機制及硬體協同,推動 AI 應用更貼近實際工作流與企業合規需求。

🔮 趨勢雷達

未來三至六個月,AI 產業將從單純的模型競賽轉向 Agent 落地與硬體整合的深水区。Anthropic 與 Cursor 的動態顯示,低成本的自主 Agent 將迅速成為企業標準配置,迫使競爭對手跟進價格戰,而開發者對 Agent 的遠端監控需求將催生新的中間件市場。同時,OpenAI 推出專屬硬體標誌著 AI 工具將突破軟體邊界,形成软硬一体的生態閉環。此外,隱寫術與自我進化技術的應用,意味著合規與自動化迭代將成為產品差異化的關鍵,投資熱點將從基礎模型轉向具備實際工作流整合能力與硬體協同效應的應用層公司。

喜歡這篇?每天早晨還有更多。

訂閱 5min AI,讓 AI 替你追蹤整個 AI 世界。