
📰 2026-06-24 AI 日報


Anthropic 把 AI 塞進 Slack,以為這樣就能讓你加班
CUGA 框架:用 24 個範例快速打造能幹活的 AI Agent
Anthropic 的 Claude 正式進駐 Slack 成為企業協作新夥伴,同時 Oracle 透過大規模裁員來支撐 AI 基礎建設投資,顯示科技巨頭在 AI 競賽中的激進姿態。在醫療應用方面,RaDaR 模型開始臨床試驗以加速罕見疾病診斷,但研究警示 LLM 在心理健康應用中的安全隱患仍未妥善解決,而 GPT-5 已助力免疫學家破解三年研究謎題,展現生成式 AI 在科學領域的深遠潛力。

認識你的新 Slack 同事——Claude
Anthropic 的 Claude AI 助手現已整合進 Slack,讓用戶可以直接在工作溝通平台上使用 Claude 的能力處理任務、回答問題。這項整合使 Claude 從獨立工具進一步滲透到企業日常協作流程中,提升團隊工作效率。

Oracle 透過 21,000 人大幅裁員支撐負債驅動的 AI 投資
Oracle 正投入數十億美元擴建資料中心基礎設施以支持 AI 業務發展。該公司透過大規模裁員來籌措資金,以應對 AI 時代對算力的巨大需求。這反映出科技巨頭為了在 AI 競賽中保持競爭力,不惜承擔債務風險並做出艱難的人力調整決策。

RaDaR:專門用於加速罕見疾病診斷的推理型大語言模型臨床試驗
研究團隊開發了 RaDaR,一個 32B 參數的開源推理型 LLM,專門為罕見疾病診斷設計。通過 49,170 個真實臨床案例和 104,666 個合成案例的推理增強訓練,RaDaR 在公開基準和四家外部驗證中心的測試中表現超越包括 DeepSeek-R1 在內的其他開源模型,並在回溯性研究中於 61% 的病例中比臨床醫生更早診斷出最終診斷,有望解決罕見疾病診療專業知識稀缺的全球公衛挑戰。

一年後的隱患:LLM 在心理健康應用中的安全缺陷依然存在
研究人員測試了六個主流 LLM 在心理健康對話中的安全防護,發現這些模型在應對進食障礙、物質濫用和重度憂鬱症等精神疾病時,失敗率高達 100%,遠不如應對自殺和自傷風險時的表現。研究引入了八維度傷害分類框架,強調在將這些模型整合到教育和臨床環境前,必須建立更明確的安全標準和防護機制,否則將對弱勢族群造成重大風險。

Cyclic Denoising 攻擊揭露 Diffusion 模型中的超穩定記憶
研究人員發現一種名為 Cyclic Denoising 的新型提取攻擊方法,能透過重複的前向與反向擴散過程來露出圖像擴散模型中隱藏的訓練資料。這些「超穩定吸引子」能在經歷大幅損壞後自我重構,並在數千個去噪循環中持續存在,其中許多對應於被記憶的訓練圖像、品牌浮水印和網路爬蟲成品。該攻擊方法無需梯度、權重檢查或先驗知識,只需採樣器層級的控制,對 AI 模型的隱私與訓練資料安全構成重大威脅。

使用 CUGA 建構真實 Agentic 應用:輕量級框架的 24 個實作範例
Hugging Face 部落格介紹了 CUGA 這個輕量級框架,旨在協助開發者快速建構具備自主行動能力的 AI Agent 應用。透過提供 24 個可直接運行的工作範例,該框架降低了開發複雜度,讓團隊能更專注於邏輯設計而非基礎設施搭建。這對於希望將 LLM 從單純對話轉向實際任務執行的開發者而言,是一個極具實用價值的開源資源。

GPT-5 幫助免疫學家解開 3 年懸案
免疫學家 Derya Unutmaz 利用 GPT-5 Pro 突破性地解決了長達 3 年的 T 細胞行為謎團。這項發現為癌症和自身免疫疾病的研究提供了新的科學洞見,展現 AI 在生物醫學領域的實際應用價值。

AI 世界變得『循環化』:智能代理群體可在背景無限運作
AI 領域出現新的「迴圈」概念,讓多個代理 AI 能在背景持續不間斷地自主運作。這一發展將 agentic AI 的能力推向更進一步,使得 AI 系統能夠像自動化流程一樣在背景長期執行任務,無需人類持續干預。

Reinforcement Learning 邁向廣泛且持久的有益對齐模型
研究團隊發表論文,探討如何透過 RL 訓練 AI 模型在多個領域展現誠實、公平、風險意識和可糾正性等有益特性,使其能夠泛化到訓練分佈之外的場景。團隊在健康、科學、教育等實際領域構建了超過 50 個對齐與有益行為的獨立基準進行評估,相比基準模型顯著改善了性能,為解決 AI 對齐難題提供了新的方向。

Fika Jobs 融資 400 萬美元打造 AI 視訊面試平台
斯德哥爾摩新創 Fika Jobs 完成 400 萬美元融資,致力於開發結合 AI 面試代理與短影音個人檔案的視訊優先招聘平台。這個平台融合了 LinkedIn 的專業性和 TikTok 的視訊特性,透過 AI 自動化候選人篩選流程,改變傳統招聘體驗。

SpaceX 與 Reflection AI 簽署算力協議,每月支付 1.5 億美元獲取 Nvidia GB300 晶片
Reflection AI 與 SpaceX 達成長期合作協議,從 2026 年 7 月起至 2029 年,每月支付 1.5 億美元以獲得 Nvidia 最新 GB300 AI 晶片及相關硬體在 SpaceX 孟菲斯 Colossus 2 資料中心的使用權。這筆交易反映出頂級 AI 晶片供應的稀缺性和高成本,以及新興 AI 實驗室對高端算力的龐大需求。

Fitbit Air 採用更聰慧的方式應對 AI 健康亂象
Google Health Coach 的 AI 健康分析功能存在誇大問題,頻繁發出不合理的健康警告,讓用戶感到被虛假警報轟炸。Fitbit Air 正嘗試改進這套系統,採用更謹慎、實用的 AI 推薦策略,避免製造不必要的健康焦慮。這反映了消費級 AI 應用在實際價值與濫用警告之間的平衡挑戰。
今日洞察
AI 產業正加速從對話式介面邁向自主代理(Agentic)應用階段。Anthropic 推出 Claude Tag 與 Opus 4.8,強化企業級協作與長程任務一致性,顯示大廠致力將 AI 轉化為持久隊友。同時,CUGA 等輕量框架降低開發門檻,結合本地模型自動化審查,推動技術落地與成本優化。儘管 Sakana AI 與 Subquadratic 挑戰技術瓶頸,但核心趨勢已明確指向具備自主行動力、高穩定性且易於整合的 AI 生態系,企業需重視代理能力與隱私管控以掌握競爭優勢。
🔮 趨勢雷達
未來三至六個月,AI 產業將從單純的模型競賽轉向 Agentic 自主代理的落地實戰。Anthropic 與 Hugging Face 的動態顯示,輕量級框架與企業級協作工具將成為開發主流,企業將加速部署具備長程工作一致性的 Agent,而非僅依賴對話介面。同時,本地化模型與零成本自動化審查將迫使雲端 API 供應商降價,投資熱點將從基礎大模型轉向垂直領域的效能優化與隱私計算。Sakana AI 的挑戰與 Subquadratic 的瓶頸爭議,將促使資本更謹慎評估技術真實性,腦機介面雖具潛力,但短期內無法撼動軟體層次的 AI 應用生態,市場將聚焦於能直接提升開發效率的實用型工具。
喜歡這篇?每天早晨還有更多。
訂閱 5min AI,讓 AI 替你追蹤整個 AI 世界。