
📰 2026-07-09 AI 日報


Anthropic 把 Claude 塞進手機,讓你隨時隨地被工作追殺
OpenAI 推出 GPT-Live-1 語音模型,Anthropic 擴充 Claude Cowork 跨裝置體驗
Google Photos推出AI生成影片新功能「Video Remix」,Meta則在圖像生成領域奪得榜首,展現科技巨頭在生成式AI的激烈競爭。微軟裁員4,800人約占員工總數2.1%,同時業界警告駭客可利用9款熱門AI工具組建大規模殭屍網路,凸顯AI發展伴隨的挑戰。新創公司General Intuition認為機器人產業即將迎來如ChatGPT般的突破時刻,預示AI應用領域的新一波擴展。

Google Photos 推出新 AI 功能「Video Remix」
Google Photos 新增 AI 影片編輯工具 Video Remix,可對影片進行電影級光線調整、背景替換和藝術風格處理。這項功能讓一般用戶無需專業編輯軟體,就能快速美化和創意改造影片內容,進一步降低影片編輯的技術門檻。

Microsoft 裁員 4,800 人,約占員工總數 2.1%
Microsoft 在新財年開始時進行第二波大規模裁員,共裁減 4,800 名員工,約占公司員工總數的 2.1%。這是該公司一年內的第二次重大裁員,首波在去年已裁減約 9,100 人。本次受影響員工主要來自商業銷售部門及 Xbox 遊戲部門,反映科技巨頭在 AI 時代加快組織調整的趨勢。

駭客可利用 9 款熱門 AI 工具組建大規模殭屍網路
研究人員發現名為「HalluSquatting」的新攻擊方式,利用 LLM 無法正確表達「我不知道」的弱點來欺騙 AI 工具。駭客能夠將這一漏洞武器化,利用 9 個最受歡迎的 AI 工具來組建和控制大規模殭屍網路,對網路安全構成嚴重威脅。

當代理人記憶過載:針對大語言模型代理的記憶投毒攻擊
研究人員發現了一種名為 GhostWriter 的新型攻擊向量,能夠針對具備長期記憶功能的 AI 代理進行記憶投毒。這類個人助手代理掌控敏感資訊(如郵件、日曆、代碼倉庫),攻擊者可透過向不受信任的資訊來源注入隱藏攻擊載體,對代理的記憶系統造成污染,進而誘導代理執行惡意操作。

LLMs 與生成式 AI 在資安與隱私中的雙面風險:調查 AI 生成惡意軟體、可解釋性與防禦策略
這份綜合調查研究 LLMs 和生成式 AI 在網路安全領域的應用,涵蓋防禦與攻擊兩個面向。LLM 生成的惡意軟體從 2021 年的 2% 暴增到 2025 年估計的 50%,催生出新型態的自動化威脅;同時這些技術也能驅動零日漏洞檢測、DevSecOps、聯邦學習等防禦應用,需要建立下一代安全框架應對。

Meta 登頂 AI 圖像生成排行榜
Meta 在 AI 圖像生成領域取得重大進展,其圖像模型在評測排行榜上上升至領先位置。此外,Meta 也推出利用 AI 優化員工一對一會議的方案,展示該公司在企業應用場景的擴展。

新創公司 General Intuition 認為機器人產業即將迎來 ChatGPT 時刻
General Intuition 正透過數百萬小時的電玩遊戲影片資料來訓練物理 AI 的基礎模型,目標是讓開發者能夠以最少的真實世界資料來構建更聰慧的機器人。這個方向反映了一個重要趨勢:合成資料與遊戲引擎可能成為機器人產業的訓練基礎,就如同 ChatGPT 改變了大語言模型的發展軌跡。

Google 的 Deepfake 檢測系統被用來揭露 McConnell 造假圖片
本週流傳一張肯塔基州參議員 Mitch McConnell 躺在病床上的圖片,聲稱其身體狀況堪憂,但經過 Google 的 Deepfake 檢測系統驗證,這張圖片實際上是 AI 生成的假圖。這起事件凸顯了生成式 AI 在政治傳播中被濫用的風險,也展示了 AI 檢測工具在識別虛假內容中的實際價值。

你的家庭在 OpenAI 中的 $300 股份
OpenAI CEO Sam Altman 提出的「美國人將分享 AI 創造的財富」承諾再次成為焦點。根據金融時報報導,Altman 正在推進讓普通美國家庭獲得 OpenAI 股份的計畫,每戶約 $300,這是他實現財富共享願景的具體措施。這一舉動反映了 AI 公司對社會責任的考量,也可能影響 OpenAI 的治理結構和股權配置。

OpenAI Academy 與沃爾頓家族基金會合作,幫助 K-12 教育工作者掌握實用 AI 技能
OpenAI Academy 與沃爾頓家族基金會攜手推出「AI Skills Jams」計劃,為 K-12 教育工作者提供親身實踐的 AI 培訓課程。這項舉措旨在幫助教育工作者掌握實用 AI 技能,將 AI 教學融入課堂教學中,擴大下一代對 AI 的理解和應用能力。

重要里程碑:美國核反應爐創紀錄,中國尋求 Nvidia 晶片替代方案
美國四座核反應爐達成能源供應的重要里程碑,同時中國面臨美國晶片制裁加劇,積極尋求 Nvidia GPU 的替代方案。這兩項進展反映了全球能源結構和地緣政治對科技產業的深遠影響,特別是 AI 計算所需的算力基礎設施正成為國家競爭的焦點。

Show HN: Onboard-CLI,一款基於 LLM 與 AST 的程式碼庫可視化工具
Onboard-CLI 是一款結合大型語言模型與抽象語法樹(AST)技術的開源工具,旨在協助開發者視覺化理解程式碼庫結構。此工具透過技術整合,讓複雜的程式碼架構變得更加直觀,有助於提升專案上手與維護的效率。
今日洞察
AI 產業正邁向多模態與高效能並重的新階段。OpenAI 透過 GPT-Live-1 強化語音即時互動與自然沉默機制,顯著提升真人化體驗;Anthropic 則擴展 Claude Cowork 跨裝置支援,深化協作場景。技術層面,Akashic 以 MemAttention 降低推論成本,Onboard-CLI 利用 AST 優化程式碼可視化,分別解決效能與開發效率痛點。同時,研究揭示 LLM 從眾效應多為提示詞混淆所致,提醒業界需重新評估模型推理可靠性。整體而言,產業焦點已從單純能力競賽,轉向提升互動自然度、降低運算開銷及確保決策穩定性的綜合優化。
🔮 趨勢雷達
未來三至六個月,AI 產業將從單純的模型能力競賽,轉向極致優化與落地體驗的深水区。OpenAI 與 Anthropic 的動態顯示,具備即時互動與跨裝置協作能力的語音及協作介面將成為企業級應用的標配,無法提供流暢自然對話體驗的產品將迅速被淘汰。同時,Akashic 等低開銷推論技術的突破,預示著推理成本將大幅下降,促使更多高頻、長上下文場景的應用在 Q3 前普及。然而,研究揭示的 LLM 從眾效應假象,將迫使開發者重新審視評估基準,避免將提示工程缺陷誤認為模型智能,這將引發一輪針對推理可靠性的技術清洗與標準重訂。
延伸閱讀
agents-cli 教學:繁中完整上手指南(功能、定價、實測)
本文提供 agents-cli 教學,詳解 agents-cli 是什麼、怎麼用。涵蓋安裝步驟、中文介面設定、免費方案與實測功能,助您快速上手 AI 代理工具。
Gemini Spark 教學Gemini Spark 教學:繁中完整上手指南(功能、定價、實測)
Gemini Spark 教學完整指南,深入解析 Gemini Spark 是什麼、怎麼用,並提供繁中介面設定、免費方案詳解與實測效能分析,助您快速上手。
LemonLime 教學LemonLime 教學:繁中完整上手指南(功能、定價、實測)
本文提供完整的 LemonLime 教學,詳解 LemonLime 是什麼、怎麼用,並包含免費方案分析與繁體中文實測。適合初學者快速上手,掌握核心功能與最佳實踐。
喜歡這篇?每天早晨還有更多。
訂閱 5min AI,讓 AI 替你追蹤整個 AI 世界。