←新聞 2 / 10→

產品發佈

AWS Weekly Roundup:GPT-6 Sol 與 Luna、Claude Opus 5.5 上架 Amazon Bedrock

AWS Weekly Roundup: GPT-6 Sol and Luna, Claude Opus 5.5 on Amazon Bedrock, Strands harness, and more (September 28, 2026)

AWS Weekly Roundup:GPT-6 Sol 與 Luna、Claude Opus 5.5 上架 Amazon Bedrock

aws.amazon.com · 2026-09-28

摘要

Amazon Bedrock 近期新增 OpenAI 的 GPT-6 Sol 與 GPT-6 Luna,以及 Anthropic 的 Claude Opus 5.5。這三款新模型分別針對開發營運、高頻重複任務及 Agentic 編碼進行優化,並提供比前代更低的定價或更少的 Token 消耗,讓使用者能根據成本與延遲需求精確匹配模型。

模型選擇成為核心議題

AWS 近期在 Amazon Bedrock 平台上架了三款新的大型語言模型:OpenAI 的 GPT-6 Sol 與 GPT-6 Luna,還有 Anthropic 的 Claude Opus 5.5。這些模型上線後,市場關注的重點從「智能極限」轉向「成本與延遲怎麼精準對應」。開發者現在要考慮的不再是單一模型多聰明,而是針對特定任務,在智慧、效率與價格之間怎麼抓平衡。

OpenAI 的 GPT-6 Sol 專門設計給高強度的開發與營運(DevOps)重複性工作用。比起前代產品,Sol 定價更低,用來處理那些繁重又頻繁的技術任務。GPT-6 Luna 則鎖定高頻率、專注型的重複任務,價格同樣比 GPT-5.6 低不少。這兩款模型在智能與效率的曲線上多提供了幾個選擇點,讓使用者可以依照不同負載需求做細部配置。

Anthropic 這邊,Claude Opus 5.5 是 Claude 5.5 家族第一款產品,主打執行 Agentic 編碼與長週期任務時,能用比 Opus 5 更少的 Token 完成更多工作。這三款新模型有個共同方向:推動「任務導向」的模型選擇邏輯,鼓勵使用者別盲目挑最大型的模型,而是依照實際使用場景挑合適的工具。

基礎設施與可觀測性升級

除了模型更新,AWS 也在基礎設施與開發工具上發布了幾項更新。Amazon CloudWatch Omni 正式推出,提供單一協作介面,讓團隊可以同時觀察應用程式與 AI 代理程式。這項服務建構在 OpenTelemetry 上,不用重新配置就能自動顯示既有的遙測數據,透過單一 URL 搭配企業級 SSO 存取,不需要控制台權限。CloudWatch Omni 能自動發現服務、映射依賴關係,還能把 AWS DevOps Agent 整合進調查會話裡,關聯信號、追蹤根本原因。

事件驅動架構方面,Amazon EventBridge 強化了自訂事件匯流排的功能。組織現在可以透過 AWS RAM 部署一個集中式匯流排,供所有帳戶共用。新功能包括可選的事件排序、簡化過的訂閱者資源(把篩選、目標、重試機制整合在一起)、依內容做重複資料刪除,以及對 AWS Lambda 等目標的同步呼叫。新的進出定價模型取代了以往多匯流排設置下複雜的跨帳戶路由費用,現有的匯流排則繼續用「經典」模式運作。

推理優化與 AI 代理程式技能

大型語言模型的推理效能方面,Amazon SageMaker HyperPod Inference Gateway 已經可用。這是一個原生 Kubernetes、具備 GPU 感知能力的路由層,可以作為單一 Amazon EKS 管理附加元件部署,不用改動應用程式程式碼。它不採用輪詢負載平衡,而是根據 KV 快取利用率、佇列深度、前綴快取命中率、預測延遲等即時推理信號來路由。在混合硬體與突發流量的場景下,這個機制可以把首 Token 延遲降低最多 82%,並支援 vLLM、SGLang 等任何 OpenAI 相容的模型伺服器。

另外,AWS End User Messaging 與 Amazon SES 發布了 AI 代理程式技能,支援 AWS MCP Server。開發者現在可以用自然語言指令,讓 AI 編碼代理程式去執行驗證發送身分、發送生產環境電子郵件,或是建立帶卡片與按鈕的 branded RCS 代理程式等任務。這些技能相容 Claude Code、Codex、Cursor、Kiro 等工具,開發者不用在不同文件與控制台之間切換就能完成訊息工作流。

其他動態與活動預告

AWS 也推出了 Strands harness,一個開源(Apache 2.0)的通用代理程式框架,可以在本地運行或部署到雲端。它支援 Amazon Bedrock、Anthropic、OpenAI、Google 以及本地 Ollama 模型,內建提示快取與上下文管理的預設設定。團隊測試顯示,這個框架在準確率不變的情況下,成本比同類框架低約 28%。

市場認可部分,Gartner 把 AWS 列為 2026 年容器管理魔力四象限的領導者,這是 AWS 連續第四年拿到這個位置。同時,AWS 發布了新的 AI 報告,內容根據對 27 國 154 位領導人的訪談,指出當 AI 建構速度加快後,瓶頸會轉移到決策、資金與治理層面。

活動方面,AWS re:Invent 將於 11 月 30 日到 12 月 4 日在拉斯維加斯舉行,預留座位將於 10 月 6 日開放。年度最後一場 AWS Summits 將於 9 月 30 日在杜拜舉行,AWS Community Days 則分別在 10 月 1 日於曼徹斯特、10 月 2 日於羅馬舉辦。

●開發者:可透過 Bedrock 試用針對特定任務優化的新模型以降低成本

●投資人:關注雲端 AI 服務在模型多樣性與定價策略上的競爭

●一般用戶:間接受惠於更高效的 AI 服務與潛在的應用優化

重要性評分

75/100

🟠 值得關注

Amazon BedrockGPT-6Claude Opus 5.5OpenAIAnthropic
原文出處
上一則← Anthropic 發布 Sonnet 5.5,宣稱是更便宜、更快的協作夥伴下一則Qwen4 內測效果提前曝光?前端傳有 Opus 5.5 水準、Qwen4 27B 傳 10 月提前開源 →

喜歡這篇?每天早晨還有更多。

訂閱 5min AI,讓 AI 替你追蹤整個 AI 世界。

相關指南

🤖 本文摘要由 AI 自動生成,內容源自原始報導。如有疑慮,請參閱關於我們。

喜歡這篇?每天早晨還有更多。

訂閱 5min AI,讓 AI 替你追蹤整個 AI 世界。