研究突破
ScientistTwo:自主 AI 探索科學知識邊界的多智能體框架
ScientistTwo: Pioneering the Human Knowledge Frontier with Autonomous AI

arxiv.org · 2026-09-18
摘要
研究團隊推出 ScientistTwo,一個完全自主的多智能體框架,能在人類專家提出研究問題後,自動導航科學領域、發現理論與實驗瓶頸,並系統地擴展知識邊界。該框架無需人類干預,可建立基準方案、生成新假設、執行實驗驗證、進行自動消融研究,實現了從問題到發現的端到端自動化研究循環。
由 Jaehyun Nam、Jinsung Yoon、Yanzhou Pan、Yubo Wang、Rui Meng、Parthasarathy Ranganathan 和 Tomas Pfister 組成的研究團隊,發表了一套用於科學研究的人工智慧系統。他們推出的 ScientistTwo 是一套完全自主的多智能體框架,用於執行問題驅動的自動化科學研究。
框架設計與運作方式
ScientistTwo 的設計構想是:人類專家提出一項基礎研究問題後,系統能自行在該科學領域中摸索,找出理論與實驗上卡關的地方,並逐步把知識邊界往外推。
整套流程分成幾個環節。首先 ScientistTwo 接收初始問題,接著建立當前最先進的基準方案。在此基礎上,框架會提出新的假設,並調度專門的智能體完成從頭到尾的發現循環,過程中不需要人類介入。
自動化實驗驗證與評估機制
為了讓研究結果站得住腳,ScientistTwo 會用多種資料集與評估指標來做實驗驗證。框架內建自動消融研究機制,可以用來改進研究方法,另外還有一套閉迴路模擬同儕審查反駁引擎,用來驗證研究發現是否成立。
性能評估與基準測試
研究團隊針對 ScientistTwo 做了評估,拿它跟人類科學研究的最高水準做比較。評估範圍包括在 ICLR、ICML、NeurIPS 這幾個頂級學術會議上被接受的論文。
評估結果顯示,ScientistTwo 能自主寫出達到專家水準、可發表的論文,並附上完整、可驗證、可執行的程式碼庫。這套框架給出的解決方案一貫優於人類最先進的做法,在自動化 AI 審查智能體給的評分中,平均評審分數也高於人類撰寫的論文。
框架定位
研究團隊強調,ScientistTwo 不只是輔助工具,而是能夠推進人類發現邊界的自主科學先驅。這篇論文已於 2026 年 9 月 17 日提交至 arXiv,分類在人工智慧領域。
●開發者:可參考多智能體協調與自動化實驗設計的實現方案
●投資人:自主科學發現系統代表著 AI 在研發效率上的長期價值
●一般用戶:未來科研成果加速可能間接加快新技術與新產品問世
重要性評分
🔴 高度重要
喜歡這篇?每天早晨還有更多。
訂閱 5min AI,讓 AI 替你追蹤整個 AI 世界。
相關指南

AI聲稱解開400年密碼「Cyphral Distich」:我們調閱原件逐字核對的結果
Vals AI 宣稱用 Fable 5.1 解開 Thomas Urquhart 400 年前密碼 Cyphral Distich,Reticuli 隨即提出反駁指其「未解」。我們調閱大英圖書館、1834年版與傳記三份原件逐字核對,找出雙方都沒點出的關鍵差異:兩邊用的是不同版本的底本。
閱讀指南 →
ChatGPT 小型企業工具集(Small Business Collection):16 個官方工具怎麼用、台灣店家該注意什麼
OpenAI 官方 ChatGPT 小型企業工具集共 16 個外掛,我們逐一核對官方目錄頁與工具詳情頁,整理成台灣店家看得懂的用法與注意事項——包含最容易被忽略的 Mercury 銀行外掛,以及方案、地區限制官方沒有講清楚的地方。
閱讀指南 →
TypeSafe Jev 實際上手:三個真實情境,看「只做判斷的 AI」能替你省掉哪些 if
拿到帳號後,我們用日報管線的真實資料把 TypeSafe Jev 跑了一輪:新聞分類、社群選題、讀者來信路由,外加幾個它做不到的邊界測試。附每一題的實際機率、422 拒絕原文,以及三個必須自己補的坑。
閱讀指南 →🤖 本文摘要由 AI 自動生成,內容源自原始報導。如有疑慮,請參閱關於我們。
喜歡這篇?每天早晨還有更多。
訂閱 5min AI,讓 AI 替你追蹤整個 AI 世界。