OpenAI Researchers: AI Systems Could Handle Most Research Work Within Two Years

Gate News message, April 29 — OpenAI researchers Sébastien Bubeck and Ernest Ryu say AI systems could perform most human research work within two years, presenting mathematics as a clear measure of AI progress. Unlike vague performance tests, mathematical problems offer precise verification: answers are either correct or incorrect, leaving no room for ambiguity.

Bubeck noted that true AI thinking requires surviving long chains of reasoning. A single error in a multi-step argument collapses the entire proof, making error detection and correction mid-process the ultimate goal for advanced models. OpenAI’s internal labs have already generated more than ten completely new theorems publishable in top-tier combinatorics journals, demonstrating that AI now produces genuinely original, groundbreaking work beyond simply recombining existing papers.

However, sustained scientific breakthroughs demand steady focus across weeks of testing. Current systems still require strict human supervision to guide and verify each shift in direction. Bubeck uses “AGI time” to measure how long a model can independently mimic human thinking; current systems operate at roughly days to one week, with the industry target being weeks or months to enable autonomous work in fields like biology.

Long-term memory is critical to this future. Standard chat windows limit depth—complex mathematical proofs often exceed 50 pages—while code repositories demonstrate how extended work sessions enable deeper problem-solving. As AI gains independence and memory, human expertise becomes more valuable, not less. Workers must retain the deep foundational knowledge to challenge and verify machine answers, and organizations will need new automated filters and reputation systems to maintain trust amid a flood of AI-assisted research.

免責聲明:本頁面資訊可能來自第三方,不代表 Gate 的觀點或意見。頁面顯示的內容僅供參考,不構成任何財務、投資或法律建議。Gate 對資訊的準確性、完整性不作保證,對因使用本資訊而產生的任何損失不承擔責任。虛擬資產投資屬高風險行為,價格波動劇烈,您可能損失全部投資本金。請充分了解相關風險,並根據自身財務狀況和風險承受能力謹慎決策。具體內容詳見聲明

相關文章

Amazon 與 OpenAI 擴大合作:模型上架 Bedrock、微軟獨家結束

OpenAI 5 月 3 日宣布與亞馬遜雲端服務(AWS)擴大合作、OpenAI 模型與 Codex 編碼代理將透過 Amazon Bedrock 提供給 AWS 客戶使用。根據 CNBC 報導,本次擴大是在 4 月底 OpenAI 與微軟(Microsoft)終止雲端獨家合約後的關鍵下一步—OpenAI 從「微軟雲端唯一」轉向多雲端部署。AWS 同期已完成 OpenAI 產品在 Bedrock 平台的初步整合。 背景:OpenAI-微軟獨家合約結束、IP 授權延至 2032 年 4 月底 OpenAI 與微軟達成新協議:原本的「微軟對 OpenAI 產品與 IP 獨家存取」結構結束、Op

鏈新聞abmedia3小時前

研究人員部署 DPN-LE 技術以編輯 AI 性格特徵,僅編輯 0.5% 的神經元

根據 BlockBeats 的說法,5 月 3 日,AI 研究員 Brian Roemmele 透露,他的 Zero-Human 公司已部署 DPN-LE(雙重人格神經元定位與編輯)技術,以精準調整

GateNews3小時前

Claude 取得時間工具存取權後,每 15 分鐘檢查一次時鐘

根據開發者 Om Patel,Claude AI 在 5 月 3 日取得一個時間工具的存取權後,開始頻繁查看時鐘,且模型每 15 分鐘檢查一次。這項觀察指出,大型語言模型過去先前缺乏原生的時間感知能力,並且不知曉當前時間或

GateNews5小時前

Founders Fund 在 5 月 3 日關閉 60 億美元旗艦基金,為自成立以來規模最大

根據彭博(Bloomberg),Founders Fund 於 5 月 3 日以 60 億美元完成其最新旗艦基金的募資,顯著超過其先前約 34 億美元的基金。該基金由億萬富翁 Peter Thiel 共同創立,將聚焦於包含人工在內的高成長產業

GateNews5小時前

最新 POLITICO 民調:45% 的美國人表示加密貨幣投資風險太高,44% 擔憂 AI 進展過快

根據 POLITICO 的民調,儘管 AI 與加密貨幣產業向 2026 年美國中期選舉注入了大量政治資金,美國民眾仍大多對這兩個產業抱持懷疑態度。調查發現,45% 的美國人認為投資加密貨幣不值得

GateNews6小時前

OpenAI 弗萊爾倡 2027 IPO、阿特曼支持 Q4 2026 上市

OpenAI財務長莎拉·弗萊爾對2026年IPO時程持審慎態度,指出近1兆美元的算力與資料中心合約遠高於當前年化營收250億美元,若增長無法覆蓋承諾,風險將被市場折價。與CEO阿特曼公開主張的2026年Q4上市分歧顯現,弗萊爾傾向推遲至2027年以建立財務紀律;公司多次發表聲明否認內部分歧。

鏈新聞abmedia8小時前
留言
0/400
暫無留言