繁體
  • 简体中文
  • 繁體中文

熱門資訊> 正文

Anthropic表示人工智能可能很快在沒有人類幫助的情況下進行自我升級

2026-06-05 05:02

Anthropic正在將越來越多的人工智能開發份額委託給人工智能系統,並且它可能會開發自己的繼任者,並稱其為「循環式自我改進」。"

「我們還沒有做到這一點,循環自我完善並非不可避免。但它可能會比大多數機構準備的更早到來,」該公司在最近的一篇博客文章中寫道。

該報告描述了Anthropic內部的轉變,從早期由人工編寫的代碼主導的工作流程轉向可以執行任務、運行代碼並將工作移交給其他代理的軟件代理。它將這一進展框架為一條途徑,隨着時間的推移,可以在最少的監督下完成從協助工程師到培訓和改進模型的循環。

另請閲讀:1.8美元萬億私人信貸市場面臨估值測試

Anthropic研究所利用內部指標表示,到2026年5月,Claude負責合併到Anthropic代碼庫的80%以上的代碼,高於2025年2月的個位數水平。

該公司還報告稱,在人工智能代理從建議代碼片段發展爲獨立執行和迭代更長的任務后,工程師的生產力大幅提高,2026年第二季度工程師每天合併的代碼大約是2024年的八倍。

Anthropic警告説,原始代碼數量可能會誇大生產力的提高,稱代碼行是一個不完美的衡量標準,儘管內部反饋表明人工智能正在使員工能夠更快地完成核心任務。

在2026年3月對130名研究人員進行的一項內部調查中,受訪者估計,他們使用Mythos Preview產生的產出大約是沒有人工智能工具時的4倍。

「我們預計三月份的真實上升程度稍低。儘管如此,我們發現總體説法是合理的,並且與我們的其他觀察結果一致:Anthropic技術人員的很大一部分完成核心工作的速度是在沒有人工智能幫助的情況下的好幾倍,」該公司寫道。

該研究所還指出,如果沒有代理人,可能不會優先考慮一些工作,包括探索工具和長期推迟的清理工作。在一個例子中,它説Claude提供了800多個修復程序,將一類API錯誤減少了1,000倍。監督工程師估計,同樣的工作一個人需要大約四年的時間才能完成。

Anthropic還指出,人工智能能夠獨立可靠完成的任務長度大約每四個月就會翻一番。這高於早期每七個月翻一番的趨勢。

「2024年3月,Claude Opus 3可以完成人類大約需要四分鍾才能完成的軟件任務。一年后,Claude Sonnet 3.7管理了大約一個半小時的任務。一年后,Claude Opus 4.6完成了12小時的任務。1如果這一趨勢持續下去,需要熟練人員幾天的任務今年可能會進入任務範圍。到2027年,人工智能系統可能能夠完成需要一個人數周時間的任務,」該公司表示。

該報告還強調了包括SWE-Bench和CORE-Bench在內的基準進展,稱分數在相對較短的時間內從低水平轉變為接近上限的表現。它補充説,METR發現Claude Mythos預覽版可以工作「至少」16小時,並且「處於[METR]在沒有新任務的情況下可以測量的上限」。"

模型可能會執行定義明確的任務,但它們在決定工程和研究中追求哪些目標方面仍然落后於人類。

該研究所認為,縮小這一差距對於任何未來可以設計自己的繼任者的系統來説都至關重要,並表示這種可能性將增加安全、監控和行為塑造控制的風險。

本月早些時候,Anthropic向美國證券交易委員會祕密提交了S-1表格草案,賦予這家人工智能公司在美國證券交易委員會完成審查后上市的選擇權。

上個月,Anthropic在H輪融資650億美元后超過OpenAI成為世界上最有價值的創業公司,該公司的估值為9650億美元。Altimeter Capital、Dragoneer、Greenoaks和Sequoia Capital領投了本輪融資。

如果Anthropic以1萬億美元的估值上市,它將立即躋身全球最有價值的公司之列,並可能成為歷史上第二或第三大IPO,僅次於SpaceX和沙特阿美。

照片:Shutterstock

另讀:Ramp估值達到440億美元,擴大對人工智能金融的推動

風險及免責提示:以上內容僅代表作者的個人立場和觀點,不代表華盛的任何立場,華盛亦無法證實上述內容的真實性、準確性和原創性。投資者在做出任何投資決定前,應結合自身情況,考慮投資產品的風險。必要時,請諮詢專業投資顧問的意見。華盛不提供任何投資建議,對此亦不做任何承諾和保證。