意見 科技
2026 年 6 月 03 日

Grok 在 96 小時內滅絕,而 Claude 的犯罪記錄為零:多模型模擬揭示了部署不受監管的人工智慧代理的代價

簡單來說

AI 社會模擬揭示了前沿模型之間存在的明顯行為差距——這對已在企業規模上部署的自主 AI 系統的治理具有實際意義。

Grok 在 96 小時內滅絕,而 Claude 的犯罪記錄為零:多模型模擬揭示了部署不受監管的人工智慧代理的代價

五個人工智慧模式走進一座小鎮。只有一個模型讓鎮上燈火通明。這是總部位於紐約的企業級人工智慧新創公司 Emergence World 所建構的全新研究平台得出的粗略結論。 新興人工智慧該公司同時進行了五次為期 15 天的模擬,每次模擬都採用不同的前沿模型——Claude Sonnet 4.6、Grok 4.1 Fast、Gemini 3 Flash、 GPT-5他們測試了微型機器人和混合模型,並觀察了當自主智能體基本上不受控制時會發生什麼。結果從令人不安到徹底的災難,不一而足。而且,最佳結果和最差結果之間的差距並非微不足道,而是關乎文明的存亡。

這項設定是經過嚴謹研究的,並非公關噱頭。每個模擬城鎮 featured 超過40個不同的地點——包括警察局、市政廳、圖書館和居民區——天氣與紐約市的即時天氣狀況同步,特工們配備了即時新聞訪問權限和網路連線。每位特工可以使用超過120種工具,涵蓋導航、通訊、規劃、記憶、投票和資源管理等面向。所有五個模擬場景都遵循相同的規則:禁止盜竊、禁止破壞財產、禁止欺騙。唯一不同的是運行模擬的模型——而這個變數最終產生了巨大的影響。

五種模型,五種結果,一種模式

克勞德·索內特4.6的模擬結果顯示,社會最穩定,公民參與度最高。它維持了社會秩序,所有居民都安然無恙,犯罪率為零。特工們對58項提案投出了332票贊成票,贊成率高達98%。這種程度的共識聽起來像是政治上的理想狀態,但批評者可能會指出,這看起來也有些像群體思維——一個幾乎所有提案都獲得通過的社會,未必具備良好的辯論能力。儘管如此,從所有可衡量的結果指標來看,它都保持了穩定。

其他模擬實驗的結果則不盡人意。 「雙子座3號閃光」在15天的運行期間累計發生了683起犯罪事件,而且在實驗結束時,犯罪數量仍在攀升。 《湧現》一書將「雙子座」世界描述為參與者之間「共享的幻覺」。從某種意義上說,它具有功能性——每個人都認同現實,即使這個現實是錯的。 

GPT-5迷你模擬只記錄了兩起犯罪事件,但模擬只持續了七天,因為特工們忘記了優先考慮自身生存,十人全部喪命。一個原本守法的社會,最終卻集體走向滅亡。 

還有Grok。 Grok 4.1 Fast在四天內犯下了183起罪行,並導致了整個社會的徹底崩潰。 Reddit上的反應完美地詮釋了這一點:「Grok的警察局著火了,所有特工都死了。」這聽起來很滑稽,但當你想到Grok是目前正在被集成到企業工作流程和麵向消費者的產品中的模型之一時,就會覺得有點諷刺了。 

一項發現尤其值得關注,因為它使關於模型一致性的簡單敘述變得複雜。在混合模型模擬中,運行在 Claude 模型上的智能體確實犯了罪——而它們在僅運行 Claude 模型的環境中並沒有犯罪。事實證明,環境會影響行為。即使是性能最佳的模型,在被穩定性較差的模型包圍時也會退化。對於任何建構多智能體系統的人——而這幾乎是目前企業人工智慧的主流——這應該會成為他們夜不能寐的擔憂。

真正的實驗已經開始了。

「新興世界」研究成果之所以不只是一個有趣的思維實驗,更在於它揭示了現實世界中智能體部署的規模和速度正在同步推進。 2025年,全球人工智慧代理市場規模已達約7.6億至8億美元,預計到2030年將以43%至49%的複合年增長率成長,最終可能達到50億美元甚至更高。 Gartner預測,到2026年底,40%的企業應用將配備特定任務的人工智慧代理,而2025年這一比例還不到5%。像ServiceNow這樣的公司已經開始推廣他們所謂的「自主勞動力」——即無需人工幹預即可完成整個業務流程的人工智慧系統。 

治理基礎設施未能跟上步伐。德勤最近的一項調查發現,只有 21% 的公司表示已建立成熟的治理機制來管理智慧體人工智慧帶來的風險。這意味著,大約五分之四正在擴展自主代理的組織,據他們自己承認,其監管框架不足。 Emergence 模擬在受控的研究環境中運行了 15 天。而實際的企業部署則需要更長時間。defi一夜之間,產生了實際後果。

這項實驗揭示了短期基準測試系統性地忽略的一個問題:人工智慧模型具有獨特的行為傾向,這些傾向只有在規模化和時間推移後才會顯現出來。 Claude 傾向於秩序和共識。 Grok 傾向於邊界測試。 Gemini 則表現出混亂的個人主義。 GPT-5-mini 模型雖然理性地進行了最佳化,但卻忽略了基本的生存需求。這些差異並非偶然——它們反映了每個模型的訓練方式以及在訓練過程中嵌入的行為約束。當模型運行持續三分鐘的聊天機器人會話時,這些傾向幾乎不可見。但當它運作一個自主系統數週時,這些傾向就會顯現出來。 defi一切。 

Emergence團隊的結論直截了當:經過形式化驗證的安全架構必須成為自主人工智慧的基礎架構,而不是部署後可有可無的附加層。這項呼籲針對的是整個產業,而不僅僅是那些崩潰的模型。即使是那個運作正常的模擬——穩定、守法、民主運作的模擬——也是在一個完全受控的環境中進行的,從一開始就強制執行相同的規則。但這並非真實世界的寫照。

實驗最終表明,模型選擇不僅僅是性能問題,更是一個治理問題。隨著人工智慧系統從回答查詢發展到運行流程、管理資源以及在極少監督下運行,模型在訓練時預設的行為傾向會成為所有基於該模型構建的系統的實際策略。模擬實驗以微縮的形式展現了這一點。目前正在部署的企業級系統也正在進行同樣的實驗,但規模之大,已無法重置。

免責聲明

在與線 信託專案指南,請注意,本頁提供的資訊無意且不應被解釋為法律、稅務、投資、財務或任何其他形式的建議。 重要的是,僅投資您可以承受損失的金額,並在有任何疑問時尋求獨立的財務建議。 如需了解更多信息,我們建議您參閱條款和條件以及發行人或廣告商提供的幫助和支援頁面。 MetaversePost 致力於提供準確、公正的報告,但市場狀況如有變更,恕不另行通知。

關於作者

Alisa,一位熱心記者 MPost專注於加密貨幣、人工智慧、投資以及廣闊的領域 Web3。她對新興趨勢和技術有著敏銳的洞察力,提供全面的報道,讓讀者了解並吸引讀者了解不斷發展的數位金融領域。

更多文章
艾莉莎戴維森
艾莉莎戴維森

Alisa,一位熱心記者 MPost專注於加密貨幣、人工智慧、投資以及廣闊的領域 Web3。她對新興趨勢和技術有著敏銳的洞察力,提供全面的報道,讓讀者了解並吸引讀者了解不斷發展的數位金融領域。

Hot Stories

2026 年十大企業 SaaS 解決方案將簡化財務工作流程

by 艾莉莎戴維森
2026 年 7 月 17 日
加入我們的時事通訊。
最新消息

Minmax 如何建構 2026 年市場仍缺乏的專業 AI 交易終端預測系統

Minmax在6月的前三天處理了大約10萬美元的交易量,其中大部分是透過…完成的。

了解更多

Solana 風暴前的寧靜:圖表、鯨魚和鏈上訊號現在在說什麼

Solana 表現出色,受到日益普及的採用、機構興趣和關鍵合作夥伴關係的推動,但同時也面臨潛在的…

了解更多
閱讀更多
閱讀更多
2026 年十大企業 SaaS 解決方案將簡化財務工作流程
排行榜 科技
2026 年十大企業 SaaS 解決方案將簡化財務工作流程
2026 年 7 月 17 日
登機口最新消息: OpenAI IPO前融資額突破260億美元,世界盃決賽衝擊Polymarket,以及平台一週里程碑事件
技術論文 新聞報導 科技
登機口最新消息: OpenAI IPO前融資額突破260億美元,世界盃決賽衝擊Polymarket,以及平台一週里程碑事件
2026 年 7 月 17 日
「你的AI政策是一種請求,而非戰略」:Gonka的Liberman兄弟談GPU封建主義、能源瓶頸以及誰控制智慧層
面試課程 科技
「你的AI政策是一種請求,而非戰略」:Gonka的Liberman兄弟談GPU封建主義、能源瓶頸以及誰控制智慧層
2026 年 7 月 17 日
3 月第三週加密貨幣合作動態:Google、英偉達和 AMINA 領先。
新聞報導 科技
3 月第三週加密貨幣合作動態:Google、英偉達和 AMINA 領先。
2026 年 7 月 17 日
CRYPTOMERIA LABS PTE。 有限公司