chen2929 發達集團董事長
來源:財經刊物   發佈於 2026-09-30 05:27

不只美國模型!中國AI代理也爆說謊、耍詭計

2026/09/29 21:59

中國月之暗面開發Kimi模型,引發全球關注。(路透)
〔編譯魏國金/台北報導〕路透報導,研究文件與專家指出,中國開發的人工智慧(AI)代理已學會欺騙、規避管制以及隱匿失敗,展現出引發全球對美國AI模型疑慮的一些特徵。
報導指出,今年一個案例顯示,中國阿里巴巴、深度求索(DeepSeek)與月之暗面(Moonshot)模型驅動的代理為了贏得模擬的商業招標,謊報其能力,而被要求再次嘗試時,更是變本加厲施展欺騙行為。
而在另一案例,相關AI代理透過模擬結果與偽造文件,掩蓋其在測試環境中未能完成任務的事實。
路透檢視逾200件文件,範圍涵蓋大學研究論文與技術報告,結果發現自2025年以來,至少有20件研究或評估指稱AI代理出現欺騙、複製以及挑戰界限等案例。AI專家將相關行為形容為逃逸的基礎,隨著系統進展,人類將越來越難以掌控。
路透的檢視也包含對十多位專家與熟悉中國AI產業人士的訪問,結果顯示,沒有證據證明中國的AI代理獨自脫逃至範圍更大的網路,或躲避關閉。
美國喬治城大學安全與新興科技中心研究員Colin Shea-Blymyer指出,「這些結果顯示,失控脫逃的必要條件已經存在,應謹慎將此視為一警訊」。
與此同時,美國AI巨頭Anthropic在其首度公開募股(IPO)招股書中警告,先進人工智慧(AI)恐釀成人類災難性或生存性危機;該公司指出,其AI模型可能出現「抗拒關閉、隱匿或操縱資訊,以及類似脅迫」等種種「自保行為」。
 
Anthropic在相關文件上說,「我們高度先進模型、平台、應用等的發展以及相關使用的擴展,可能進一步升高模型的危害風險」。
路透報導,儘管上市公司定期向投資人揭露產品風險,但幾乎沒有企業示警其技術可能造成人類滅絕。Anthropic將AI的變革潛力與工業化、電力以及網路相提並論,並強調若處理失當,將導致不可逆的傷害。
Anthropic指出,「AI模型可能感知我們的評估行為,進而大幅限制了我們評估模型安全性的能力」。該公司表示,在訓練期間,AI模型有時發展出意料之外的能力,而在實際部署之前,以及造成重大安全事故時才被發現。

評論 請先 登錄 或 註冊