| 又一人離職,Anthropic 科學家:AI 幾年後就會毀滅人類 |
作者 黃 嬿 | 發布日期 2026 年 09 月 09 日 11:34 | 分類 AI 人工智慧 人力資源
查看翻譯 |
|

AI 能力快速躍進之際,第一線研究人員對 AI 失控的憂慮也浮上檯面。曾先後任職 OpenAI 與 Anthropic 的 27 歲英國研究員 Jacob Coxon 宣布辭去 Anthropic 職務,並決定離開 AI 產業。他警告,全球頂尖 AI 公司正競相開發能夠「自我改進」的超級智慧,直言 AI 在十年內可能會毀滅人類。
Coxon 過去三年在 OpenAI 與 Anthropic 從事 AI 模型預訓練研究。他 8 日在社群平台 X 發文表示,兩家公司都沒有承擔與技術風險相稱的責任,反而持續朝能自我提升的超級智慧前進,「拿我們的生命冒險」。
他特別擔心的是 AI「自我改進」能力。現階段 AI 已能協助程式設計、尋找軟體漏洞與執行複雜任務,如果未來 AI 能進一步協助設計、訓練甚至改善下一代 AI,技術進步速度可能突然加快。Anthropic 自己今年也曾警告,按照目前趨勢,未來 AI 可能有能力參與設計自己的後繼模型,而這種「遞迴式自我改進」可能增加人類失去控制的風險。
Coxon 甚至預測,AI 系統很快就能「入侵任何東西,一夜之間徹底改變任何領域,並獲得真正的權力和資源」。部分頂尖 AI 研究人員私下對這種情境的憂慮,遠比公開場合表達得更加嚴重,他們真心相信 AI 可能在這五年內就對人類造成災難性威脅。
問題出在競爭機制
Anthropic 本身就是由一群離開 OpenAI 的研究人員創立的。Dario Amodei、Daniela Amodei、Chris Olah、Jared Kaplan、Jack Clark 等人在 2020 年前後陸續離開 OpenAI,後來成立 Anthropic,其中一項核心訴求就是更重視 AI 安全與可控性。現在連 Anthropic 內部研究員也因擔心超級智慧競賽而離開,問題出在競爭機制本身。
Coxon 也說,他離開 OpenAI 加入 Anthropic,正是看中後者對 AI 安全的重視。Anthropic 確實長期公開討論極端 AI 風險,並建立「負責任擴展政策」(Responsible Scaling Policy),隨模型能力提高採取不同安全措施。今年更主張主要 AI 實驗室建立協調機制,必要時能共同放慢甚至暫停先進 AI 開發。
但他表示,Anthropic 內部對 AI 可能帶來的文明級風險已有充分認識,問題反而在於公司認為,其他競爭者未必會負責任地放慢腳步,因此自己必須搶在其他公司之前取得領先。
AI 不是普通科技
Bill Gates 最近罕見大幅提高對 AI 風險的警告。他表示,AI 進步速度已超過政府與社會準備的速度,除了大量白領、藍領工作可能消失,AI 也可能降低發動網路攻擊與生物攻擊的技術門檻,甚至出現人類難以控制的系統。
蓋茲形容這次與過去的科技革命不同,AI 是一個需要全社會高度政策管理的「演化里程碑」,各國應建立新的國家級監管機構,不能再把 AI 治理完全交給科技公司。不過,Nvidia 執行長黃仁勳最近則是呼籲,各國不要因為「理論上的危害」過度監管 AI,應優先處理已經實際出現的風險,不要用預想中的末日情境限制技術發展。
(首圖來源:
pixabay)