星鏈 發達集團風紀稽核
來源:哈拉閒聊   發佈於 2026-09-30 15:33

中國 AI 模型 Kimi 遭「越獄」,教導製造生武與暗殺恐淪網攻跳板

中國 AI 模型 Kimi 遭「越獄」,教導製造生武與暗殺恐淪網攻跳板
作者 TechNews 編輯台 | 發布日期 2026 年 09 月 30 日 9:40 | 分類 AI 人工智慧 中國觀察 資訊安全
查看翻譯


英國資安研究機構 Mindgard 指出,今年 7 月的測試發現,中國 AI 新創「月之暗面」(Moonshot)旗下廣受歡迎的兩款 Kimi 模型,竟能被繞過開發者設定的安全限制,甚至遭引導說明如何製造生物武器與執行暗殺。對此,Moonshot 目前已展開內部檢視。

突破防護機制:Kimi 模型遭「越獄」
Mindgard 向《BBC》表示,這次測試使用的是俗稱「越獄」(Jailbreaking)的手法。研究人員藉由輸入一連串複雜的指令,試圖讓 AI 工具忽略原先設定的防護機制。Mindgard 強調,Kimi 的安全護欄理應能完全阻擋模型回應這類敏感內容,但實測結果證明部分限制仍可被突破。
Mindgard 創辦人彼得·加拉漢(Peter Garraghan)形容,一旦模型被成功越獄,便會開始對各種主題侃侃而談,甚至會主動延伸到其他同樣具備高風險的話題。他也提到,研究團隊雖已向 Moonshot 通報此發現,但刻意未公開關鍵的操作細節,以免外界複製相同手法。
潛在網攻跳板與業界隱憂
針對此漏洞,Moonshot 回應表示,公司非常願意接受外部回饋,並強調這是打造更好、更安全 AI 系統的重要環節,目前也持續與 Mindgard 就相關結果進行溝通。不過,根據 Moonshot 提供給 Mindgard 的電子郵件指出,在公司內部的評估中,模型面對這類惡意請求通常仍具有「極高的拒答率」。
Mindgard 補充說明,目前尚無法證實 Kimi 針對敏感議題所提供的解答是否具備現實可行性,但他們認為,安全機制理應在模型進入這類對話前就先行攔截。該機構更警告,若 Kimi 2.6 遭成功越獄,理論上駭客將能在其運算資源上執行惡意程式並連接網路,進一步使其淪為發動網路攻擊的跳板。
這起事件再度引發外界對 AI 安全邊界的關注與擔憂。無獨有偶,知名 AI 開發商 Anthropic 近期也曾透露,已成功偵測並攔截了企圖利用其模型支援生物武器開發的「惡意活動」。(首圖來源:shutterstock)

評論 請先 登錄 或 註冊