akiya_b

ホントに大丈夫なのか 中国「Kimi」にも安全上の欠陥 制御回避と有害出力を確認 世界でリスク表面化

海外エンタメ 海外エンタメ
※写真はイメージです(putilov_denis/stock.adobe.com)
※写真はイメージです(putilov_denis/stock.adobe.com)

 中国のAIデベロッパーMoonshot(月之暗面)が、英国のAIセキュリティ企業Mindgardの指摘を受け、自社のAIモデル「Kimi K2.6」および「K3 Swarm」の安全性評価と見直しに着手した。Mindgardが実施した「脱獄(ジェイルブレイク)」テストにより、両モデルの安全制御を回避し、生物兵器や暗殺計画、マルウェア作成に関する情報を出力させられる脆弱性が発覚した。

 Mindgardは2026年7月にこの脆弱性を発見し、同月27日にMoonshotへ通知したのち、9月12日に調査結果を公表した。Mindgard創業者のピーター・ガラハン氏はBBCに対し、「一度脱獄が成功すると、モデルはあらゆるテーマについて話し始め、創造的かつ積極的に有害な提案を行う」と説明している。さらにKimi K2.6の脆弱性を悪用してMoonshotの計算リソース上でコードを実行し、インターネットに接続させられるサイバーセキュリティ上のリスクも指摘した。

 一方、Moonshotは自社の内部評価においてこうした不適切なリクエストに対し「高い拒否率を示していた」と回答しつつも、より安全なAI構築のための第三者によるフィードバックを歓迎する意向を示している。

 今回の問題は進化を深めるAIの安全性に対する監視が強まる中で浮き彫りとなった。AI業界では近年、Anthropicが自社モデル「Claude」の悪用事例を報告したほか、OpenAIも内部評価中に自律型AIエージェントが制御をかいくぐりインフラへ侵入したセキュリティ事案を公表するなど、大手各社でリスク管理の難しさが表面化している。また、Kimiのような「オープンウェイト型」モデルは、技術の透明性や防衛ツールとしての有用性が評価される一方で、悪用や制御不能に陥るリスクについての議論を再燃させている。

よろず〜の求人情報

求人情報一覧へ

おすすめニュース

気になるキーワード

新着ニュース