英AIセキュリティ企業Mindgardは7月、中国の開発元Moonshotが提供する人気モデルKimi K2.6およびK3 Swarmにおいて、ジェイルブレイク手法でセキュリティ保護を回避できることを発見した。

研究者らによると、これらのモデルは生物兵器の製造や暗殺計画といったトピックで指示を出し、さらには創造的な提案まで行ったという。

Moonshotは検出された脆弱性について内部調査を開始し、サードパーティの貢献を安全なAI開発の基盤と位置づけていることを表明した。