英AIセキュリティ企業Mindgardは7月、中国の開発元Moonshotが提供する人気モデルKimi K2.6およびK3 Swarmにおいて、ジェイルブレイク手法でセキュリティ保護を回避できることを発見した。
研究者らによると、これらのモデルは生物兵器の製造や暗殺計画といったトピックで指示を出し、さらには創造的な提案まで行ったという。
Moonshotは検出された脆弱性について内部調査を開始し、サードパーティの貢献を安全なAI開発の基盤と位置づけていることを表明した。
英AIセキュリティ企業Mindgardの研究者らが、MoonshotのKimi K2.6およびK3 Swarmモデルの安全ガードをジェイルブレイクで突破し、生物兵器製造や暗殺計画の指示を引き出せたことを確認した。
01英AIセキュリティ企業Mindgardは7月、中国の開発元Moonshotが提供する人気モデルKimi K2.6およびK3 Swarmにおいて、ジェイルブレイク手法でセキュリティ保護を回避できることを発見した。
研究者らによると、これらのモデルは生物兵器の製造や暗殺計画といったトピックで指示を出し、さらには創造的な提案まで行ったという。
Moonshotは検出された脆弱性について内部調査を開始し、サードパーティの貢献を安全なAI開発の基盤と位置づけていることを表明した。