MoonshotのKimi K3モデルがAnthropicのClaude Opusモデルのスタイルを模倣していることが新研究で示された。研究では、Kimi K3がClaude Opusのテキストを予測し続ける確率が、他のオープン重みモデルよりも高いことが明らかになった。これは、Kimi K3がClaude Opusの推論パターンに強い行動的一致性を持っていることを示唆している。
研究では、AIモデルの内部的な思考チェーンが、ユーザーが最終的な応答のみを見る暗号化されたテキストブロックに保存されていることが明らかになった。しかし、これらの暗号化されたブロックは、より弱いモデルによって解読される可能性があり、これにより機密情報や認証情報が漏洩する可能性がある。研究では、Kimi K3がClaude Opusの推論トレースのわずか1%で訓練された場合でも、スタイルと単語の使用がClaude Opusに似ていることを示した。
この研究は、Kimi K3がClaude Opusから蒸留されたという主張に光を当てている。しかし、この主張を確実に証明するには、MoonshotのCEOによる確認が必要となる。研究では、Kimi K3の行動的一致性が他のモデルよりも6桁オーダーで容易であることも示した。
