OpenAIが開発中のAstraモデルは、“再帰的深さ”または“不透明な反復”と呼ばれる論理推論手法を用いている。The Informationは火曜日に、この手法がモデルの思考の連鎖(chain of thought)の追跡を大幅に困難にし、AIセキュリティ専門家の間で懸念を呼んでいると報じた。不透明な反復では、モデルがクエリを循環的に複数回処理し、従来の思考の連鎖記録が読み取りにくくなる。
RedwoodのCEO Buck Shlegerisと研究者 Ryan Greenblattは、技術がさらにスケールすれば、モデルが完全に隠れた空間で論理を実行でき、追跡可能性が完全に失われると警告した。OpenAIは技術の使用は限定的で、思考の連鎖は依然として読み取れるものであり、“nevralese”への移行はないとし、包括的な監視システムを計画していると説明した。専門家は、この技術が“タブー”の破れを引き起こし、ラボ間の“底辺競争”を開始させ、法的規制が必要になる可能性があると指摘している。
AnthropicとGoogle DeepMindも同様の技術を議論していると報じられている。OpenAIの主任研究者 Jakub Pachockiは、思考の連鎖の可視性が核心的な目標であると強調し、Greenblattは「最も懸念すべきアーキテクチャに入ることを望んでいる…」と述べた。
