2024年11月に2人の元大手テック企業研究者が設立したスタートアップが、今週新しい視覚AIモデルを発表した。このモデルは倉庫や工場のロボットが環境を認識し、判断して動作することを目指しており、同社は最近ベンチャーキャピタル主導で2100万ドルの資金調達を行ったと発表した。

モデルはオープンウェイトで提供され、パラメータや学習資料は誰でも検証できるように公開されている。同社は、モデルを総計100万時間に及ぶ一般動画、観測カメラから取得したエゴ動画、繰り返し人間の動作を記録したUMI動画などのデータセットで学習させ、ペタバイト規模のデータプールを構築したと述べている。

同社はデータソースの詳細を明かさず、モデルの実際の工場での性能はまだ実証されていない。ソフトウェアは製造、物流、セキュリティなどの分野での利用を見込んで市場投入が予定されており、成功はロボットが多様なタスクを柔軟にこなせるかにかかっている。