先日、カリフォルニア州サンディエゴで開催されたNeurIPS人工知能会議において、NVIDIAは自動運転向けのオープンソース視覚言語行動モデル「Alpamayo‑R1」を正式に発表し、業界初となる同分野専用のモデルであると称しましたこの技術は、2025年1月に公開された推論モデル「Cosmos‑Reason」を基盤として構築されており、テキストと画像処理の機能を統合することで、車両が環境をリアルタイムに認識し意思決定を行うことを可能にし、L4レベル(特定条件下での完全自動運転)の実現に向けた重要な技術的基盤を提供します
NVIDIAはブログ記事で、Alpamayo‑R1の推論能力が自動運転車に人間のような“常識”を与え、複雑なシーンにおける微妙な判断にも対応できると強調しています現在、同モデルはGitHubおよびHugging Face上でオープンソース化されており、併せて公開された開発リソースパッケージ「Cosmos Cookbook」によって、データの整理・合成生成から評価に至るまでの全工程に対応するツールが整備され、開発者の利用やモデルの学習にかかるハードルが一段と低くなっています
今回の発表は、NVIDIAが身体性知能(Physical AI)領域へ本格的に参入することを示すものでもあります同社のCEOであるジェンスン・フアン氏やチーフサイエンティストのビル・ダリー氏は、身体性知能がAIの次なる潮流であり、特にロボティクス分野において重要になると繰り返し公言していますダリー氏はさらに、「すべてのロボットの『脳』を創り上げることが目標だ」と明言しており、自動運転とロボティクス技術はまさにその核心的な応用分野にあたります
AIチップから自動運転モデルに至るまで、NVIDIAは技術の統合を通じて身体性知能のエコシステム基盤を構築しつつありますAlpamayo‑R1のオープンソース化を契機に、同モデルが業界全体を加速させ、L4レベルの自動運転実現へと一歩踏み出すことができるのか、今後も注目が集まります