6月24日に、Google Deepmindは革新的なロボットモデルのGemini Robotics On-Deviceを発表し、クラウド接続に頼らずにモデルが完全にローカルに動作できるようになったときに初めてマークしました.この視覚言語アクション(VLA)モデルは、Gemini 2.}} 0 Archativesting and captection、Ictunate compationtion、Ictunate compations forcement unational rignation、emance contection、emance contection、emance contection、emancetロボットは、オフライン環境で折り畳み、ジッパーを解凍する、さらには靴ひもを結ぶなどの複雑なタスクを正確に実行します。

技術的ブレークスルー:クラウドからエッジへの自律性への飛躍
Gemini Robotics On-Deviceは、軽量のデザインとアルゴリズムの最適化を通じてローカルハードウェアのクラウドベースのモデルに匹敵するパフォーマンスを実現し、高密度触覚センサーとIP67防水デザインを備えた他のローカルソリューション.}}} .を大幅に上回ります。モビリティの条件、歩行速度は、前世代と比較して60%改善されており、バランスの精度はプロの体操選手のものであり、産業集会.などの正確な運用を実行するためのデュアルアームコラボレーションのサポートをサポートしています。
開発者エコシステム:わずか50のデモンストレーションでのカスタマイズ
Googleの最初のオープンチューニングVLAモデルとして、Gemini Robotics On-Deviceは、ApptronikのApollo Humanoid Robot {{3}にルービックキューブをギフトバッグに配置する」など、{3}を{3}に配置する」などの50-100タスクのデモンストレーションで新しいシナリオに迅速に適応できます。仮想環境でモデルをテストし、「信頼できるテスタープログラム{.」を通じてアクセスするために、このイニシアチブは、ハードウェアソフトウェアデカップリングとより低い業界開発障壁を駆動する可能性を備えた「ロボティクスのAndroid」と見なされています. .
アプリケーションシナリオ:工場から住宅への一般化可能性
産業部門では、このモデルはフランカFR3デュアルアームロボットに適合しており、ホーム環境でコンベアベルトアセンブリや品質検査などのタスクを可能にし、自然言語の相互作用を調理して犬を散歩させるなどの毎日のサービスを実行したり、ユーザーのスケジュールを介して事前にapieventivedを介してapiventivedを介して実施していることを事前に実施していることを事前に描いています。ハードウェアレベルでアクションフォースと速度制限を設定して、多層安全保護システムを構築します.

現在Gemini 2 . 0に基づいて開発されましたが、そのコアチームはすでに最新のGemini 2 . 5のパフォーマンス向上を統合し始めています。 知能。" Gemini Robotics On-Deviceの発売は、大規模なアプリケーションに入る具体化されたインテリジェンスの新しい時代をマークします。
