2025/06/24 14:05 Gemini Robotics On-Device brings AI to local robotic devices

ロボ子、Gemini Robotics On-Deviceって知ってるか?Google DeepMindが開発した、ロボット上でローカルに動くVLAモデルのことじゃ。

はい、博士。記事を読みました。ネットワークが不安定な環境でも使えるのが良いですね。

そうじゃ!汎用的な器用さとタスクの一般化に優れてるらしいぞ。遅延が少ないのもポイントじゃな。

開発者向けのSDKも提供されるんですね。新しいタスクへの適応を支援してくれるとのことですが、具体的にどういうことができるんですか?

ふむ、50〜100程度のデモンストレーションで新しいタスクに適応できるらしいぞ。すごいじゃろ?

それはすごいですね!でも、どうしてそんなに少ないデータで適応できるんでしょうか?

VLAモデルの視覚、意味、行動の一般化能力が高いからじゃろうな。自然言語の指示にも従えるらしいぞ。

なるほど。双腕ロボット向けに設計されていて、計算リソースも最小限で済むんですね。

そうそう。ランチボックスのジッパー締めとか、カードの引き抜きとか、サラダドレッシングをかけるとか、色々なタスクをこなせるらしいぞ。

サラダドレッシングをかける…ちょっと面白いですね。でも、安全性はどうなんでしょう?

そこもちゃんと考慮されておるぞ!AI原則に沿って開発されていて、意味的および物理的な安全性を考慮した包括的な安全アプローチを採用しておる。

Live APIを使って意味的およびコンテンツの安全性を確保したり、低レベルの安全クリティカルコントローラーと連携してアクションを実行したりするんですね。

semantic safety benchmarkとかred-teaming exercisesを使って、モデルの安全性の脆弱性を検証しておるらしい。

責任ある開発とイノベーション(ReDI)チームが、現実世界への影響を分析し、リスクを最小限に抑える方法を検討しているんですね。すごい。

じゃろ?責任と安全評議会(RSC)が評価をレビューして、モデル開発にフィードバックを提供しておるらしいぞ。

トラステッドテスターグループにリリースして、利用状況と安全性のプロファイルをより深く理解し、フィードバックを収集するんですね。

Gemini Robotics SDKを通じて、開発者が特定のニーズに合わせてモデルを適応させることができるのも良い点じゃな。

本当に色々なことができるんですね。ところで博士、この技術を使って何か面白いことできませんかね?

うむ…例えば、ロボットに私の代わりに宿題をやらせるとか…

それはダメです!博士は自分で勉強してください!

冗談じゃ、冗談!でも、いつかロボットが私の代わりに学会発表してくれる日が来るかもしれんぞ?
⚠️この記事は生成AIによるコンテンツを含み、ハルシネーションの可能性があります。