新しい人工知能 (AI) を開発するための偉大な技術競争において、 グーグル 別のカードをテーブルに置きます。
これは Genie で、テキストやイラストなどのさまざまな種類のコマンドを、ユーザーにとってインタラクティブでダイナミックな世界に変換できる前例のないモデルです。
この発表は、Research Giant プラットフォームの最新化の直後に行われました。
ちょうど先月、同社はBardに変更を加え、現在はGeminiに名前を変更し、OpenAIのChatGPTおよびCopilotとの論争を激化させた。 マイクロソフト。
ジーニーはどのように機能しますか?
の研究者によると、 グーグルGenie は、テキスト プロンプトや画像スケッチを実行し、それらを具体的な仮想世界に変換することができます。
たとえば、ユーザーは紙にアイデアをスケッチし、写真を撮って Genie にアップロードできます。
AI は、挿入されたコンテンツとコンテキストに最適なインタラクション メカニズムに基づいて仮想世界を構築します。
トークナイザーの機能
これを可能にするために、Genie は、ネットワークの外側に存在するものの安全な表現を作成できるテクノロジーであるトークナイザーの助けを借りています。 インターネット。
このシステムはビデオを小さなトークンに圧縮し、その素材をアクション モデルに送信します。アクション モデルはフレームの遷移をエンコードし、想像力に変換します。
研究結果と今後の展望
ジーニーは長い期間の訓練を受け、以下の情報に基づいて情報を与えられました。 ゲームプレイ プラットフォームゲームの。
Google DeepMind の Genie チーム リーダーである Tim Rocktäschel 氏は、X (旧 Twitter) への投稿で、人工知能の開発に関する洞察を共有しました。 見て:
まだ実験段階であり、一般公開される予定はありませんが、Genie はテクノロジー巨人の他のツールの改善に前向きな期待をもたらします。
Google によるこうした進歩の後でも、競争は依然として激しいです。 最近、OpenAI はほぼ瞬時にビデオを生成する AI である Sora を発表し、ユーザーを驚かせました。 テクノロジー産業 彼の驚異的な創造力で。
この発表により、AI の世界での競争はさらに激化する傾向にあることが明らかになりました。
最後に、大企業の取り組みは、AI がますます複雑で高度な創造物を生み出すことができるという将来の展望を明らかにしています。
間違いなく、このレースで次のステップに進むのは興味深いものになるだろう 技術的な。
私たちの活動を応援してください ❤️
この記事を気に入っていただけたら、今後も質の高いコンテンツを発信し続けられるようチップのご支援をご検討ください。





















