あ グーグル 水曜日(6/12)、人工知能 (AI) における最新の進歩を発表しました。 ジェミニ。
この新しいマルチモーダル主要言語モデル (LLM) は、人気のある ChatGPT チャットボットで使用されている GPT-4 を超えることが約束されており、AI 開発における重要なマイルストーンを示します。
前任者とは異なり、Gemini は、テキスト、音声、画像、ビデオなどをカバーする「さまざまな種類の情報を理解し、操作し、組み合わせる」という独自の能力で際立っています。 プログラミング言語。
Google DeepMind の CEO 兼共同創設者である Demis Hassabis 氏は、Gemini の創設により、Gemini を「インテリジェントなソフトウェア」のようなものではなく、より直観的で実用的なものにすることを目指していると強調しています。
Google の新しい AI、Gemini の詳細
Gemini のもう 1 つの注目すべき機能は柔軟性であり、これまで Google が作成したモデルの中で最も多用途です。
Ultra、Pro、Nano の 3 つの異なるサイズで利用可能で、データセンターや モバイルデバイス、このようにさまざまな用途を提供します。
画像: Shutterstock/LookerStudio
現在、Gemini 1.0 は、英語に限定されていますが、ブラジルを含む 170 か国の Google Bard ですでに利用可能です。
2024 年までに最も強力なモデルが統合されると予想されています。 チャットボット、他の言語にも拡大します。
Google Pixel 8 Pro にはすでに Gemini が組み込まれており、将来的には Google 検索、Chrome、その他の企業のサービスや製品から直接アクセスできるようになります。
モバイル分野では、Gemini Nano は、音声録音アプリケーションや Gboard のスマート リプライ機能でタスクを実行する際にその効率性を実証します。 ワッツアップ。
ただし、来年発売予定のより堅牢なバージョンである Gemini Ultra は、最初は一部の顧客、開発者、パートナー、セキュリティと責任の専門家に限定されたフェーズを経て、フィードバックを収集して製品を改善することを目的としています。
Gemini の機能に関しては、広範なドキュメントから洞察を抽出する機能と、テキスト、画像、音声などを同時に理解する機能が際立っています。
このマルチモーダルなアプローチにより、特に複雑な質問に直面した場合に、より状況に応じた応答が可能になります。
Googleは、ジェミニは32の学術ベンチマークのうち30で成功し、数学、物理学、歴史、法律、医学、倫理などのさまざまな分野で人間の専門家を上回ったと主張している。
と比較して、 GPT-4Gemini Ultraは、画像、ビデオ、オーディオを含むマルチモーダルテストで優れていることに加えて、テキスト、推論、数学、プログラミングで優れていることを示しました。
要約すると、Gemini は AI における有望なイノベーションとして浮上し、ChatGPT の機能に挑戦し、難しい質問に答える際に、より思慮深く正確なアプローチを約束します。
私たちの活動を応援してください ❤️
この記事を気に入っていただけたら、今後も質の高いコンテンツを発信し続けられるようチップのご支援をご検討ください。






















