AI要約Google機能アップデート16:04
AIが複数ソースを照合して要約
デバイス上で画像・音声検索が1モデルで可能になります
1つの軽量モデルで多様なメディア検索・RAGをオフラインで実現し、プライバシーと速度が向上します。
参照確認
参照ソース 2件
参照ソース
要点整理
- 1テキスト・画像・音声・動画を統一埋め込み
- 2740Mパラメータでオンデバイス最適
- 3Apache 2.0で商用利用・微調整可能
Google DeepMindがEmbeddingGemma 2を2026年10月6日にオープンリリースしました。740Mパラメータの軽量多モーダル埋め込みモデルで、テキスト・画像・音声・動画を統一した768次元空間にマッピングします。Apache 2.0ライセンスでHugging Faceなどで利用可能、オンデバイスRAGやクロスモーダル検索に最適です。
要点
EmbeddingGemma 2はGemma 4ベースの740Mパラメータモデル。テキスト・コード中心270Mにビジョン170M・オーディオ300Mのエンコーダをモジュール式で追加し、8Kコンテキストで長文・動画・音声を扱えます。
影響
開発者がデバイス上でプライバシー重視のRAGやクロスモーダル検索を簡単に構築可能。Hugging FaceやKaggleで重み公開済みです。
何が起きたか
Google DeepMindがEmbeddingGemma 2を2026年10月6日にオープンリリースしました。740Mパラメータの軽量多モーダル埋め込みモデルで、テキスト・画像・音声・動画を統一した768次元空間にマッピングします。Apache 2.0ライセンスでHugging Faceなどで利用可能、オンデバイスRAGやクロスモーダル検索に最適です。
hayamiの重要度メモ
公式ブログでの新モデルリリースで開発者実務への影響が大きく、新規性が高いためP1。
このニュースを含むレポート
日刊・週刊・月刊レポートで、前後の流れも確認できます。