Gemma 3ベースの次世代エンコーダー-デコーダーモデル「T5Gemma 2」をリリース。マルチモーダルとロングコンテキスト対応の初のモデル。

アーキテクチャ変更として、埋め込みの共有とデコーダーの注意機構統合によりパラメータ数を削減。270M-270M、1B-1B、4B-4Bサイズのコンパクトモデルを提供。

Gemma 3の機能を継承し、画像理解、128Kトークンのロングコンテキスト、140言語以上の多言語に対応する。マルチモーダル性能とロングコンテキスト能力でGemma 3を上回るとしている。

Kaggle、Hugging Face、Colab、Vertex AIで利用可能。

#参考文献