Veille IA Veille IA sans buzz : pour stratèges québécois.
La veille

Gemma 4 : Le modèle multimodal open source de Google DeepMind

1 min de lecture · Hugging Face Blog · 1 avr. 2026 · IA générative · Pertinence : élevée
Gemma 4 : Le modèle multimodal open source de Google DeepMind

Rédigé à partir de la source originale; chaque fait est vérifié contre le texte source.

Que faut-il retenir ?

  • Gemma 4 supporte les entrées texte, image et audio, avec des améliorations spécifiques pour l'encodage d'images.
  • Le modèle Gemma 4 E2B a 2.3B de paramètres effectifs et une fenêtre de contexte de 128k.
  • Le modèle Gemma 4 31B atteint un score LMArena estimé de 1452 pour le texte.
  • Gemma 4 utilise des architectures innovantes comme les Per-Layer Embeddings et le Shared KV Cache.

Pourquoi cette nouvelle compte-t-elle ?

Gemma 4 représente une avancée significative dans les modèles multimodaux, offrant des performances élevées et une compatibilité étendue. Les professionnels peuvent l'utiliser pour des applications variées, de la génération de texte à l'analyse d'images et d'audio, avec une efficacité optimisée pour les appareils.

Public concerné : développeurs, entreprises

Quelles sont les principales caractéristiques de Gemma 4 ?

Gemma 4 supporte les entrées texte, image et audio, avec des améliorations spécifiques pour l'encodage d'images et des architectures innovantes comme les Per-Layer Embeddings et le Shared KV Cache.

🔧 Outils mentionnés

🔐 Connexion rapide

Entrez votre courriel pour recevoir un code à 6 chiffres.

Pas besoin de mot de passe ni d'inscription. Entrez votre courriel, recevez un code par courriel, et c'est tout !