Veille IA Veille IA sans buzz : pour stratèges québécois.
La veille

IA locale : ce mini PC AMD fait tourner de très gros modèles sans infonuagique ni abonnement

2 min de lecture · Le Big Data · 14 juin 2026 · IA générative · Pertinence : élevée
Vérifié par la rédaction de laveille.ai le . Notre méthodologie

D'après AMD - billet officiel sur le Ryzen AI Max+ et l'IA locale, relayé par Le Big Data

IA locale : ce mini PC AMD fait tourner de très gros modèles sans infonuagique ni abonnement

Rédigé à partir de la source originale; chaque fait est vérifié contre le texte source.

À retenir

  • La puce Ryzen AI Max+ 395 (nom de code Strix Halo) combine 16 coeurs Zen 5, un GPU intégré Radeon 8060S et un NPU annoncé à 50 TOPS, pour un total plateforme allant jusqu'à 126 TOPS selon AMD.
  • Sa mémoire unifiée LPDDR5X peut atteindre 128 Go, dont une large part peut être attribuée au GPU intégré comme mémoire vidéo, ce qui permet de charger des modèles normalement réservés à des serveurs équipés de grosses cartes graphiques.
  • Le mini PC GMKtec EVO-X2, bâti sur cette puce, est cité comme exemple de machine capable de faire tourner localement des logiciels comme Ollama, LM Studio ou llama.cpp pour l'inférence de modèles ouverts.
  • AMD commercialise aussi sa propre plateforme de développement Ryzen AI Halo (128 Go de mémoire, SSD de 2 To) à 3 999 dollars américains aux États-Unis, selon Tom's Hardware.
  • Faire tourner un modèle localement élimine les frais par requête et l'envoi de données à un fournisseur infonuagique, mais n'élimine pas le coût d'achat du mini PC ni celui de l'électricité.

Pourquoi ça compte

Pour une PME ou un professionnel manipulant des données sensibles, un mini PC capable d'exécuter localement des modèles ouverts de plusieurs dizaines de milliards de paramètres réduit la dépendance à un fournisseur infonuagique et limite la circulation de données confidentielles vers des serveurs externes.

Chiffre-clé

AMD annonce, dans un billet publié le 21 octobre 2025, que le Ryzen AI Max+ 395 peut faire tourner localement des modèles de langage allant jusqu'à 235 milliards de paramètres grâce à sa mémoire unifiée pouvant atteindre 128 Go.

Action concrète

Avant d'acheter un mini PC à mémoire unifiée pour de l'IA locale, valider le modèle précis visé (par exemple Llama 3.3 70B ou Qwen3 30 à 35B) et son niveau de quantification, car la capacité de charger un modèle ne garantit pas une vitesse de génération confortable.

Sources originale et média

Sources

🔐 Connexion rapide

Entrez votre courriel pour recevoir un code à 6 chiffres.

Pas besoin de mot de passe ni d'inscription. Entrez votre courriel, recevez un code par courriel, et c'est tout !