MiniMax
Le modèle M3 et l’agent MiniMax Code pour des tâches avec outils
Presentation
Fiche actualisée le 22 septembre 2026. Versions, accès et tarifs vérifiés dans les sources officielles citées. Cette mise à jour documentaire ne constitue pas un nouveau benchmark NXUS.
MiniMax développe plusieurs familles de modèles pour le texte, l’image, la vidéo et la voix. Cette fiche porte principalement sur M3 et son usage dans MiniMax Code ou par API. Au 22 septembre 2026, M3 reste la référence généraliste récente confirmée ; les versions H3 et Speech appartiennent à des familles spécialisées.
M3 : code, agents et compréhension multimodale
M3, publié le 1er juin, utilise une attention parcimonieuse appelée MSA. Il accepte notamment des images et vidéos et vise les tâches longues avec outils. Le service annonce jusqu’à un million de tokens de contexte, avec un minimum garanti de 512 k dans la présentation du modèle. Le mode de raisonnement peut être activé ou désactivé selon la demande. Les expériences d’agents autonomes présentées par l’éditeur restent des démonstrations dans leurs conditions propres.
Sources : MiniMax M3 : modèle et accès Présentation de MiniMax M3.
MiniMax Code et disponibilité des poids
MiniMax Code est l’agent officiel, accessible sur le web et en application de bureau. Il orchestre modèle, fichiers et outils ; ses capacités de manipulation d’ordinateur dépendent des permissions et de l’environnement. La présentation qualifie M3 d’open-weight, mais la section de téléchargement consultée annonce encore une ouverture à venir. Cette fiche ne transforme donc pas cette promesse en disponibilité de poids localement vérifiée. Pour une installation autonome, exige un dépôt officiel et une licence précis.
Sources : MiniMax M3 : modèle et accès Présentation de MiniMax M3.
Prix API Standard et seuil de contexte
La grille actuelle affiche, jusqu’à 512 k tokens d’entrée, 0,30 $ en entrée et 1,20 $ en sortie par MTok, avec lecture de cache à 0,06 $. Au-delà : 0,60 $ / 2,40 $ et cache à 0,12 $. La réduction est présentée comme permanente par la page actuelle, et non comme une promotion avec une date de fin connue. Le service Priority est plus cher. Les modèles audio et vidéo ont leurs propres unités, telles que caractères ou secondes : ces prix ne peuvent pas être appliqués à M3 par analogie.
Sources : Tarifs API à l’usage.
Token Plan : abonnement et quotas
Les plans mensuels sont Plus 20 $, Max 50 $ et Ultra 120 $. La page présente des volumes estimés et des limites par fenêtres glissantes de cinq heures et par semaine, ainsi que des restrictions de débit. Ces estimations ne sont pas un volume d’appels garanti pour toute taille de requête. Le Token Plan vise l’usage interactif de développeur ; l’éditeur recommande l’offre à l’usage pour la production. La musique n’est plus incluse dans Token Plan depuis le 20 août : l’ancienne description qui la regroupait avec tous les médias est à corriger.
Sources : Token Plan actuel.
Où utiliser cet outil ?
Utilise MiniMax Code pour travailler avec l’agent. La plateforme MiniMax donne accès à l’API et aux abonnements. Les intégrations avec des outils de code tiers doivent suivre leurs guides officiels et utiliser le type de clé correspondant à l’offre choisie.
Sources officielles et documentation
Comment utiliser
Parcours conseillé pour une première utilisation :
- Ouvre MiniMax Code pour une tâche interactive ou la plateforme pour une intégration.
- Choisis entre Token Plan et API à l’usage selon ton besoin de production et de débit.
- Teste une petite tâche de code ou un document multimodal, avec un résultat vérifiable.
- Surveille le contexte envoyé : dépasser 512 k tokens d’entrée change la grille M3.
- Relis les modifications et contrôle la consommation avant de lancer une tâche longue ou plusieurs agents.
Pour comparer deux modèles, conserve le même document et les mêmes critères : exactitude, temps de réponse, qualité du livrable et coût réel. Une réponse plus longue ou un raisonnement plus intense ne garantissent pas un meilleur résultat.
Astuces & conseils
Éviter le contexte inutile
Envoie les fichiers nécessaires à la tâche plutôt que l’intégralité du dépôt par défaut.
Choisir la bonne clé
Les crédits d’un abonnement et le solde API utilisent des mécanismes distincts.
Fonctionnalites cles
M3 multimodal
Texte, images et vidéo en entrée selon l’API.
MiniMax Code
Agent officiel pour tâches avec fichiers et outils.
Contexte long
Jusqu’à 1 M, avec seuil tarifaire à 512 k d’entrée.
Deux modes de facturation
Abonnement interactif ou API à l’usage.
Modeles IA
MiniMax M3
RecommandeJusqu’à 1 M ; minimum annoncé 512 k
Standard ≤512 k entrée : 0,30 $ / 1,20 $ par MTok
Oui
Code, agents, images et vidéo en entrée
MiniMax M2.7
Selon référence et service
Voir grille et quotas Token Plan
Référence antérieure toujours citée dans Token Plan
Tarifs & plans
Token Plan Plus
20 $/mois
- Quotas partagés selon conditions
Token Plan Max
50 $/mois
- Capacité et simultanéité supérieures
Token Plan Ultra
120 $/mois
- Capacité supérieure, quotas conservés
API M3 Standard
0,30 $ entrée / 1,20 $ sortie par MTok
- Jusqu’à 512 k tokens d’entrée
- 0,60 $ / 2,40 $ au-delà
- Cache et Priority distincts
Questions frequentes
Non. M3 est un modèle généraliste pouvant comprendre des contenus visuels. H3 appartient à la famille de génération vidéo.
La grille consultée le qualifie de réduction permanente. Aucun terme de promotion n’est donc inventé dans cette fiche.
L’éditeur le présente pour l’usage interactif et recommande la facturation à l’usage pour la production.
Aucun téléchargement de poids n’est présenté comme vérifié ici : la page officielle consultée comporte encore une annonce d’ouverture à venir.
Outils similaires

ChatGPT
Chat, recherche, documents et agents avec les modèles OpenAI
GLM
Des modèles pour le code, les agents et la compréhension visuelle

Google Gemini
Texte, documents et conversations vocales dans l’écosystème Google
Kimi
Un assistant pour les dossiers longs et le travail avec agents

Qwen
Des modèles de texte, vision et temps réel dans la gamme Qwen
Glossaire associe
Modèle et application
Le modèle traite les données. L’application ajoute interface, fichiers, recherche et outils ; ses quotas ne sont pas nécessairement ceux de l’API.
Contexte
Quantité de tokens traitée dans une requête, avec des limites distinctes pour l’entrée et la sortie. Une fenêtre longue ne garantit pas une lecture parfaite.
MTok
Un million de tokens. Les tarifs API distinguent généralement entrée, entrée réutilisée en cache et sortie, auxquels peuvent s’ajouter des outils.
Agent
Logiciel qui utilise un modèle pour enchaîner des actions et des appels à des outils afin d’accomplir une tâche.
Ressources connexes
Prompts ChatGPT
+500 prompts IA gratuits classés en 21 catégories
Agent IA : le guide
C'est quoi un agent IA ? Définition, exemples et comment démarrer
Cas d'usage agents IA
+800 scénarios concrets par métier et par agent (Claude Code, Codex…)
Skills IA
Compétences à brancher sur Claude, Codex et tes agents
Blog IA
Actualités, tutoriels et analyses sur l'intelligence artificielle
Passer à l’IA
Agent IA, formation des équipes et conduite du changement