Mammouth AI revient souvent quand une équipe veut donner accès à l’IA à tout le monde sans payer un abonnement ChatGPT, un abonnement Claude et un abonnement Gemini. La promesse tient en une ligne : les meilleurs modèles du marché, dans une seule interface, pour le prix d’un seul. Cet article explique ce que l’outil fait vraiment, comment son prix est possible et à qui il convient. Il s’appuie sur la documentation de Mammouth, consultée le 4 octobre 2026, et sur des avis publics. Il n’est ni sponsorisé ni affilié.
La réponse courte
Mammouth est un agrégateur : quand vous posez une question, l’interface l’envoie au modèle choisi (GPT, Claude, Gemini, Mistral, Grok, DeepSeek, Kimi…) par son API, puis affiche la réponse. Vous pouvez renvoyer la même question à un autre modèle d’un clic pour comparer. La société, Mammouth AI SAS, est française, basée à Paris et créée en septembre 2024.
C’est un bon outil pour rédiger, résumer, reformuler et comparer des modèles, à condition d’accepter une règle : vous n’avez pas un accès illimité au modèle le plus puissant de chaque éditeur. Quand vous consommez beaucoup, Mammouth bascule vers un modèle plus léger.
Combien ça coûte
L’accueil du site annonce un accès « à partir de 10 €/mois ». Un utilisateur de longue date précise 10 € HT, soit environ 12 € TTC (Alexandre Chaimbault, janvier 2026). Trois formules existent : Starter, Standard et Expert. D’après la politique de quotas, Standard donne trois fois le volume de Starter et Expert dix fois, pour six fois le prix.
Pour une équipe, le prix par personne est le même qu’en individuel, avec une console d’administration et une facturation centralisée. Au-delà de 100 licences, l’offre « Enterprise » passe par devis, avec virement ou Chorus (tarifs). Le paiement par virement ou bon de commande impose un engagement annuel (offre équipes).
Comment un prix aussi bas est possible
C’est la vraie question. Elle a une réponse simple : tous les modèles ne coûtent pas le même prix, et l’abonnement oriente l’usage vers les moins chers.
Les modèles ont des prix très différents
Les éditeurs facturent leurs API au volume de texte traité, compté en « jetons » (environ trois quarts de mot). La grille de l’API Mammouth affiche par exemple, en dollars par million de jetons, 4 en entrée et 20 en sortie pour Claude Opus 5.5, contre 0,15 et 0,50 pour GLM 5.3 Flash. Les prix de Claude sont confirmés par Anthropic. Selon le modèle et le sens, l’écart va de 1 à 25 environ, et jusqu’à 1 à 40.
Le quota se renouvelle toutes les trois heures
La politique de quotas décrit le mécanisme. Chaque session dure trois heures. La consommation dépend de la longueur des messages, des documents joints, de la longueur de la conversation (tout l’historique est renvoyé à chaque message), des outils utilisés et du modèle choisi. Quand le quota d’un modèle est atteint, Mammouth passe automatiquement à un modèle plus léger : l’exemple officiel est Claude Opus, puis Claude Sonnet, puis Claude Haiku. Vous n’êtes jamais bloqué, mais vous ne travaillez plus avec le même modèle.
Les fondateurs l’assument. Dans l’entretien rapporté par le vidéaste Jeanviet, ils décrivent une « bascule en escalier » : une fenêtre prévient l’utilisateur et le nom du modèle change à l’écran ; la différence entre les offres tient surtout à la vitesse de cette bascule. Le conseil de l’un des cofondateurs, résumé par Jeanviet : « arrête avec les gros modèles », au profit de GLM 5.3 Flash, qui « coûte une fraction d’un Claude ou d’un GPT » (compte rendu de Jeanviet, septembre 2026).
Un ordre de grandeur
Prenons une hypothèse simple : dans une conversation déjà entamée, un échange envoie environ 6 000 jetons (consignes, historique, question) et en reçoit 700. Avec les prix publiés par Mammouth, cet échange coûte environ 0,038 dollar sur Claude Opus 5.5 et 0,0013 dollar sur GLM 5.3 Flash. Un agent qui fait 40 échanges par jour ouvré coûterait autour de 32 dollars par mois s’il restait sur le modèle le plus puissant, et autour d’un dollar sur le modèle léger. C’est notre calcul, hors TVA, hébergement, paiement et support.
Le modèle économique tient donc sur trois appuis : beaucoup d’abonnés consomment peu, les quotas plafonnent les plus gros consommateurs, et une part importante des réponses est servie par des modèles légers ou open source. Ce n’est pas caché : c’est écrit dans la documentation. Mais « accès à Claude, GPT et Gemini » ne signifie pas « accès illimité au meilleur de chacun ».
Ce que disent les utilisateurs et les testeurs
Sur Trustpilot, le 4 octobre 2026, Mammouth obtient 4,2 sur 5 pour 294 avis : 62 % de cinq étoiles, mais 22 % d’une étoile. Les avis positifs citent le prix, l’interface et la comparaison des modèles. Les négatifs parlent de contexte qui s’épuise vite, de limites sur les modèles de raisonnement et de remboursements refusés.
Les testeurs indépendants convergent. Alexandre Chaimbault, après six mois, y voit « un bon outil, honnête dans ce qu’il propose », pour « un usage mixte […] mais pas hyper poussé » (son retour). Le développeur Melvynx ne le recommande pas comme abonnement principal : il dit avoir été souvent orienté vers des modèles légers, même avec du quota disponible, et trouve l’ergonomie en retrait de ChatGPT (Codelynx, septembre 2026).
Sur Reddit, les premiers fils demandaient s’il s’agissait d’une arnaque. La réponse dominante est non : ce sont bien les API des éditeurs (r/ChatGPT, décembre 2024). Les reproches portent sur les quotas et la mémoire des longues conversations. Attention aux avis anciens : le système de quotas a changé en 2026 (r/mammouthai, mai 2026). Une partie des vidéos de présentation sont aussi des partenariats rémunérés : vérifiez la mention avant de vous fier à un test.
Pour qui c’est adapté
Plutôt adapté :
- une personne ou une équipe qui veut découvrir plusieurs modèles et comparer leurs réponses ;
- la bureautique courante : rédiger un courrier, résumer un document non sensible, reformuler, préparer une trame ;
- une organisation qui veut un outil unique à petit prix, avec une société française et des conditions en droit français.
Moins adapté :
- les usages intensifs : longs documents, raisonnement poussé, code en continu ;
- les tâches où la qualité doit rester constante d’une heure à l’autre, puisque le modèle peut changer en cours de journée ;
- les données personnelles ou sensibles sans analyse préalable : une partie des modèles est servie aux États-Unis (voir notre article sur Mammouth AI en collectivité) ;
- répondre directement à des usagers ou à des clients : ce n’est pas l’objet de l’outil.
Avant de l’adopter en équipe
Un abonnement ne règle ni les règles d’usage, ni la formation, ni le choix des données que l’on peut confier à l’outil. Trois gestes simples :
- Tester avec un petit groupe pendant quelques semaines, sur des tâches réelles, en notant quand la bascule de modèle gêne.
- Écrire une courte charte : usages autorisés, données interdites, relecture obligatoire avant envoi.
- Former les personnes à vérifier les réponses : depuis février 2025, le règlement européen sur l’IA demande aux organisations qui déploient ces outils de prendre des mesures pour développer la maîtrise de l’IA de leur personnel. Le détail est dans notre article sur l’obligation de formation à l’IA en entreprise.
Si votre besoin dépasse l’assistance bureautique, par exemple répondre à partir de vos propres documents ou servir vos usagers, lisez notre comparaison abonnement IA ou solution sur mesure. Pour faire le tri dans vos usages, voyez notre page conseil IA ou la formation IA de vos équipes.
