Des plans clairs — et un accompagnement humain.
Quotas mesurés dans la console, LLM en BYOK aux tarifs fournisseur, embeddings locaux inclus. Les Early Adopters bénéficient de tarifs préférentiels et d'un suivi direct par l'équipe fondatrice.
On construit TokenSaver avec nos premiers clients.
Vous voyez les tarifs, mais chaque projet est différent. Discutons de votre stack, de vos volumes et de ce que vous cherchez à gouverner. On vous propose une démo personnalisée et, si pertinent, des conditions Early Adopter.
Trois plans. Une plateforme. Votre LLM, vos clés.
TokenSaver est une couche d'optimisation et de gouvernance — pas un revendeur de tokens. Free pour tester. Pro pour produire. Enterprise pour le SI.
Testez sur du vrai trafic — sans carte bancaire, sans clé LLM.
Idéal pour découvrir et valider un usage IA : modèles hébergés, zéro config.
- 15 modèles hébergés inclus
- Cache, RAG, compression et PII inclus
- 500 requêtes · 150k tokens / mois
- 3 documents RAG · 100 Mo
- 1 clé API TokenSaver
- Agent Registry inclus
Sans CB · essai 30 jours · modèles hébergés
BYOK + cache, RAG, PII et compression — le plan production des agences, freelances et TPE.
Conçu pour les équipes qui livrent des copilotes en production — BYOK, catalogue complet, quotas d'équipe.
- 50 000 requêtes · 10M tokens / mois
- Catalogue LLM complet (BYOK)
- OpenAI, Anthropic, Google, Mistral, OpenRouter…
- 50 documents RAG · 5 Go
- 5 clés API TokenSaver
- Cache · RAG · PII · compression (sans CCR)
- Agent Registry & gouvernance inclus
Cyber, CCR, SLA et déploiement sur mesure — pour l'IA à l'échelle du SI et des secteurs réglementés.
Pensé pour les SI et secteurs réglementés : gouvernance cyber, CCR, audit et déploiement à l'échelle.
- Cyber : posture OWASP, menaces, alertes, policies
- CCR — originaux compressés récupérables
- Catalogue haut (×~10 Pro) ou sur mesure
- Illimité possible au contrat
- SLA · support dédié · on-premise / VPC
- Mémoire multi-agent L3 · audit & conformité
Free = essai 30 jours avec modèles hébergés. Pro = plateforme (cache, RAG, compression, PII, gouvernance) — LLM en BYOK au tarif du fournisseur. Enterprise = cyber, CCR, SLA, déploiement sur mesure. Embeddings RAG/cache locaux inclus. Les offres Early Adopter sont réservées aux membres du programme et font l'objet d'un échange avec l'équipe.
Comparaison détaillée
Les quotas correspondent à la vue « Plan & Usage » de la console.
| Fonctionnalité | Free | Pro | Enterprise |
|---|---|---|---|
| Prix | 0 € · 30 j | 79 € HT / user / mois | Sur mesure |
| Requêtes / mois | 500 | 50 000 | Sur mesure (illimité au contrat) |
| Tokens / mois | 150k | 10M | Sur mesure (illimité au contrat) |
| Requêtes / jour | 50 | 3 000 | Sur mesure |
| RPM | 20 | 60 | Sur mesure / SLA |
| Clés API TokenSaver | 1 | 5 | 50+ / contrat |
| Documents RAG | 3 | 50 | Sur mesure |
| Stockage connaissance | 100 Mo | 5 Go | Sur mesure (ex. 50 Go+) |
| Cache sémantique | |||
| RAG local + embeddings | |||
| Compression sémantique | |||
| Détection & anonymisation PII | |||
| BYOK (clés fournisseur) | |||
| Catalogue LLM | 15 hébergés | Catalogue complet | Complet / dédié |
| Agent Registry (zero-trust) | |||
| Cyber (posture, menaces, alertes) | |||
| CCR (compression récupérable) | |||
| Mémoire L3 / SCO / context graph | |||
| API OpenAI & Anthropic compatibles | |||
| Console & monitoring | |||
| SSO SAML / SCIM | ✓ (contrat) | ||
| SLA & support dédié | |||
| On-premise / VPC |
Questions fréquentes
Qu'est-ce que le programme Early Adopter ?
Une communauté restreinte d'équipes IA qui bénéficient d'un accompagnement rapproché par l'équipe fondatrice, de tarifs préférentiels sur le plan Pro et d'un accès prioritaire aux nouveaux modules (routage intelligent, Agent Registry, connecteurs SaaS, cyber Enterprise).
Pourquoi demander une démo alors que les tarifs sont publics ?
Parce que TokenSaver est encore en phase d'apprentissage client. La démo nous permet de valider avec vous le ROI réel sur votre stack, d'ajuster les quotas si besoin et de vous proposer des conditions Early Adopter adaptées à votre cas d'usage.
Les coûts LLM des fournisseurs sont-ils inclus ?
Non. Pro et Enterprise sont des frais de plateforme (cache, RAG, compression, PII, gouvernance). Le chat LLM est en BYOK : vous branchez vos clés OpenAI, Anthropic, Mistral… et payez le fournisseur au tarif officiel. Sur Free, l'inférence est hébergée pendant 30 jours dans les quotas d'essai. Les embeddings RAG et cache sont calculés en local — pas de facture d'embedding API.
Quand est-ce que Pro devient rentable ?
Dès que le cache, le RAG et la compression économisent plus que les 79 € HT mensuels par utilisateur — typique des copilotes support, agents à prompts récurrents et flux documentaires. La console affiche les tokens économisés par run pour mesurer le ROI réel.
Free après 30 jours ?
L'essai hosted se termine. La lecture console reste possible ; pour continuer à appeler l'API, passez en Pro (BYOK) via un échange avec l'équipe / la démo Early Adopter.
Puis-je changer de plan ?
Oui. Le passage Free → Pro se fait après échange Early Adopter / démo. Le passage vers Enterprise se fait avec notre équipe pour cadrer SLA, cyber, CCR, VPC et intégrations custom.
Qu'est-ce que le CCR (Enterprise) ?
Le module CCR permet de conserver et récupérer les originaux liés à la compression — utile pour audit, conformité et secteurs réglementés. Réservé à Enterprise, avec le pack cyber.
Où sont hébergées mes données ?
En Europe. Vos clés LLM restent dans le vault TokenSaver (jamais exposées à vos apps), vos documents RAG dans votre périmètre, et les traces sont exportables SIEM pour audit EU AI Act / RGPD.
Rejoignez les Early Adopters TokenSaver.
Une communauté d'équipes IA qui construisent la gouvernance LLM d'entreprise avec nous — tarifs préférentiels, roadmap partagée, accès direct à l'équipe.