Une seule clé, cinq surfaces — votre stack reste intacte.
TokenSaver s'intercale devant vos APIs LLM sans réécriture. Console, APIs drop-in OpenAI et Anthropic, API native + SDK Python open source, serveurs MCP : cinq portes d'entrée, le même pipeline gouverné derrière.
Un pipeline gouverné — cinq portes d'entrée.
Que vos équipes vivent dans un chat UI, un IDE ou un backend custom, le même chemin s'applique : cache, RAG, compression, PII, puis le modèle — avec clés org-scoped, quotas et dashboards partagés.
API OpenAI-compatible
LibreChat, Open WebUI, LangChain, n8n : changez le base URL, gardez votre client. Chat Completions, Responses, embeddings — tous les providers routés.
- ·Bearer TokenSaver
- ·Headers X-Tokensaver-* pour tuning per-request
API Anthropic-compatible
Claude Code et Anthropic SDK sans fork : ANTHROPIC_BASE_URL vers TokenSaver. Messages API, tool use, streaming SSE — pipeline gouverné identique.
- ·ANTHROPIC_AUTH_TOKEN
- ·count_tokens & models
API native + SDK Python
Contrôle fin : pipelines, RAG, chats. SDK tokensaver-sdk open source (MIT) sur PyPI. Idéal pour agents custom, CI et backends métier.
- ·pip install tokensaver-sdk
- ·Python ≥ 3.10
Serveurs MCP
Cursor et agents MCP-aware : outils tokensaver_* (chat gouverné, usage, cache) + trust gateway qui enveloppe tout MCP tiers avec auth, PII et audit.
- ·Model Context Protocol
- ·Trust gateway pour MCP tiers
TokenSaver Platform
L'app hébergée pour opérateurs : chat gouverné, dashboards de coût, catalogue modèles, clés API, defaults de pipeline. Zéro config, même pipeline.
- ·Multi-tenant
- ·SSO SAML / OIDC
Vos outils marchent déjà — nous nous glissons devant.
Parce que TokenSaver imite les APIs OpenAI et Anthropic au bit près, tout client qui accepte un base URL personnalisé fonctionne sans patch.
Provider-agnostic — utilisez les modèles auxquels vous faites confiance.
Même gouvernance, même optimisation, même audit — quel que soit le fournisseur derrière. Basculez ou comparez sans dupliquer les politiques.
Un client Python MIT, sur PyPI.
tokensaver-sdk est open source et gratuit pour la communauté. Il s'appuie sur LangChain et LangGraph pour l'orchestration ; TokenSaver ajoute la couche de gouvernance : quotas, budgets, cache sémantique, RAG, PII, observabilité.
- One-call : cache, RAG, compression, PII — dans l'ordre
- Control plane : politiques et métering au-dessus de LangGraph
- ask(), helpers RAG, erreurs typées — pas une doc, un vrai client
pip install tokensaver-sdk
from tokensaver import Client
ts = Client(api_key="tks_live_...")
reply = ts.ask(
provider="anthropic",
model="claude-sonnet-4",
prompt="Résume ce contrat en 5 points.",
pipeline={"cache": True, "pii": "mask"},
)
print(reply.text, reply.cost, reply.trace_id)Vos outils d'ops le voient — sans intégration custom.
OpenTelemetry natif
Traces et métriques instrumentées à chaque étape du pipeline — export standard OTLP.
Prometheus & Grafana
Mêmes signaux que ceux déjà utilisés par vos SRE : alerting, SLOs, dashboards coût/latence.
Traces cascadées
Runs agentiques multi-steps, tool calls, sous-agents — une seule timeline unifiée par requête.
Branchez TokenSaver en une ligne — gardez tout le reste.
Un base URL, une clé Bearer. Vos agents, vos IDE, vos workflows n8n continuent de tourner — désormais gouvernés, tracés et optimisés.