Où s'installe l'économie ?
BV‑SALA n'est ni une app, ni une extension, ni un réglage de ChatGPT. C'est un morceau de code qu'un développeur place dans sa propre application, exactement là où cette application appelle l'API d'OpenAI ou d'Anthropic. Elle ne peut économiser que là où existe une facture au token — et ne peut le mesurer que là où elle voit passer chaque requête.
La couche vit dans votre code
Le même appel, avec et sans la couche. Le trafic voyage toujours directement de votre application au fournisseur — BV‑SALA n'est pas un serveur intermédiaire et ne voit jamais vos données de l'extérieur.
Cette case verte est un paquet npm dans le code de l'application. C'est pourquoi la question clé n'est jamais « qu'est-ce que j'installe ? » mais « qui a écrit le code qui appelle l'API ? » — cette personne est celle qui peut l'installer. La seule exception est un terminal de codage comme Claude Code : là, la passerelle « bvsala claude » se place devant sans toucher une seule ligne de code.
Votre cas, en 10 secondes
Quatre façons d'utiliser l'IA, et ce que BV‑SALA peut faire dans chacune.
Vous payez un forfait fixe (ou rien) : il n'existe pas de facture au token à réduire, et c'est un produit fermé où personne ne peut placer de logiciel entre l'app et ses modèles. L'économie de BV‑SALA ne s'applique pas ici — et aucun produit ne peut honnêtement la promettre là.
Exactement le même cas : abonnement fixe et produit fermé. Utilisez Claude en toute tranquillité — il n'y a pas de dépense au token à optimiser de l'extérieur.
Avec un abonnement, comme ci-dessus : forfait fixe, rien à installer. Avec une clé d'API, il y a une vraie facture au token — et le compteur tourne : « bvsala claude » lance Claude Code à travers la passerelle locale et votre dépense apparaît dans votre panneau, token par token, sans toucher une ligne de code. Économiser là est la phase suivante — d'abord, on mesure pour de vrai.
Le cas pour lequel BV‑SALA existe. Votre app appelle l'API avec votre clé, le fournisseur facture chaque token, et la couche s'installe en trois étapes : paquet, licence et envelopper l'appel. Dès la première requête, elle renvoie un SavingsReport avec l'économie vérifiée.
Estimation vs. mesure
Le produit a deux chiffres différents, et mieux vaut ne pas les mélanger.
Le simulateur de la section Tarifs projette vos économies à partir de vos propres chiffres : requêtes, tokens et modèle. C'est une projection honnête — c'est pourquoi elle porte l'étiquette « estimation ».
Chaque appel renvoie un SavingsReport : les appels que vous n'avez jamais payés et l'économie nette par requête. Auditable, requête par requête, sur votre propre infrastructure.
L'installation complète, si vous développez une app
# 1 · le paquet pnpm add @bivelio/savings-layer # 2 · la licence (depuis votre tableau de bord) export BIVELIO_LICENSE_KEY=… # 3 · envelopper l'appel — c'est tout le changement de code const layer = createSavingsLayer({ provider, licenseKey, … }); const { text, report } = await layer.generate({ model, messages }); console.log(report.cost.netSavings) // ← l'économie, mesurée