Wo wird die Ersparnis installiert?
BV‑SALA ist keine App, keine Erweiterung und keine ChatGPT-Einstellung. Es ist ein Stück Code, das ein Entwickler in seine eigene Anwendung einbaut — genau dort, wo diese Anwendung die OpenAI- oder Anthropic-API aufruft. Sparen kann es nur, wo eine Token-Rechnung existiert — und messen nur, wo es jede Anfrage vorbeiziehen sieht.
Die Schicht lebt in deinem Code
Derselbe Aufruf, mit und ohne Schicht. Der Traffic geht immer direkt von deiner Anwendung zum Anbieter — BV‑SALA ist kein Zwischenserver und sieht deine Daten nie von außen.
Dieses grüne Kästchen ist ein npm-Paket im Code der Anwendung. Deshalb lautet die Schlüsselfrage nie „Was installiere ich?“, sondern „Wer hat den Code geschrieben, der die API aufruft?“ — diese Person kann es installieren. Die eine Ausnahme ist ein Coding-Terminal wie Claude Code: dort setzt sich das Gateway „bvsala claude“ davor, ohne eine einzige Zeile Code anzufassen.
Dein Fall, in 10 Sekunden
Vier Arten, KI zu nutzen — und was BV‑SALA in jeder davon tun kann.
Du zahlst eine feste Gebühr (oder nichts): Es gibt keine Token-Rechnung zu senken, und es ist ein geschlossenes Produkt, in das niemand Software zwischen App und Modelle schieben kann. Die Ersparnis von BV‑SALA greift hier nicht — und kein Produkt kann sie dort ehrlich versprechen.
Exakt derselbe Fall: festes Abo, geschlossenes Produkt. Nutze Claude beruhigt — es gibt keine Token-Ausgaben, die man von außen optimieren könnte.
Mit Abo wie oben: Pauschale, nichts zu installieren. Mit API-Schlüssel gibt es eine echte Token-Rechnung — und der Zähler läuft: „bvsala claude“ startet Claude Code durch das lokale Gateway und deine Ausgaben erscheinen in deinem Panel, Token für Token, ohne eine Zeile Code anzufassen. Sparen dort ist die nächste Phase — erst wird richtig gemessen.
Der Fall, für den BV‑SALA existiert. Deine App ruft die API mit deinem Schlüssel auf, der Anbieter berechnet jeden Token, und die Schicht wird in drei Schritten installiert: Paket, Lizenz, Aufruf umhüllen. Ab der ersten Anfrage liefert sie einen SavingsReport mit der verifizierten Ersparnis.
Schätzung vs. Messung
Das Produkt hat zwei verschiedene Zahlen, die man nicht vermischen sollte.
Der Rechner im Preisbereich der Startseite rechnet deine Ersparnis mit deinen eigenen Zahlen hoch: Anfragen, Tokens und Modell. Eine ehrliche Hochrechnung — deshalb trägt sie das Etikett „Schätzung“.
Jeder Aufruf liefert einen SavingsReport: die Aufrufe, die du nie bezahlt hast, und die Nettoersparnis pro Anfrage. Prüfbar, Anfrage für Anfrage, auf deiner eigenen Infrastruktur.
Die komplette Installation, wenn du eine App baust
# 1 · das Paket pnpm add @bivelio/savings-layer # 2 · die Lizenz (aus deinem Dashboard) export BIVELIO_LICENSE_KEY=… # 3 · den Aufruf umhüllen — das ist die ganze Code-Änderung const layer = createSavingsLayer({ provider, licenseKey, … }); const { text, report } = await layer.generate({ model, messages }); console.log(report.cost.netSavings) // ← die Ersparnis, gemessen