Gdzie instaluje się oszczędność?
BV‑SALA to nie aplikacja, nie rozszerzenie ani nie ustawienie ChatGPT. To kawałek kodu, który deweloper umieszcza we własnej aplikacji — dokładnie tam, gdzie ta aplikacja wywołuje API OpenAI lub Anthropic. Może oszczędzać tylko tam, gdzie istnieje rachunek za tokeny — i mierzyć tylko tam, gdzie widzi każde żądanie.
Warstwa żyje w Twoim kodzie
To samo wywołanie, z warstwą i bez niej. Ruch zawsze idzie prosto z Twojej aplikacji do dostawcy — BV‑SALA nie jest serwerem pośredniczącym i nigdy nie widzi Twoich danych z zewnątrz.
Ta zielona ramka to pakiet npm w kodzie aplikacji. Dlatego kluczowe pytanie nigdy nie brzmi „co mam zainstalować?”, lecz „kto napisał kod, który wywołuje API?” — ta osoba może go zainstalować. Jedynym wyjątkiem jest terminal programistyczny taki jak Claude Code: tam brama „bvsala claude” staje z przodu, nie dotykając ani linijki kodu.
Twój przypadek, w 10 sekund
Cztery sposoby używania AI i co BV‑SALA może zrobić w każdym z nich.
Płacisz stałą opłatę (albo nic): nie ma rachunku za tokeny do obniżenia, a to zamknięty produkt, w którym nikt nie umieści oprogramowania między aplikacją a modelami. Oszczędność BV‑SALA tu po prostu nie działa — i żaden produkt nie może jej tam uczciwie obiecać.
Dokładnie ten sam przypadek: stały abonament i zamknięty produkt. Używaj Claude spokojnie — nie ma wydatków na tokeny do optymalizowania z zewnątrz.
Z subskrypcją, jak wyżej: stała opłata, nic do instalowania. Z kluczem API jest prawdziwy rachunek za tokeny — a licznik już działa: „bvsala claude” uruchamia Claude Code przez lokalną bramę i Twój wydatek pojawia się w panelu, token po tokenie, bez dotykania ani linijki kodu. Oszczędzanie tam to następny etap — najpierw naprawdę mierzymy.
Przypadek, dla którego istnieje BV‑SALA. Twoja aplikacja woła API Twoim kluczem, dostawca liczy każdy token, a warstwę instaluje się w trzech krokach: pakiet, licencja i owinięcie wywołania. Od pierwszego żądania zwraca SavingsReport ze zweryfikowaną oszczędnością.
Szacunek vs. pomiar
Produkt ma dwie różne liczby i lepiej ich nie mieszać.
Kalkulator w cenniku prognozuje Twoje oszczędności na podstawie Twoich własnych liczb: żądań, tokenów i modelu. To uczciwa projekcja — dlatego nosi etykietę „szacunek”.
Każde wywołanie zwraca SavingsReport: wywołania, za które nigdy nie zapłaciłeś, i oszczędność netto na żądanie. Audytowalne, żądanie po żądaniu, na Twojej własnej infrastrukturze.
Pełna instalacja, jeśli tworzysz aplikację
# 1 · pakiet pnpm add @bivelio/savings-layer # 2 · licencja (z Twojego panelu) export BIVELIO_LICENSE_KEY=… # 3 · owinięcie wywołania — to cała zmiana kodu const layer = createSavingsLayer({ provider, licenseKey, … }); const { text, report } = await layer.generate({ model, messages }); console.log(report.cost.netSavings) // ← oszczędność, zmierzona