Savings Layer forma part de la plataforma BiVelio
La capa de cost de LLM que qualsevol pot instal·lar — amb llicència per executar

Demostra l'estalvi amb les teves pròpies dades.

BV‑SALA se situa davant de qualsevol proveïdor de LLM i, en cada sol·licitud, tria l'execució més barata que encara compleix el teu llindar de qualitat. No ens creguis sense més: enganxa les teves dades a sota i observa com es mou el mesurador.

S'executa completament al teu navegador. Sense registre, res no surt d'aquesta pàgina.
Guanya l'execució més barataper sol·licitud
01Evita la crida completamentresolutors · memòria cau exacta i semàntica0 crides
02Evita la recuperació i les einesruta: cap / única / múltiple / einamenys crides
03Elimina el context innecessaridesduplica · reordena · k‑adaptativa−tokens
04Comprimeix el que quedacodificació més lleugera · només si és net positiu−tokens
05Restringeix la sortidaesquema · contracte mínim−sortida
Pas 1 · Proves preliminars — al teu navegador

Prova l'optimitzador tu mateix. Res no surt d'aquesta pàgina.

Aquests dos instruments executen l'optimitzador real localment perquè puguis comprovar el mecanisme abans de tocar cap proveïdor. El panell esquerre executa l'optimitzador real de BV‑SALA sobre les dades que enganxis — comptabilitat real de tokens, el mateix codi que envia el SDK. El panell dret estima una factura mensual executant l'optimitzador sobre una càrrega de treball de mostra contra un model simulat. Per a dòlars mesurats de manera demostrable, consulta el Pas 2 més avall.

Verificador d'estalviESTIMACIÓ — heurística, no mesurada pel proveïdor
Les teves dades0
BV-SALA0

Ja és òptim aquí — BV‑SALA mai no ho empitjora.

Projector de facturaESTIMACIÓ
estalvi projectat / mes · a preus de gpt-4o-mini
$170
$330 → $160 · 52% menys
Pas 2 · Com es mesuren els estalvis — reproduïble

Tots dos braços mesurats pel tokenitzador del mateix proveïdor — sense línia base modelada.

Aquest és el resultat del benchmark A/B (pnpm ab): per a cada escenari envia una sol·licitud ingènua i la sol·licitud de BV‑SALA al mateix model, calcula el preu de totes dues a partir del propi ús de tokens del proveïdor i informa del límit inferior de confiança del 95% — mai l'afalagadora estimació puntual. No hi ha res modelat.

MOCK · referènciaESTIMAT · proveïdor simulat — això demostra que el mecanisme funciona, no la teva factura. Una execució LIVE confirmada substitueix cada xifra d'aquí.
44.5%
estalvi net, límit inferior de l'IC del 95%. Estimació puntual 54.1%, superior 58.4% — destaquem el mínim (càrrega de treball de referència, proveïdor simulat).
−5.0%0%63.4%
avoided_calls
35.2%
95% ≥ −27.8% · Δ $0.000015
estimat (simulat)
eliminated_tokens
60.6%
95% ≥ 30.8% · Δ $0.000351
estimat (simulat)
compressed_tokens
57.3%
95% ≥ 57.3% · Δ $0.000771
estimat (simulat)
output_restriction
−25.0%
95% ≥ −25.0% · Δ $-0.000012
estimat (simulat)

Quatre llibres comptables, mai sumats: cadascun és una palanca mesurada per separat, de manera que un dòlar no es pot comptar dues vegades. El residu de conciliació ≈ 0 ho demostra. Aquestes són palanques de referència: la teva via en viu mesura unes altres quatre — provider-cached substitueix output-restriction — de manera que mai no en fem correspondre una amb l'altra.

Control de qualitat 100% superatEls llibres quadrenEmpremta del model establePunt d'equilibri de la memòria cau K=2sense comprovar (simulat)Una resposta que empitjora anul·la el seu estalvi
escenaritipusA ent/sortB ent/sortcost Acost Bestalviqa
Local arithmeticresolver10/150/0$0.000010$0.00100.0%2/2
Tool-heavy requestran815/15190/20$0.000131$0.00004069.1%4/4
Large uniform tableran2,182/15877/20$0.000336$0.00014457.3%4/4
Summarize provided textran31/1531/20$0.000014$0.000017−22.0%4/4
Constrained structured answerran20/1520/20$0.000012$0.000015−25.0%4/4
FAQ (first ask)ran12/1512/20$0.000011$0.000014−27.8%4/4
FAQ (repeat ask)cache12/1512/20$0.000011$0.000014−27.8%2/2
memòria cau · amortitzatFAQ (repeat ask): error en fred $0.000014 → encert $0.00. Assoleix l'equilibri amb K=2 repeticions — l'estalvi de la memòria cau és de trànsit repetit, no una xifra d'una sola crida, així que una crida en fred honestament marca ≈0%.
Comptabilitat honesta

Quatre llibres comptables separats. Mai sumats en una sola xifra de vanitat.

Un encert de memòria cau elimina una crida sencera. BV‑SALA recodifica les dades estructurades de manera més compacta. La compressió descarta paraules redundants. Una memòria cau de prefix del proveïdor abarateix els tokens sense eliminar-los. Barrejar-los et menteix — així que no ho fem.

01

avoided_calls

Crides a LLM, recuperació i eines que mai no s'han executat.

executa l'optimitzador per mesurar
02

eliminated_tokens

Informació descartada perquè simplement no calia.

executa l'optimitzador per mesurar
03

compressed_tokens

Informació conservada, però codificada amb menys tokens.

executa l'optimitzador per mesurar
04

provider_cached_tokens

Encara al prompt, però facturada o processada de manera més barata.

executa l'optimitzador per mesurar
Cinc línies per començar

Executa'l a la teva pròpia app. Els teus prompts mai no toquen els nostres servidors.

Col·loca el SDK davant del teu proveïdor. Cada resposta porta un SavingsReport complet que pots representar en gràfics — les mateixes xifres que llegeix el tauler.

// your app — the data plane. LLM traffic goes straight to your provider.
import { createSavingsLayer } from "@bivelio/savings-layer";

const layer = createSavingsLayer({
  provider: yourProvider,
  licenseKey: process.env.BIVELIO_LICENSE_KEY,       // from your dashboard
  licenseServerUrl: "https://savings.bivelio.com",   // license check + kill-switch
});

const { data, report } = await layer.generate({
  model: "openai/gpt-4o-mini",
  messages,
  response: { contractId: "answer:v1", schema, maxOutputTokens: 220 },
});

report.cost.netSavings;   // → your net savings on this request
report.calls.avoidedLlm;  // → whole calls you never paid for
Un sol pla, amb preu per seient

Cèntims per executar. Múltiples per estalviar.

Sense pla gratuït, sense prova — prova BV‑SALA aquí mateix al teu navegador i després subscriu-te per executar-lo a la teva app. Preu per seient, en USD.

$4 / seient / mes

PRO — facturat per seient. O $39 / seient / any (estalvia ~19%). Enterprise, amb funcions empaquetades, arribarà més endavant.

Un seient és una màquina o identitat de servei activa, no una persona — facturat només si està actiu 3 dies o més en un mes. La CI i els executors efímers no compten.

  • Cada optimització de BV‑SALA, sense límit
  • Memòria cau semàntica gestionada i llindars apresos
  • Taulers d'estalvi i analítiques d'equip
  • Els teus prompts mai no surten de la teva infraestructura
Comença →

Per què el preu pot ser tan baix

  • No movem cap token. El teu trànsit de LLM va directe al teu proveïdor — només veiem recomptes, mai contingut.
  • Tu allotges la part pesada. L'optimitzador s'executa al teu procés; els nostres servidors només llicencien, aprenen i informen.
  • La infraestructura escala amb els ingressos. Comença en un servidor petit i només creix quan els clients de pagament cobreixen el nivell següent.
  • L'informe és el mesurador. La facturació llegeix el mateix SavingsReport que verifiques a dalt — sense caixa negra.
BiVelio — Verifica el teu estalvi en LLM