Demostra l'estalvi amb les teves pròpies dades.
BV‑SALA se situa davant de qualsevol proveïdor de LLM i, en cada sol·licitud, tria l'execució més barata que encara compleix el teu llindar de qualitat. No ens creguis sense més: enganxa les teves dades a sota i observa com es mou el mesurador.
Prova l'optimitzador tu mateix. Res no surt d'aquesta pàgina.
Aquests dos instruments executen l'optimitzador real localment perquè puguis comprovar el mecanisme abans de tocar cap proveïdor. El panell esquerre executa l'optimitzador real de BV‑SALA sobre les dades que enganxis — comptabilitat real de tokens, el mateix codi que envia el SDK. El panell dret estima una factura mensual executant l'optimitzador sobre una càrrega de treball de mostra contra un model simulat. Per a dòlars mesurats de manera demostrable, consulta el Pas 2 més avall.
Ja és òptim aquí — BV‑SALA mai no ho empitjora.
Tots dos braços mesurats pel tokenitzador del mateix proveïdor — sense línia base modelada.
Aquest és el resultat del benchmark A/B (pnpm ab): per a cada escenari envia una sol·licitud ingènua i la sol·licitud de BV‑SALA al mateix model, calcula el preu de totes dues a partir del propi ús de tokens del proveïdor i informa del límit inferior de confiança del 95% — mai l'afalagadora estimació puntual. No hi ha res modelat.
Quatre llibres comptables, mai sumats: cadascun és una palanca mesurada per separat, de manera que un dòlar no es pot comptar dues vegades. El residu de conciliació ≈ 0 ho demostra. Aquestes són palanques de referència: la teva via en viu mesura unes altres quatre — provider-cached substitueix output-restriction — de manera que mai no en fem correspondre una amb l'altra.
| escenari | tipus | A ent/sort | B ent/sort | cost A | cost B | estalvi ▾ | qa |
|---|---|---|---|---|---|---|---|
| Local arithmetic | resolver | 10/15 | 0/0 | $0.000010 | $0.00 | 100.0% | 2/2 |
| Tool-heavy request | ran | 815/15 | 190/20 | $0.000131 | $0.000040 | 69.1% | 4/4 |
| Large uniform table | ran | 2,182/15 | 877/20 | $0.000336 | $0.000144 | 57.3% | 4/4 |
| Summarize provided text | ran | 31/15 | 31/20 | $0.000014 | $0.000017 | −22.0% | 4/4 |
| Constrained structured answer | ran | 20/15 | 20/20 | $0.000012 | $0.000015 | −25.0% | 4/4 |
| FAQ (first ask) | ran | 12/15 | 12/20 | $0.000011 | $0.000014 | −27.8% | 4/4 |
| FAQ (repeat ask) | cache | 12/15 | 12/20 | $0.000011 | $0.000014 | −27.8% | 2/2 |
Quatre llibres comptables separats. Mai sumats en una sola xifra de vanitat.
Un encert de memòria cau elimina una crida sencera. BV‑SALA recodifica les dades estructurades de manera més compacta. La compressió descarta paraules redundants. Una memòria cau de prefix del proveïdor abarateix els tokens sense eliminar-los. Barrejar-los et menteix — així que no ho fem.
avoided_calls
Crides a LLM, recuperació i eines que mai no s'han executat.
eliminated_tokens
Informació descartada perquè simplement no calia.
compressed_tokens
Informació conservada, però codificada amb menys tokens.
provider_cached_tokens
Encara al prompt, però facturada o processada de manera més barata.
Executa'l a la teva pròpia app. Els teus prompts mai no toquen els nostres servidors.
Col·loca el SDK davant del teu proveïdor. Cada resposta porta un SavingsReport complet que pots representar en gràfics — les mateixes xifres que llegeix el tauler.
// your app — the data plane. LLM traffic goes straight to your provider. import { createSavingsLayer } from "@bivelio/savings-layer"; const layer = createSavingsLayer({ provider: yourProvider, licenseKey: process.env.BIVELIO_LICENSE_KEY, // from your dashboard licenseServerUrl: "https://savings.bivelio.com", // license check + kill-switch }); const { data, report } = await layer.generate({ model: "openai/gpt-4o-mini", messages, response: { contractId: "answer:v1", schema, maxOutputTokens: 220 }, }); report.cost.netSavings; // → your net savings on this request report.calls.avoidedLlm; // → whole calls you never paid for
Cèntims per executar. Múltiples per estalviar.
Sense pla gratuït, sense prova — prova BV‑SALA aquí mateix al teu navegador i després subscriu-te per executar-lo a la teva app. Preu per seient, en USD.
PRO — facturat per seient. O $39 / seient / any (estalvia ~19%). Enterprise, amb funcions empaquetades, arribarà més endavant.
Un seient és una màquina o identitat de servei activa, no una persona — facturat només si està actiu 3 dies o més en un mes. La CI i els executors efímers no compten.
- Cada optimització de BV‑SALA, sense límit
- Memòria cau semàntica gestionada i llindars apresos
- Taulers d'estalvi i analítiques d'equip
- Els teus prompts mai no surten de la teva infraestructura
Per què el preu pot ser tan baix
- No movem cap token. El teu trànsit de LLM va directe al teu proveïdor — només veiem recomptes, mai contingut.
- Tu allotges la part pesada. L'optimitzador s'executa al teu procés; els nostres servidors només llicencien, aprenen i informen.
- La infraestructura escala amb els ingressos. Comença en un servidor petit i només creix quan els clients de pagament cobreixen el nivell següent.
- L'informe és el mesurador. La facturació llegeix el mateix SavingsReport que verifiques a dalt — sense caixa negra.