Un SDK que se instala en tu código, deja pasar solo lo que hace falta pagar y devuelve un SavingsReport por llamada: lo medido y lo estimado por separado, contados con el contador de tu proveedor. Publicamos solo lo que hemos medido.
Cualquier endpoint compatible con la API de OpenAI, y el adaptador nativo de Anthropic. Con cifra publicada, hoy, solo OpenAI gpt-4o-mini.
El titular es el suelo del intervalo del 95 %, nunca el punto.
avoided_calls22 %eliminated_tokens43,2 %compressed_tokens20,1 %Cada libro se publica con su propio intervalo; los que no despejan el cero no se anuncian.tirada 12 sept 2026 · d1c8233
Menos dolores de cabeza con la factura. Sin cambiar de proveedor.
Tres hechos sobre el paquete. Ninguno es una promesa.
Cero dependencias de runtime
Un solo bundle ESM. Nada se instala junto a tu código que no hayamos escrito nosotros; el tokenizador exacto es un peer opcional.
Un SavingsReport por llamada
Cuatro libros contables que nunca se suman, el coste con su base (medido o estimado) y trazas por etapa. Es lo mismo que lee tu panel.
Tu tráfico sigue yendo directo
El SDK envuelve la llamada dentro de tu proceso. Tus prompts no pasan por BiVelio: a nosotros solo llegan recuentos y coste.
¿Qué hace Savings, exactamente?
Cuatro ideas, cuatro animaciones de ocho segundos. Esto es todo el producto.
La IA se cobra por palabras
Cada petición a la IA se paga por el texto que entra y sale. Savings se pone en medio del camino y deja pasar solo lo necesario: lo que no hacía falta pagar, cae en tu tarro.
No pagas dos veces por lo mismo
La IA relee en cada turno todo lo que ya le habías enviado — y el proveedor lo cobra otra vez. Savings prepara cada petición para que el proveedor aplique su precio rebajado a lo repetido. El descuento lo pone el proveedor; nuestra parte es pedirlo bien.
Un recibo que puedes comprobar
No te pedimos fe. Cada ahorro se mide con el contador oficial del proveedor — el mismo con el que te factura — y aparece en tu recibo. Lo que no se puede contrastar con la factura, no se anuncia.
Solo ganamos si tú ahorras
Nuestra comisión sale del ahorro medido, nunca de tu bolsillo: la mayor parte de lo ahorrado se queda siempre contigo. ¿Un mes sin ahorro? Comisión cero.
Las animaciones ilustran la idea. Las cifras de verdad — medidas contra proveedores reales — están justo debajo.
¿Cómo sabemos que ahorra? Lo medimos — y publicamos los ensayos, uno por uno.
Cada escenario se ejecuta dos veces contra el proveedor real: tal cual, y con Savings delante. Los dos resultados se cuentan con el contador del propio proveedor — el mismo que pone el precio en tu factura. Esto es lo que salió, con su margen de error:
gpt-4o-miniCada paso cae en UN libro contable distinto, así que estas cifras no se suman entre sí. Un paso cuyo libro no despeja el cero no aparece aquí: la restricción de salida se midió y no ahorra, así que no se anuncia. Todas las cifras de esta tirada son de gpt-4o-mini: la misma palanca puede costar dinero en otro modelo, y así se publica.
La prueba es un experimento justo: la misma tarea dos veces — sin Savings y con Savings — y el mismo contador del proveedor midiendo las dos.
Traducción, sin jerga
En esta prueba, la factura bajó con casi total seguridad al menos un 23,2%. Lo más probable es que bajara un 24,6%.
Cuando hay una horquilla, anunciamos siempre el número pequeño — el que la estadística garantiza —, nunca el bonito.
Cuatro libros, nunca sumados: cada uno es una palanca medida por separado, así que un dólar no se puede contar dos veces. El residual de conciliación ≈ 0 lo demuestra. Estas son palancas de referencia: tu vía en vivo mide otras cuatro (provider-cached reemplaza a output-restriction), así que nunca las equiparamos entre sí.
Si el envío va con paja…
…la verja la quita antes de pagar: el paquete llega a la nube mucho más pequeño y la diferencia cae en tu tarro.
Si ya va magro…
…pasa intacto. Ahí no hay nada que quitar — y no se promete ahorro donde no lo hay.
No todos los envíos llevan la misma paja: en esta tirada, el recorte medido por escenario fue desde -0,2% hasta 100%. Los que no ahorran también se publican.
gpt-4o-miniCada tipo de ahorro, contado aparte — para que ninguna cifra se infle.
Savings ahorra de varias maneras: evita llamadas enteras, quita texto que sobra, empaqueta mejor lo que se envía y activa los descuentos del proveedor. Cada manera lleva su propia cuenta y su propia cifra medida — y nunca las sumamos en un numerote de marketing.
Cada libro se mide y se publica por separado contra la API de OpenAI; los que no despejan el cero no aparecen. Un porcentaje sin su modelo al lado no significa nada: la misma palanca puede ahorrar en un modelo y costar en otro.
avoided_calls
Llamadas a LLM, recuperación y herramientas que nunca se ejecutaron.
eliminated_tokens
Información descartada porque simplemente no era necesaria.
compressed_tokens
Información conservada, pero codificada con menos tokens.
Ejecútalo en tu propia app. Tus prompts nunca tocan nuestros servidores.
Coloca el SDK delante de tu proveedor. Cada respuesta lleva un SavingsReport completo que puedes graficar — las mismas cifras que lee el panel.
# 1 · el paquete pnpm add @bivelio/savings-layer # 2 · la licencia (de tu dashboard) export BIVELIO_LICENSE_KEY=… # 3 · envolver la llamada — esto es todo el cambio de código const layer = createSavingsLayer({ provider, licenseKey, … }); const { text, report } = await layer.generate({ model, messages }); console.log(report.cost.netSavings) // ← el ahorro, medido
Donde ya viven tus automatizaciones. Si llama a la API de tu proveedor con tu clave, se mide — el SDK envuelve la llamada; el gateway se pone delante.
¿Claude Code con API key? Mira su gasto real, token a token.
Un solo comando pone un medidor local delante de tu terminal. Sin tocar código y sin configurar nada — y tus prompts jamás salen de tu máquina: a este panel solo llegan conteos y coste.
npm i -g @bivelio/savings-layer export BIVELIO_SERVICE_KEY=bvk_… bvsala claude
El gateway mide cada petición. Con licencia PRO aplica además una palanca por defecto: acorta el TTL de escritura de caché mientras la sesión sigue caliente — cambia el precio, nunca el contenido que lee el modelo. Las demás palancas van apagadas hasta que las enciendes. El skill savings-mode está disponible para tus topes, con su efecto pendiente de medir. Funciona también con Codex CLI, Goose y Qwen Code — y bvsala doctor imprime la configuración exacta del resto. Ver cómo funciona →
El skill que estira tus topes de suscripción
Sin factura también hay dolor: la ventana de cinco horas y el tope semanal. savings-mode es un skill de instrucciones puras — sin proxy, sin tocar tu tráfico — que recorta las dos masas que de verdad queman tope: la salida del modelo y los resultados de herramientas. Es gratis; lo que se paga con Savings es saber cuánto te ahorra.
lecturas de caché
El contexto entero se relee en cada turno — por eso mantenerlo magro importa.
escritura de caché (una hora)
Cada resultado de herramienta se escribe en caché con prima antes de releerse.
salida del modelo
Menos del uno por ciento de los tokens; el skill la ataca directamente.
Medido con el medidor sobre 959 peticiones reales de Claude Code, contra los contadores del proveedor (2026-09-01). El efecto del propio skill se publicará cuando esté medido en A/B — nunca antes.
npx -y @bivelio/savings-layer skillUn solo comando: se instala en ~/.claude/skills y se activa solo cuando la conversación habla de límites o de ahorrar tokens.
Una cuota pequeña por asiento. Y comisión solo sobre lo que ahorras.
Sin plan gratuito y sin prueba: lo que puedes comprobar antes de pagar son las mediciones públicas de esta página. La cuota va por asiento, en EUR, y la comisión sale del ahorro medido — nunca de tu bolsillo.
PRO — facturado por asiento. O 39 € / asiento / año (ahorra ~19%). Enterprise, con funciones empaquetadas, llegará más adelante.
IVA no incluido. Si su empresa tiene NIF-IVA intracomunitario, se aplica la inversión del sujeto pasivo.
Un asiento es una máquina o identidad de servicio activa, no una persona — facturado solo si está activo 3 o más días en un mes. CI y ejecutores efímeros no cuentan.
- Cada optimización de BV‑SALA, sin límite
- Recibo por petición: SavingsReport con cuatro libros contables, medido y estimado por separado
- Paneles de ahorro y analíticas de equipo
- Tus prompts nunca salen de tu infraestructura
¿Y cuánto nos pagarías tú?
EstimaciónJuega con tus números: elige proveedor y modelo, y mira tu ahorro, nuestro extra y lo que te queda — con los precios reales del catálogo y la tarifa real.
Cargando el catálogo de precios…
Cómo se calcula lo que nos pagas
- Tu primer mes: solo 4 € por asiento. Lo medimos todo y no cobramos comisión — al cierre verás el extracto exacto de lo que habría costado.
- Después, comisión solo sobre el ahorro medido: el que puedes contrastar con la factura de tu proveedor. Lo estimado nunca se factura.
- Y siempre te quedas con el 90% o más de cada euro ahorrado: la comisión solo existe cuando existe tu ahorro medido.
- Por tramos, y cada tramo a su tipo — 10% ≤ 1000 € · 8% ≤ 5000 € · 6% ≤ 20.000 € · 4% +. Cuanto más ahorras, menor es nuestro porcentaje.
- ¿Un mes sin ahorro? Comisión: 0 €. Sin permanencia — y tu primera factura variable solo contiene números que ya viste en tu extracto.