Savings Layer forma parte de la plataforma BiVelio
La capa, explicada · sin jerga

¿Dónde se instala el ahorro?

BV‑SALA no es una app, ni una extensión, ni un ajuste de ChatGPT. Es una pieza de código que un desarrollador coloca dentro de su propia aplicación, justo donde esa aplicación llama a la API de OpenAI o Anthropic. Solo puede ahorrar donde existe una factura por tokens — y solo puede medirlo donde ve pasar cada petición.

La capa vive dentro de tu código

La misma llamada, con y sin la capa. El tráfico siempre viaja directo de tu aplicación al proveedor — BV‑SALA no es un servidor intermedio ni ve tus datos desde fuera.

Sin BV‑SALA
Tu aplicación
cada petición sale entera
API del proveedor
OpenAI · Anthropic · vLLM…
$330
factura / mes
Con BV‑SALA
Tu aplicación
mismo código de negocio
BV-SALA
evita llamadas · recorta entrada y salida
API del proveedor
recibe menos tokens
$160
+ SavingsReport

Ese recuadro verde es un paquete npm dentro del código de la aplicación. Por eso la pregunta clave nunca es «¿qué instalo?» sino «¿quién escribió el código que llama a la API?» — esa persona es quien puede instalarlo. La única excepción es un terminal de codificación como Claude Code: ahí el gateway «bvsala claude» se pone delante sin tocar ni una línea de código.

Tu caso, en 10 segundos

Cuatro maneras de usar IA, y qué puede hacer BV‑SALA en cada una.

ChatGPTapp o web, gratis o de pago
Nada que instalar

Pagas una cuota fija (o nada): no existe una factura por tokens que reducir, y es un producto cerrado en el que nadie puede colocar software entre la app y sus modelos. El ahorro de BV‑SALA no aplica aquí — y ningún producto puede prometerlo ahí con honestidad.

Claudeclaude.ai, gratis o de pago
Nada que instalar

Exactamente el mismo caso: suscripción fija y producto cerrado. Usa Claude con tranquilidad — no hay gasto por tokens que optimizar desde fuera.

Claude Codeterminal, con clave de API
Ya mide

Con suscripción, igual que arriba: cuota fija y nada que instalar. Con clave de API hay una factura por tokens real — y el medidor ya está en marcha: «bvsala claude» lanza Claude Code a través del gateway local y tu gasto aparece en el panel, token a token, sin tocar una línea de código. El ahorro ahí es la siguiente fase — primero medimos de verdad.

Tu aplicacióntu código + tu clave de API
Aquí sí

El caso para el que existe BV‑SALA. Tu app llama a la API con tu clave, el proveedor factura cada token, y la capa se instala en tres pasos: paquete, licencia y envolver la llamada. Desde la primera petición devuelve un SavingsReport con el ahorro verificado.

Estimación vs. medición

El producto tiene dos cifras distintas y conviene no mezclarlas.

Antes de instalar
Estimación

La calculadora del pricing proyecta tu ahorro con tus propios números: peticiones, tokens y modelo. Es una proyección honesta — por eso lleva la etiqueta «estimación».

Después de instalar
Medición real

Cada llamada devuelve un SavingsReport: las llamadas que nunca pagaste y el ahorro neto por petición. Auditable, petición a petición, en tu propia infraestructura.

La instalación completa, si desarrollas una app

# 1 · el paquete
pnpm add @bivelio/savings-layer

# 2 · la licencia (de tu dashboard)
export BIVELIO_LICENSE_KEY=…

# 3 · envolver la llamada — esto es todo el cambio de código
const layer = createSavingsLayer({ provider, licenseKey, … });
const { text, report } = await layer.generate({ model, messages });

console.log(report.cost.netSavings)  // ← el ahorro, medido
¿Dónde se instala el ahorro? · BiVelio Savings Layer