¿Dónde se instala el ahorro?
BV‑SALA no es una app, ni una extensión, ni un ajuste de ChatGPT. Es una pieza de código que un desarrollador coloca dentro de su propia aplicación, justo donde esa aplicación llama a la API de OpenAI o Anthropic. Solo puede ahorrar donde existe una factura por tokens — y solo puede medirlo donde ve pasar cada petición.
La capa vive dentro de tu código
La misma llamada, con y sin la capa. El tráfico siempre viaja directo de tu aplicación al proveedor — BV‑SALA no es un servidor intermedio ni ve tus datos desde fuera.
Ese recuadro verde es un paquete npm dentro del código de la aplicación. Por eso la pregunta clave nunca es «¿qué instalo?» sino «¿quién escribió el código que llama a la API?» — esa persona es quien puede instalarlo. La única excepción es un terminal de codificación como Claude Code: ahí el gateway «bvsala claude» se pone delante sin tocar ni una línea de código.
Tu caso, en 10 segundos
Cuatro maneras de usar IA, y qué puede hacer BV‑SALA en cada una.
Pagas una cuota fija (o nada): no existe una factura por tokens que reducir, y es un producto cerrado en el que nadie puede colocar software entre la app y sus modelos. El ahorro de BV‑SALA no aplica aquí — y ningún producto puede prometerlo ahí con honestidad.
Exactamente el mismo caso: suscripción fija y producto cerrado. Usa Claude con tranquilidad — no hay gasto por tokens que optimizar desde fuera.
Con suscripción, igual que arriba: cuota fija y nada que instalar. Con clave de API hay una factura por tokens real — y el medidor ya está en marcha: «bvsala claude» lanza Claude Code a través del gateway local y tu gasto aparece en el panel, token a token, sin tocar una línea de código. El ahorro ahí es la siguiente fase — primero medimos de verdad.
El caso para el que existe BV‑SALA. Tu app llama a la API con tu clave, el proveedor factura cada token, y la capa se instala en tres pasos: paquete, licencia y envolver la llamada. Desde la primera petición devuelve un SavingsReport con el ahorro verificado.
Estimación vs. medición
El producto tiene dos cifras distintas y conviene no mezclarlas.
La calculadora del pricing proyecta tu ahorro con tus propios números: peticiones, tokens y modelo. Es una proyección honesta — por eso lleva la etiqueta «estimación».
Cada llamada devuelve un SavingsReport: las llamadas que nunca pagaste y el ahorro neto por petición. Auditable, petición a petición, en tu propia infraestructura.
La instalación completa, si desarrollas una app
# 1 · el paquete pnpm add @bivelio/savings-layer # 2 · la licencia (de tu dashboard) export BIVELIO_LICENSE_KEY=… # 3 · envolver la llamada — esto es todo el cambio de código const layer = createSavingsLayer({ provider, licenseKey, … }); const { text, report } = await layer.generate({ model, messages }); console.log(report.cost.netSavings) // ← el ahorro, medido