Di mana penghematan dipasang?
BV‑SALA bukan aplikasi, bukan ekstensi, bukan pula pengaturan ChatGPT. Ia adalah sepotong kode yang ditempatkan developer di dalam aplikasinya sendiri, tepat di tempat aplikasi itu memanggil API OpenAI atau Anthropic. Ia hanya bisa menghemat di tempat ada tagihan per token — dan hanya bisa mengukurnya di tempat ia melihat setiap permintaan lewat.
Lapisan ini hidup di dalam kode kamu
Panggilan yang sama, dengan dan tanpa lapisan. Lalu lintas selalu berjalan langsung dari aplikasi kamu ke penyedia — BV‑SALA bukan server perantara dan tidak pernah melihat datamu dari luar.
Kotak hijau itu adalah paket npm di dalam kode aplikasi. Karena itu pertanyaan kuncinya tidak pernah «apa yang saya pasang?» melainkan «siapa yang menulis kode yang memanggil API?» — orang itulah yang bisa memasangnya. Satu-satunya pengecualian adalah terminal pemrograman seperti Claude Code: di sana gateway «bvsala claude» berdiri di depan tanpa menyentuh satu baris kode pun.
Kasus kamu, dalam 10 detik
Empat cara memakai AI, dan apa yang bisa dilakukan BV‑SALA di masing-masing.
Kamu membayar tarif tetap (atau tidak sama sekali): tidak ada tagihan per token yang bisa dikurangi, dan ini produk tertutup — tidak ada yang bisa menaruh perangkat lunak di antara aplikasi dan modelnya. Penghematan BV‑SALA memang tidak berlaku di sini — dan tidak ada produk yang bisa menjanjikannya di sana dengan jujur.
Kasus yang persis sama: langganan tetap dan produk tertutup. Pakai Claude dengan tenang — tidak ada pengeluaran token yang bisa dioptimalkan dari luar.
Dengan langganan, sama seperti di atas: biaya tetap, tidak ada yang perlu dipasang. Dengan kunci API ada tagihan per token yang nyata — dan pengukurnya sudah berjalan: «bvsala claude» menjalankan Claude Code melalui gateway lokal dan pengeluaranmu muncul di panel, token demi token, tanpa menyentuh satu baris kode pun. Menghemat di sana adalah fase berikutnya — pertama kami mengukur dengan sungguh-sungguh.
Kasus yang menjadi alasan BV‑SALA ada. Aplikasimu memanggil API dengan kuncimu, penyedia menagih setiap token, dan lapisan ini dipasang dalam tiga langkah: paket, lisensi, dan membungkus panggilan. Sejak permintaan pertama ia mengembalikan SavingsReport dengan penghematan terverifikasi.
Estimasi vs. pengukuran
Produk ini punya dua angka berbeda dan sebaiknya tidak dicampur.
Kalkulator di bagian harga memproyeksikan penghematanmu dengan angkamu sendiri: permintaan, token, dan model. Proyeksi yang jujur — karena itu ia memakai label «estimasi».
Setiap panggilan mengembalikan SavingsReport: panggilan yang tidak pernah kamu bayar dan penghematan bersih per permintaan. Dapat diaudit, permintaan demi permintaan, di infrastrukturmu sendiri.
Pemasangan lengkap, jika kamu membangun aplikasi
# 1 · paketnya pnpm add @bivelio/savings-layer # 2 · lisensinya (dari dasbor kamu) export BIVELIO_LICENSE_KEY=… # 3 · membungkus panggilan — ini seluruh perubahan kodenya const layer = createSavingsLayer({ provider, licenseKey, … }); const { text, report } = await layer.generate({ model, messages }); console.log(report.cost.netSavings) // ← penghematan, terukur