Beranda → Blog → Server Whisper sendiri atau API transkripsi: mana lebih murah
Server Whisper sendiri atau API transkripsi: mana lebih murah
Whisper itu terbuka, ukurannya beberapa gigabita, dan jalan dengan satu perintah — wajar kalau tergoda memasangnya sendiri. Tapi tagihan perangkat keras datang bulanan sedangkan audio datang per menit, dan pada volume kecil self-hosting kalah telak dari API. Mari hitung.
Apa saja isi self-hosting
Memuat model adalah bagian termudah. Sisanya muncul sebulan kemudian:
- GPU. large-v3 butuh sekitar 10 GB VRAM, artinya kartu 12 GB ke atas.
- Antrean. Dua permintaan bersamaan tidak muat di satu kartu — perlu penjadwal.
- Konversi format. Klien mengirim m4a, ogg, webm, jadi Anda merawat ffmpeg dan mengejar kodek.
- Orang jaga. Driver, pembaruan CUDA, restart setelah kegagalan — itu waktu manusia.
Menghitung uangnya
Ambil beban tipikal: 500 menit audio per bulan.
| Pilihan | Biaya per bulan | Perlu tambahan |
|---|---|---|
| Sewa GPU awan | mulai 100 dolar untuk kartu paling sederhana | pemasangan, pembaruan, pemantauan |
| Kartu sendiri | 400–800 dolar di muka plus listrik | tempat, pendingin, mati saat rusak |
| API bayar per menit | 500 menit dikali tarif | tidak ada |
Kartu sewaan ditagih dua puluh empat jam, termasuk saat antrean kosong. Di situlah perkiraan "sendiri lebih murah" runtuh: 500 menit audio itu kurang dari sembilan jam kerja kartu dari 720 jam yang tersedia.
Kapan self-hosting menang
Ada dua kasus yang membenarkan server sendiri.
Aliran besar dan tetap. Begitu kartu sibuk setidaknya setengah hari, biayanya tersebar ke ribuan menit dan harga per menit jatuh di bawah API mana pun.
Data tidak boleh keluar. Kesehatan, perbankan, pekerjaan rahasia — di sana jawabannya bukan soal harga. Selebihnya, cukup periksa cara penyedia menyimpan rekaman: kalau dihapus dalam sehari dan tidak dipakai melatih model, risikonya setara layanan awan lain yang sudah Anda pakai.
Urutan yang masuk akal
Memulai dari self-hosting hampir selalu terlalu dini: Anda belum tahu akurasi pada audio Anda sendiri maupun volume sebenarnya. Urutan yang bekerja:
- Sambungkan API dan jalankan rekaman nyata — itu pekerjaan sehari.
- Kumpulkan jumlah menit selama sebulan dan lihat tagihan aslinya.
- Kalau volumenya sudah cukup membuat kartu sibuk terus, pindahkan ke dalam dan simpan API sebagai cadangan saat lonjakan.
Karena protokolnya sama di kedua arah, perpindahan hanya soal mengganti alamat dan kunci — kodenya tidak ikut pindah.
Coba dengan rekaman Anda sendiri. Pendaftaran memakan waktu satu menit, dan menit gratisnya cukup untuk menilai kualitasnya.
Ambil kunci API gratisPertanyaan yang sering diajukan
Mulai volume berapa GPU sendiri balik modal?
Kira-kira ketika kartu sibuk separuh hari. Pada beberapa ratus menit per bulan, kartu menganggur dan bayar per menit lebih murah.
Bisakah jalan tanpa GPU?
Bisa di CPU, tapi puluhan kali lebih lambat: satu menit audio makan beberapa menit. Cukup untuk berkas sesekali, tidak untuk jalur produksi.
Sesulit apa memindahkannya nanti?
Protokolnya identik, jadi kode klien cuma ganti alamat dan kunci. Sisanya — antrean, konversi, pemantauan — dibangun dari nol.
Bagaimana privasi saat memakai API?
Perhatikan masa simpan. Di sini rekaman dan transkrip dihapus dalam 24 jam dan tidak pernah dipakai melatih model.
Bacaan terkait
- Model Whisper mana yang sebaiknya dipilih — Perbedaan model Whisper dari tiny hingga large-v3: kecepatan, akurasi, kebutuhan VRAM, dan kapan model kecil justru pilihan yang lebih masuk akal.
- Harga transkripsi: sebenarnya Anda membayar untuk apa — Bagaimana penagihan transkripsi bekerja, bagian audio mana yang diam-diam memakan biaya, kapan GPU sendiri lebih murah daripada API, dan cara memperkirakan biaya bulanan.
- Privasi dan keamanan transkripsi: yang perlu ditanyakan — Lima pertanyaan untuk penyedia pengenalan suara: masa simpan, pemakaian data untuk pelatihan, enkripsi kanal, akses karyawan, dan penghapusan atas permintaan.