Beranda → Blog → Cara mengubah rekaman kuliah atau webinar menjadi catatan
Cara mengubah rekaman kuliah atau webinar menjadi catatan
Kuliah sembilan puluh menit kira-kira dua belas ribu kata. Menonton ulang demi satu rumus jelas boros, sedangkan mencatat manual memakan waktu sebanyak rekamannya sendiri. Transkrip menyelesaikannya dalam hitungan menit: teksnya bisa dicari, diringkas, dan dibuka lagi sebelum ujian atau sebelum implementasi.
Apa gunanya versi teks
Transkrip menutup tiga alasan orang menonton ulang rekaman:
- Pencarian. Satu istilah, nama pustaka, atau nama penulis ketemu dalam sedetik, bukan lewat menggeser-geser pemutar.
- Catatan. Meringkas teks tertulis cukup sekali jalan, manual maupun dengan model bahasa.
- Aksesibilitas. Orang membaca ketika mendengarkan tidak praktis: di perjalanan, di ruang kerja terbuka, atau dengan gangguan pendengaran.
Pembuat kursus dapat bonus: halaman dengan transkrip terindeks mesin pencari, sedangkan videonya tidak.
Menyiapkan rekaman
Kuliah hampir selalu datang dalam bentuk video. Ambil jalur audionya lalu kompres — gambar tidak dipakai untuk pengenalan, dan megabita berlebih hanya memperlambat unggahan:
ffmpeg -i lecture.mp4 -vn -ac 1 -ar 16000 -c:a libopus -b:a 24k lecture.ogg
Mono, 16 kHz, dan opus mengecilkan berkas sepuluh kali lipat tanpa kehilangan kejelasan: modelnya toh bekerja pada 16 kHz.
Transkrip dengan stempel waktu
Untuk kuliah, format bersegmen paling berguna — dari situ Anda bisa melompat ke menit yang tepat di video.
from openai import OpenAI
client = OpenAI(base_url="https://voicesscribe.com/v1", api_key="kunci Anda")
with open("lecture.ogg", "rb") as f:
r = client.audio.transcriptions.create(
model="whisper-1", file=f, response_format="verbose_json",
)
for seg in r.segments:
print(f"[{int(seg['start'])//60:02d}:{int(seg['start'])%60:02d}] {seg['text'].strip()}")
Hasilnya teks terpotong per kalimat dengan penanda waktu. Taruh di samping video dan setiap stempel waktu menjadi tautan ke rekaman.
Istilah, nama, dan rumus
Kuliah penuh kosakata khusus, dan justru di situ model mana pun tergelincir. Kirimkan daftarnya lewat prompt:
r = client.audio.transcriptions.create(
model="whisper-1", file=f,
prompt="Kuliah ekonometrika: heteroskedastisitas, uji Durbin-Watson, OLS",
)
Prompt tidak muncul di hasil — ia hanya menggeser pengenalan ke arah kata yang benar. Kalau pengajarnya konsisten satu bahasa, kirim juga kode bahasa: itu menghilangkan salah deteksi pada jeda dan kalimat pembuka.
Menangani sembilan puluh menit penuh
Rekaman panjang tidak muat dalam satu permintaan, jadi potong di jeda lalu gabungkan hasilnya:
ffmpeg -i lecture.ogg -f segment -segment_time 900 -c copy part%03d.ogg
Potongan lima belas menit diproses paralel dan digabung urut nama berkas. Usahakan memotong pada keheningan supaya tidak ada kalimat yang terbelah.
Coba dengan rekaman Anda sendiri. Pendaftaran memakan waktu satu menit, dan menit gratisnya cukup untuk menilai kualitasnya.
Ambil kunci API gratisPertanyaan yang sering diajukan
Berapa lama memproses kuliah satu jam?
Prosesnya lebih cepat dari waktu nyata: satu jam audio selesai dalam beberapa menit, dan memecahnya untuk diproses paralel membuatnya lebih cepat lagi.
Apakah audio ruang kelas yang buruk tetap terbaca?
Suara dekat mikrofon terbaca andal. Ruang bergema, pertanyaan dari belakang, dan bunyi proyektor menurunkan akurasi — mikrofon jepit atau keluaran dari mixer sangat membantu.
Bisa langsung dapat subtitle videonya?
Bisa, minta format srt atau vtt dan jawabannya langsung berupa berkas subtitle yang siap dipasang di pemutar.
Bagaimana memisahkan dosen dari penanya?
Tidak ada pemisahan pembicara otomatis. Kalau pertanyaan lewat mikrofon terpisah yang direkam ke jalur sendiri, transkrip jalurnya satu per satu.
Bacaan terkait
- Cara mentranskrip rekaman rapat dan mendapat notulen yang berguna — Ubah rekaman Zoom, Teams, dan Google Meet menjadi teks yang bisa dicari serta notulen terstruktur: di mana berkasnya, cara mentranskrip, dan cara menarik keputusannya.
- Subtitle SRT dan VTT otomatis dari video dan webinar — Cara mendapatkan berkas subtitle bertanda waktu dari rekaman webinar atau video: ekstraksi audio, format SRT dan VTT, contoh kode, dan masalah yang sering muncul.
- Cara mengubah video YouTube menjadi teks — Tiga cara mendapatkan teks dari video YouTube: takarir otomatis bawaan, mentranskrip jalur audionya sendiri, dan pemrosesan massal — lengkap dengan kode dan batasannya.