BerandaBlog → Cara mengubah rekaman kuliah atau webinar menjadi catatan

Cara mengubah rekaman kuliah atau webinar menjadi catatan

Diterbitkan 2026-08-20 · 5 menit baca

Kuliah sembilan puluh menit kira-kira dua belas ribu kata. Menonton ulang demi satu rumus jelas boros, sedangkan mencatat manual memakan waktu sebanyak rekamannya sendiri. Transkrip menyelesaikannya dalam hitungan menit: teksnya bisa dicari, diringkas, dan dibuka lagi sebelum ujian atau sebelum implementasi.

Apa gunanya versi teks

Transkrip menutup tiga alasan orang menonton ulang rekaman:

Pembuat kursus dapat bonus: halaman dengan transkrip terindeks mesin pencari, sedangkan videonya tidak.

Menyiapkan rekaman

Kuliah hampir selalu datang dalam bentuk video. Ambil jalur audionya lalu kompres — gambar tidak dipakai untuk pengenalan, dan megabita berlebih hanya memperlambat unggahan:

ffmpeg -i lecture.mp4 -vn -ac 1 -ar 16000 -c:a libopus -b:a 24k lecture.ogg

Mono, 16 kHz, dan opus mengecilkan berkas sepuluh kali lipat tanpa kehilangan kejelasan: modelnya toh bekerja pada 16 kHz.

Transkrip dengan stempel waktu

Untuk kuliah, format bersegmen paling berguna — dari situ Anda bisa melompat ke menit yang tepat di video.

from openai import OpenAI

client = OpenAI(base_url="https://voicesscribe.com/v1", api_key="kunci Anda")

with open("lecture.ogg", "rb") as f:
    r = client.audio.transcriptions.create(
        model="whisper-1", file=f, response_format="verbose_json",
    )

for seg in r.segments:
    print(f"[{int(seg['start'])//60:02d}:{int(seg['start'])%60:02d}] {seg['text'].strip()}")

Hasilnya teks terpotong per kalimat dengan penanda waktu. Taruh di samping video dan setiap stempel waktu menjadi tautan ke rekaman.

Istilah, nama, dan rumus

Kuliah penuh kosakata khusus, dan justru di situ model mana pun tergelincir. Kirimkan daftarnya lewat prompt:

r = client.audio.transcriptions.create(
    model="whisper-1", file=f,
    prompt="Kuliah ekonometrika: heteroskedastisitas, uji Durbin-Watson, OLS",
)

Prompt tidak muncul di hasil — ia hanya menggeser pengenalan ke arah kata yang benar. Kalau pengajarnya konsisten satu bahasa, kirim juga kode bahasa: itu menghilangkan salah deteksi pada jeda dan kalimat pembuka.

Menangani sembilan puluh menit penuh

Rekaman panjang tidak muat dalam satu permintaan, jadi potong di jeda lalu gabungkan hasilnya:

ffmpeg -i lecture.ogg -f segment -segment_time 900 -c copy part%03d.ogg

Potongan lima belas menit diproses paralel dan digabung urut nama berkas. Usahakan memotong pada keheningan supaya tidak ada kalimat yang terbelah.

Coba dengan rekaman Anda sendiri. Pendaftaran memakan waktu satu menit, dan menit gratisnya cukup untuk menilai kualitasnya.

Ambil kunci API gratis

Pertanyaan yang sering diajukan

Berapa lama memproses kuliah satu jam?

Prosesnya lebih cepat dari waktu nyata: satu jam audio selesai dalam beberapa menit, dan memecahnya untuk diproses paralel membuatnya lebih cepat lagi.

Apakah audio ruang kelas yang buruk tetap terbaca?

Suara dekat mikrofon terbaca andal. Ruang bergema, pertanyaan dari belakang, dan bunyi proyektor menurunkan akurasi — mikrofon jepit atau keluaran dari mixer sangat membantu.

Bisa langsung dapat subtitle videonya?

Bisa, minta format srt atau vtt dan jawabannya langsung berupa berkas subtitle yang siap dipasang di pemutar.

Bagaimana memisahkan dosen dari penanya?

Tidak ada pemisahan pembicara otomatis. Kalau pertanyaan lewat mikrofon terpisah yang direkam ke jalur sendiri, transkrip jalurnya satu per satu.

Bacaan terkait