Taletune

Cara Merekam Contoh Suara yang Benar-benar Terdengar Seperti Kamu

8 September 2025 · 4 menit baca

Saat suara hasil kloning terdengar aneh, orang menyalahkan AI-nya. Padahal biasanya AI melakukan persis seperti yang diminta — ia dengan setia memodelkan sebuah rekaman yang dibuat di dapur, pukul delapan malam, oleh seseorang yang tiba-tiba bergaya seperti penyiar radio karena ada mikrofon menyala.

Contoh suaranya yang menentukan segalanya. Berikut hal-hal yang benar-benar berpengaruh, kurang lebih berurutan dari yang paling penting.

1. Singkirkan suara latar

Yang satu ini lebih penting daripada semua sisanya digabung.

Model suara tidak bisa memisahkan kamu dari lingkunganmu dengan rapi. Ia ikut mempelajari ruangannya. Mesin cuci piring yang menyala dua meter darimu jadi bagian dari apa yang model itu anggap sebagai suaramu, dan setiap dongeng sesudahnya membawa sisa bayangannya.

Yang bisa kamu lakukan:

  • Tutup pintu. Kamar tidur dengan banyak kain adalah tempat paling ideal — kasur, gorden, dan karpet menyerap pantulan suara.
  • Matikan apa pun yang punya mesin atau kipas. Mesin cuci piring, penyedot asap dapur, AC.
  • Tutup jendela. Suara lalu lintas lebih mengganggu daripada yang kamu kira.
  • Hindari kamar mandi dan dapur. Permukaan keras menciptakan gema, dan gema itu akan ikut terekam selamanya.

Kamu tidak butuh keheningan total. Kamu butuh tidak adanya suara-suara tertentu yang bersaing.

2. Bacalah seperti saat kamu membacakan untuk anakmu

Begitu ada mikrofon, kebanyakan orang jadi memelankan tempo, merendahkan nada, dan bercerita seperti narator film dokumenter. Hasil kloningnya pun terdengar begitu — orang asing yang agak sok berwibawa, tapi kebetulan beraksen sama denganmu.

Perbaikannya ada di kepala. Bayangkan anakmu di sebelahmu, setengah mengantuk, lalu bacalah untuk bayangan itu. Sedikit terlalu santai jauh lebih baik daripada sedikit terlalu berakting.

Kalau kamu sadar sedang memasang "suara istimewa", berhenti dan ulangi. Cuma butuh dua puluh detik.

3. Pegang ponsel dengan benar

Mikrofon ponsel itu bagus. Orangnya saja yang sering memakainya dengan keliru.

  • Sejengkal tangan dari mulut. Lebih dekat, kamu akan dapat hentakan di setiap huruf "p" dan "b". Lebih jauh, suara ruangan mulai masuk.
  • Agak miring ke samping, bukan tepat di depan mulut. Dengan begitu embusan napasmu meleset dari mikrofon.
  • Jangan menutupi sisi bawah ponsel. Di kebanyakan ponsel, mikrofon utamanya ada di situ, dan ibu jari yang menutupinya adalah penyebab paling umum contoh suara terdengar teredam.
  • Lepas casing-nya kalau casing-nya tebal.

Earbud biasanya justru menurunkan kualitas, bukan menaikkan. Mikrofonnya dirancang untuk panggilan telepon — kompresinya berat dan frekuensi rendahnya dipangkas, dan itu persis membuang kehangatan yang membuat sebuah suara terasa dikenali. Ponselnya sendiri lebih baik.

4. Beri satu menit penuh kalau bisa

Tiga puluh detik sudah bisa menghasilkan model yang layak pakai. Satu menit menghasilkan model yang terasa lebih mantap, terutama pada kalimat-kalimat yang tidak biasa.

Makin banyak audio, makin banyak contoh cara kamu mengucapkan bunyi yang berbeda-beda, jadi model itu lebih sedikit menebak. Kalau aplikasinya menampilkan naskah, bacalah sampai habis, jangan berhenti begitu tertulis "sudah cukup".

5. Baca naskahnya apa adanya

Kalau ada naskah di layar, bacalah kata-kata itu. Aplikasi sering menjalankan pemeriksaan ucapan-ke-teks yang membandingkan apa yang kamu ucapkan dengan apa yang seharusnya kamu ucapkan, sebagai penanda "apakah rekaman ini cukup jelas untuk dipakai". Berimprovisasi akan gagal di pemeriksaan itu, bahkan kalau audionya sendiri bagus.

Kalau kamu tersendat, sebagian besar aplikasi lebih suka kamu mengulang dari awal daripada memaksa lanjut — enam puluh detik yang bersih lebih baik daripada sembilan puluh detik dengan batuk di tengahnya.

6. Rekamlah dalam kondisi normal

Suara lelah pada tengah malam menghasilkan kloningan yang terdengar lelah. Begitu juga suara saat pilek, atau suara sisa-sisa setelah adu mulut soal menyikat gigi.

Kamu tidak perlu dalam kondisi prima. Kamu hanya perlu berada di sekitar dirimu yang biasa, karena itulah suara yang dikenali anakmu. Kalau sedang pilek, tunggu dua hari. Model yang kamu buat dalam lima menit itulah yang akan kamu dengar berbulan-bulan.

Rutinitas enam puluh detik

  1. Kamar tidur, pintu tertutup, semua yang bermesin dimatikan.
  2. Ponsel di tangan, sejengkal jauhnya, agak miring ke samping, sisi bawah tidak tertutup.
  3. Satu kali latihan membaca baris pertama, dengan suara keras, untuk melepaskan gaya penyiar.
  4. Rekam seluruh naskah dengan tempo membacamu yang biasa.
  5. Putar ulang. Tanyakan satu hal: ini terdengar seperti aku sedang bicara, atau seperti aku sedang tampil?
  6. Kalau terdengar sedang tampil, ulangi sekali lagi. Pasti lebih baik.

Yang tetap tidak akan sempurna

Bahkan dengan contoh suara yang sempurna, siapkan diri bahwa hasil kloningnya akan jadi versi dirimu yang sedikit lebih kalem. Lapisan aktingnya — suara serigala, jeda dramatis, bisikan saat anakmu mulai terlelap — di situlah jaraknya masih ada.

Ini perlu kamu tahu supaya tidak kecewa. Yang tetap bertahan adalah hal yang paling berarti bagi anak kecil: bunyi suara kamu. Anak-anak selalu langsung mengenalinya, dan itulah inti seluruhnya.

Setelah kamu merekam

Dua kebiasaan yang layak dipelihara:

Dengarkan satu dongeng penuh sebelum kamu mengandalkannya. Sebuah contoh suara bisa terdengar baik-baik saja saat berdiri sendiri, tapi memperlihatkan masalah setelah tiga menit narasi.

Rekam ulang kalau keadaanmu berubah. Baru pulih dari sakit yang panjang, atau contoh pertamanya kamu buat di apartemen berisik yang sekarang sudah kamu tinggalkan? Contoh suara baru cuma butuh semenit, dan profil lamanya bisa kamu hapus.

Dan kalau kamu lebih suka tidak menyimpan profil suara secara permanen, menghapusnya lalu merekam ulang nanti sepenuhnya masuk akal — pertanyaan-pertanyaan privasi yang layak diajukan membahas kenapa sebagian orang tua lebih memilih cara itu.

Siap mencoba? Taletune gratis di iOS dan Android, dan dalam sekitar dua menit kamu sudah tahu apakah hasilnya terdengar seperti kamu.

Baca berikutnya