Teks menjadi Suara Gratis: Suara AI Alami, Unduh MP3
Ubah teks menjadi suara yang terdengar alami dan unduh sebagai MP3 atau WAV.
Teks Anda dikirim ke server kami dan penyedia text-to-speech untuk membuat audio, yang selalu disimpan sebagai MP3. Kami tidak menyimpan teks Anda. Suara ini dibuat oleh AI. Lihat kebijakan privasi kami.
Semua yang sudah Anda lakukan di sini tetap gratis.
Teks Anda tidak pernah meninggalkan perangkat. Suara dibuat oleh model AI yang berjalan di browser Anda, jadi tidak ada yang diunggah ke server. Audio ini dibuat oleh AI; mohon cantumkan hal tersebut di tempat Anda mempublikasikannya.
Hasil terbaru di perangkat ini
Disimpan di browser ini saja, tidak pernah diunggah. Disimpan selama 7 hari, hingga 500 MB, yang terlama dihapus lebih dulu.
Belum ada yang tersimpan. Hasil yang Anda buat di alat apa pun akan muncul di sini.
Avalon Pro menyimpan hasil terbaru Anda di perangkat ini selama 7 hari, sehingga Anda bisa mengunduhnya lagi dari alat mana pun, dan membawa seluruh kumpulan file ke alat berikutnya. Lihat Avalon Pro
Fungsi alat ini
Untuk mengubah teks menjadi suara secara gratis, tempel teks Anda di atas, pilih suara, lalu tekan Buat suara: hasilnya dapat langsung diputar dan diunduh sebagai MP3, tanpa perlu mendaftar. Suara berasal dari Kokoro, model suara AI terbuka, dan berjalan di browser Anda, sehingga teks Anda tetap tersimpan di perangkat. Cocok untuk narasi video pendek, narasi slide, memeriksa tulisan dengan mendengarkan, dan mendengarkan tulisan Anda sendiri.
Cara menggunakannya
- Ketik atau tempel teks Anda ke dalam kotak, atau buka file .txt.
- Pilih Suara dan Kecepatan.
- Pilih MP3 untuk file kecil yang dapat diputar di mana saja, atau WAV untuk mengedit video.
- Tekan Buat suara. Saat pertama kali, model suara akan diunduh satu kali.
- Tekan Putar untuk mendengarkan, lalu Unduh.
Tips agar suara terdengar alami
- Tulis angka, tanggal, dan harga dengan cara biasa: "$19.99", "October 4", dan "9:30" akan dibacakan secara lengkap.
- Tanda baca mengatur irama: koma menambah jeda singkat dan paragraf baru menambah jeda yang lebih panjang.
- Untuk narasi video, gunakan kalimat pendek dan beri baris kosong saat adegan berganti.
- Jika sebuah nama terdengar salah, tulis sesuai cara pengucapannya.
- Butuh teks terjemahan untuk video yang sudah jadi? Gunakan pembuat subtitle gratis kami.
Kredit
Suara menggunakan Kokoro-82M oleh hexgrad (Apache 2.0). Pengucapan memakai kamus dari misaki (Apache 2.0). Model berjalan dengan ONNX Runtime Web (MIT), dan file MP3 dibuat dengan lamejs (LGPL). Pemberitahuan lengkap: lisensi pihak ketiga.
Gratis, Pro, dan Pro+
| Gratis | Pro | Pro+ | |
|---|---|---|---|
| Teks per file audio | 1.000 karakter | 20.000 karakter | 20.000 karakter di browser Anda, 40.000 karakter dengan suara server cepat |
| Satu file audio per paragraf, dalam ZIP | — | Ya | Ya |
| Preset tersimpan | — | Ya | Ya |
| Kualitas hasil | Sama di browser Anda untuk semua paket | Sama di browser Anda, akurasi lebih tinggi di server kami | |
| Alat server dibayar dengan kredit | Dengan paket kredit | Dengan paket kredit | 300 kredit setiap bulan |
Kredit Pro+ digunakan untuk alat server: suara ke teks dengan akurasi lebih tinggi, subtitle otomatis dengan akurasi lebih tinggi, suara server cepat, serta ringkasan, jawaban, dan terjemahan PDF berbasis AI. Paket kredit (150 kredit, berlaku 12 bulan) bisa dipakai di paket mana pun. Bandingkan paket.
Pertanyaan yang sering diajukan
Bolehkah saya memakai audio ini di video YouTube atau untuk keperluan komersial?
Ya. Model suara Kokoro-82M dirilis di bawah lisensi Apache 2.0 yang mengizinkan penggunaan komersial, dan kami tidak menambahkan ketentuan sendiri pada audio yang Anda buat. Suara ini dibuat oleh AI: cantumkan hal tersebut jika platform Anda meminta pelabelan konten AI.
Apakah teks saya diunggah ke suatu tempat?
Tidak. Model suara berjalan di dalam browser, pada perangkat Anda sendiri. Teks Anda tidak dikirim ke server kami maupun pihak lain. Satu-satunya pengecualian adalah suara server cepat Pro+ yang bersifat opsional dan Anda aktifkan sendiri.
Mengapa proses pertama lebih lama?
Pertama kali, browser Anda mengunduh model suara beserta kamus pengucapannya, sekitar 97 MB. Keduanya disimpan di browser Anda, sehingga kunjungan berikutnya langsung dimulai.
Berapa lama prosesnya?
Tergantung perangkat Anda. Pada laptop terbaru, audio biasanya dibuat lebih cepat daripada durasi putarnya; ponsel dan komputer lama lebih lambat. Bilah kemajuan menunjukkan sejauh mana prosesnya, dan Anda dapat menghentikannya kapan saja.
Bahasa apa saja yang didukung?
Bahasa Inggris, dengan suara Amerika. Bahasa lain belum didukung.
Mengapa ada kata yang terdengar salah?
Pengucapan berasal dari kamus berisi sekitar 180.000 kata bahasa Inggris. Nama dan kata baru yang tidak ada di dalamnya dibaca dengan aturan ejaan, yang bisa saja meleset. Menulis kata sesuai bunyinya, misalnya Shiv-awn untuk Siobhan, biasanya memperbaikinya.
Apa saja batasannya?
Versi gratis membacakan hingga 1.000 karakter sekaligus, tanpa batas harian. Avalon Pro membacakan hingga 20.000 karakter sekaligus, dapat menyimpan satu file audio per paragraf dalam ZIP, dan menyimpan suara serta kecepatan Anda sebagai preset. Avalon Pro+ menambahkan suara server cepat untuk teks hingga 40.000 karakter, menggunakan kredit.