Apa itu Irodori-TTS? Fitur, Poin Penting, dan Cara Pakainya
28 Juli 2026
Software AI pembaca teks macam apa Irodori-TTS itu?
Mungkin banyak dari Anda yang penasaran dengan software AI pembaca teks baru "Irodori-TTS".
Dalam artikel ini, kami akan menjelaskan **fitur, hal yang bisa dilakukan, poin perhatian, dan cara penggunaan Irodori-TTS** dengan cara yang mudah dipahami.
Selain itu, bagi Anda yang merasa "set-up sepertinya sulit", kami juga memperkenalkan **metode sintesis suara yang bisa langsung digunakan sekarang juga tanpa perlu instalasi**.
Hal yang akan diketahui dari artikel ini
- Software seperti apa Irodori-TTS itu?
- Hal yang bisa dilakukan dan poin perhatian Irodori-TTS
- Cara penggunaan Irodori-TTS (dari set-up hingga penyesuaian suara)
- Metode yang direkomendasikan saat pembangunan lingkungan terasa sulit
Apa itu Irodori-TTS? Penjelasan Software Sintesis Suara AI Bahasa Jepang
Pertama-tama, kami akan menjelaskan secara singkat fitur-fitur dari software sintesis suara AI Irodori-TTS.
Irodori-TTS adalah Model Sintesis Suara AI yang Berjalan Secara Lokal
Irodori-TTS adalah software sintesis suara AI yang dikhususkan untuk bahasa Jepang.
Pengembangnya adalah Aratako さん, dan dipublikasikan secara gratis sebagai open-source (Lisensi MIT).
Fitur utamanya adalah kemampuan "operasi lokal", di mana sintesis suara diselesaikan hanya di PC Anda sendiri.
Karena semua proses pembuatan suara dilakukan di PC Anda, teks atau data suara yang dihasilkan tidak akan dikirim ke server eksternal.
Setelah set-up awal, Anda dapat menghasilkan suara tanpa koneksi internet, dan **tidak ada batasan jumlah pembuatan suara**.
Namun, set-up memerlukan alat pemrograman seperti Python dan Git.
Selain itu, PC berperforma tinggi yang dilengkapi dengan GPU (Graphic Board) direkomendasikan agar software dapat berjalan dengan cepat.
Hal yang Bisa dan Tidak Bisa Dilakukan dengan Irodori-TTS
Selanjutnya, kami akan menjelaskan tentang apa yang bisa dan tidak bisa dilakukan dengan Irodori-TTS.
Hal yang Bisa Dilakukan dengan Irodori-TTS
Karena Irodori-TTS berjalan di lingkungan lokal, Anda dapat **menghasilkan suara tanpa batas sesering mungkin**.
Bahkan di lingkungan tanpa koneksi internet, setelah set-up awal selesai, Anda dapat membuat suara dengan bebas.
Tersedia beberapa cara untuk menginstruksikan jenis suara apa yang ingin dibuat, dan dengan menggunakan fitur caption, Anda dapat menciptakan kualitas suara sesuai keinginan hanya dengan instruksi teks.
Selain itu, Anda juga dapat mereplikasi suara yang Anda miliki melalui voice cloning, atau menambahkan ekspresi emosi dengan emoji.
Karena menggunakan Lisensi MIT, **suara yang dihasilkan juga dapat digunakan untuk tujuan komersial**.
Poin Perhatian Irodori-TTS
Di sisi lain, ada beberapa poin perhatian yang perlu diketahui sebelum menggunakan Irodori-TTS.
Suara yang dapat dibuat dalam satu waktu terbatas hingga sekitar 30 detik
**Satu kali pembuatan suara hanya dapat membacakan teks hingga sekitar 30 detik**.
Jika ingin membacakan teks yang panjang, Anda perlu membagi teks tersebut dan membuatnya berulang kali.
Sulit untuk menghasilkan suara atau cara bicara yang benar-benar sesuai keinginan
Karena Irodori-TTS memiliki tingkat kebebasan yang tinggi, suara default (suara dasar) tidak disediakan secara khusus.
Oleh karena itu, jika Anda tidak menentukan caption atau suara referensi, jenis kelamin dan usia akan berubah secara acak setiap kali suara dihasilkan.
**Jika Anda ingin membacakan teks dengan suara yang sama, Anda perlu memuat suara referensi (reference audio)**.
Selain itu, tidak ada fitur untuk menyesuaikan intonasi atau nada secara manual.
Bahasa yang didukung hanya bahasa Jepang
Bahasa yang didukung hanya bahasa Jepang, dan tidak mendukung bahasa asing seperti bahasa Inggris.
Selain itu, kesalahan pembacaan kanji terkadang bisa terjadi, jadi perlu berhati-hati.
Direkomendasikan PC spek tinggi dengan GPU
Tergantung pada spesifikasi PC, pembuatan suara mungkin memakan waktu.
**Pada PC yang tidak dilengkapi GPU, pembuatan teks pendek sekalipun bisa memakan waktu sekitar 1 menit.**
Untuk CPU kelas entry-level seperti Celeron atau N100, rasanya akan sulit untuk penggunaan praktis.
Cara Menggunakan Irodori-TTS (Alur Set-up)
Berikut penjelasan singkat mengenai cara menggunakan Irodori-TTS.
Alur keseluruhan set-up adalah sebagai berikut:
- Instal software yang diperlukan
- Buat folder kerja
- Clone Irodori-TTS dari GitHub
- Instal paket yang diperlukan
- Jalankan Irodori-TTS
- Muat model AI
- Bacakan teks
1. Instal software yang diperlukan untuk Irodori-TTS
Persiapan awal diperlukan untuk men-set up Irodori-TTS.
Pertama, instal ketiga jenis alat ini:
- Python 3.10 atau lebih tinggi: Bahasa pemrograman
- Git: Sistem manajemen versi (diperlukan untuk mengunduh Irodori-TTS)
- uv: Manajer paket Python
Untuk menginstal Python, Git, dan uv, pertama-tama klik kanan pada menu Start dan klik "Terminal" (tidak perlu dijalankan sebagai administrator).
Kemudian layar Terminal (PowerShell) akan terbuka.
Masukkan perintah berikut di layar ini dan jalankan.
winget install --id Git.Git -e
winget install --id=astral-sh.uv -e
Dengan ini, Anda telah menginstal hal-hal yang diperlukan untuk men-set up Irodori-TTS.
※ Karena Python dikelola oleh uv, Python akan diinstal secara otomatis saat proses set-up.
Setelah instalasi, tutup Terminal (PowerShell) sekali dan buka kembali (agar "path" terdaftar).
2. Buat folder kerja
Selanjutnya, buat folder kerja.
Irodori-TTS akan diinstal di sini.
Kali ini, kami membuat folder dengan nama "irodori-tts" langsung di bawah drive C.
Setelah folder dibuat, pindah ke folder tersebut di Terminal.
cd C:\irodori-tts
3. Clone Irodori-TTS dari GitHub
Masukkan perintah berikut di Terminal untuk meng-clone repositori Irodori-TTS dari GitHub.
git clone https://github.com/Aratako/Irodori-TTS.git
Proses clone repositori akan selesai dalam beberapa detik.
Masukkan perintah berikut untuk pindah ke folder repositori yang telah di-clone.
cd Irodori-TTS
4. Instal paket yang diperlukan
Masukkan dan jalankan perintah berikut untuk menginstal paket-paket yang diperlukan agar Irodori-TTS dapat berjalan.
uv sync
Ini akan memakan waktu karena banyak paket yang harus diunduh dan diinstal.
Inti Python juga akan diinstal di sini.
Tunggu hingga proses unduh dan instal selesai tanpa menutup layar Terminal.
Karena file berkapasitas hampir 3GB akan diunduh, disarankan untuk melakukan set-up di tempat dengan koneksi internet yang baik.
5. Jalankan Irodori-TTS
Setelah pengunduhan dan instalasi paket selesai, maka **set-up telah rampung**.
Sekarang jalankan Irodori-TTS.
Masukkan perintah berikut, jalankan, dan tunggu sebentar hingga aplikasi dimulai.
uv run python gradio_app.py --server-name 0.0.0.0 --server-port 7860
Jika Terminal menampilkan pesan seperti berikut, berarti aplikasi sudah berjalan.
Running on local URL: http://0.0.0.0:7860
Buka browser web dan akses http://localhost:7860.
Layar Irodori-TTS (WebUI) akan terbuka seperti ini.
6. Muat model AI
Klik "Load Model" untuk memuat model AI yang akan digunakan untuk membacakan teks.
Saat pertama kali digunakan, menekan tombol ini akan memulai pengunduhan model AI.
Setelah pesan selesai muncul di Model Status (area yang dikelilingi warna merah pada gambar berikut), proses pemuatan model AI selesai.
7. Bacakan teks dengan Irodori-TTS
Di Irodori-TTS, Anda dapat memberikan instruksi cara membaca termasuk ekspresi emosi, namun sebagai contoh, mari kita coba bacakan tanpa instruksi apa pun.
Gulir ke bawah untuk menemukan kolom input teks, lalu masukkan kalimat yang ingin dibacakan.
Kali ini, mari kita coba membacakan "こんにちは、これはイロドリTTSで作成された音声です。"
(Karena penulisan "Irodori-TTS" dalam alfabet tidak terbaca dengan benar, kami menuliskannya dalam katakana sebagai "イロドリTTS")
Klik tombol "Generate" untuk memulai pembuatan suara.
Irodori-TTS menggunakan CPU atau GPU (Graphic Board) di PC Anda untuk menghasilkan suara.
Oleh karena itu, **waktu yang dibutuhkan untuk pembuatan suara akan sangat bervariasi tergantung pada performa PC**.
Karena kali ini kami membuatnya menggunakan laptop yang tidak dilengkapi GPU, pembuatan suara meskipun kalimatnya pendek memakan waktu sekitar 1 menit.
Referensi: Pembuatan suara diuji pada lingkungan CPU: Ryzen 5 4650U, Memori: DDR4 32GB, Windows 11 Pro 24H2.
Setelah selesai, bentuk gelombang suara akan muncul, dan suara dapat diputar.
Contoh pembacaan "こんにちは、これはイロドリTTSで作成された音声です。"
Jika hasil uji coba tidak ada masalah, klik tombol unduh (ikon panah bawah) untuk menyimpan file suara.
File suara akan disimpan dalam format WAV.
Dengan ini, **Anda telah berhasil mensintesis suara menggunakan Irodori-TTS**.
Cara Menyesuaikan Suara Irodori-TTS
Di Irodori-TTS, Anda dapat menyesuaikan ekspresi seperti jenis kelamin dan emosi melalui berbagai cara.
Menentukan ekspresi emosi dengan emoji
Klik "Emoji Palette" di bawah kolom input teks untuk memilih emoji.
Setiap emoji memiliki ekspresi emosi yang ditetapkan.
- 😊 Dengan riang, tampak senang
- 😭 Tersedu-sedu, suara tangis
- 😰 Terburu-buru, panik
- ⏩ Bicara cepat
- 📖 Narasi, monolog
**Hanya dengan memasukkan emoji ke dalam kolom input teks, Anda dapat membacakan dengan ekspresi emosi yang ditentukan**.
Contoh pembacaan "😊 こんにちは、これはイロドリTTSで作成された音声です。"
Contoh pembacaan "📖 こんにちは、これはイロドリTTSで作成された音声です。"
Namun, jika hanya menentukan emoji, Anda tidak dapat menentukan jenis kelamin atau usia secara spesifik.
Memuat suara referensi untuk membacakan dengan suara yang sama
Irodori-TTS memungkinkan Anda memuat file suara referensi dan membacakan teks dengan merujuk pada suara tersebut.
Suara referensi dimuat melalui bagian yang bertuliskan **"Lepaskan audio di sini - atau - klik untuk mengunggah"**.
Selain dapat membacakan dengan suara yang sama, kualitas suara yang dihasilkan juga bisa lebih jernih dibandingkan jika tidak menentukan apa pun.
Dapat menyesuaikan gaya pembacaan secara langsung dengan fitur caption
Di Irodori-TTS, Anda juga dapat **menentukan secara langsung melalui teks suara seperti apa yang diinginkan untuk membacakan teks**.
Untuk menggunakan fitur caption, Anda perlu menjalankan "Versi VoiceDesign", dan perintah untuk menjalankan Irodori-TTS di Terminal akan berbeda.
uv run python gradio_app_voicedesign.py --server-name 0.0.0.0 --server-port 7861
Saat perintah ini dijalankan, layar operasi versi VoiceDesign akan terbuka.
Karena versi VoiceDesign menggunakan model AI yang berbeda dari versi standar, **saat pertama kali digunakan, Anda perlu mengklik "Load Model" untuk mengunduh model secara terpisah dari versi standar.**
Karena kapasitas model AI sekitar 2GB, disarankan untuk mengunduhnya di tempat dengan koneksi internet yang baik.
Di layar operasi versi VoiceDesign, terdapat kotak teks "Caption / Style Prompt (optional)".
Di sini, masukkan kalimat tentang jenis suara yang Anda inginkan.
- Bacakan dengan suara wanita yang tenang, terasa dekat, lembut, dan natural.
- Gunakan suara pria yang bersemangat, bicaralah dengan ceria dan jelas.
- Bacakan secara datar seperti pembawa berita dengan suara pria yang rendah.
Dengan cara ini, Anda dapat menentukan jenis suara untuk pembacaan.
Misalnya, jika ditentukan dengan **"Bacakan dengan suara wanita yang tenang, terasa dekat, lembut, dan natural."**, suaranya akan menjadi seperti berikut.
Contoh dengan instruksi "Bacakan dengan suara wanita yang tenang, terasa dekat, lembut, dan natural."
Di sini pun, suara yang dihasilkan jernih dan mudah didengar.
Namun, ada poin perhatian untuk fitur caption.
**Fitur caption memakan waktu lebih lama untuk menghasilkan suara dibandingkan dengan metode pembacaan lainnya.**
**Saat dibuat menggunakan laptop kali ini, pembuatan kalimat pendek ini memakan waktu sekitar 5 menit.**
Jika ingin menggunakan fitur caption, sangat direkomendasikan menggunakan PC spek tinggi dengan GPU.
Apa yang terjadi jika membacakan teks bahasa Inggris?
Irodori-TTS adalah software pembaca teks yang hanya mendukung bahasa Jepang.
Lalu, apa yang terjadi jika kita mencoba membacakan teks bahasa Inggris?
Mari kita coba masukkan contoh kalimat sederhana.
Contoh pembacaan "Hello, this is a voice recording created using Irodori-TTS."
Seperti ini, kata "Hello" diucapkan dengan pelafalan katakana "Haro", dan bagian "recording" diucapkan dengan pelafalan yang tidak jelas, sehingga tidak terbaca dengan benar.
**Jika Anda ingin membacakan teks bahasa Inggris, disarankan untuk menggunakan layanan pembaca teks AI yang mendukung bahasa asing**.
Metode Sintesis Suara yang Direkomendasikan Saat "Set-up Terasa Sulit"
Setelah membaca sejauh ini, mungkin ada di antara Anda yang merasa set-up Irodori-TTS sepertinya agak merepotkan.
Jika tidak terbiasa dengan pengoperasian Terminal, langkah-langkah menyiapkan alat seperti Python dan Git, menginstal paket, hingga mengunduh model AI saja sudah memakan waktu.
Selain itu, jika Anda tidak memiliki PC dengan GPU, satu kali sintesis suara akan memakan waktu terlalu lama, sehingga sulit digunakan untuk tujuan seperti narasi video.
Kalimat panjang juga harus dibagi menjadi sekitar 30 detik dan dibuat berulang kali.
Bagi Anda yang ingin membuat suara dari teks tanpa harus instalasi atau set-up, berikut kami perkenalkan **layanan sintesis suara AI yang bisa digunakan di browser**.
"Ondoku", Suara AI yang Bisa Digunakan Tanpa Instalasi
Jika ingin mensintesis suara dengan mudah menggunakan AI terbaru, layanan sintesis suara AI "Ondoku" adalah rekomendasinya.
"Ondoku" adalah layanan sintesis suara AI di mana Anda **hanya perlu membuka browser dan menempelkan teks** untuk membuat suara.
Anda dapat segera membuat suara secara gratis melalui PC, smartphone, maupun tablet.
Karena pembuatan suara dilakukan di cloud (sisi server), tidak masalah jika PC Anda tidak dilengkapi GPU.
Karena **berbagai pilihan suara seperti suara pria, wanita, hingga anak-anak sudah tersedia sejak awal**, Anda tidak perlu menyiapkan suara referensi atau caption, cukup pilih dan teks akan segera dibacakan.
Teks panjang pun dapat langsung dibacakan.
Bahkan, Ondoku juga mendukung bahasa Inggris!
Karena mendukung banyak bahasa seperti bahasa Prancis, Spanyol, Korea, Mandarin, dan lainnya, Ondoku dapat digunakan untuk pembacaan selain bahasa Jepang.
Selain itu, Anda juga dapat mencoba pembacaan yang lebih alami dengan suara AI generasi berikutnya (Ondoku Beta).
Jika Anda sedang mencari cara untuk membacakan teks sebagai suara, mengapa tidak mencoba "Ondoku" yang mudah digunakan secara gratis?
Perbandingan Perbedaan Ondoku dan Irodori-TTS
Terakhir, berikut perbandingan perbedaan utama antara Ondoku dan Irodori-TTS.
| Item | Ondoku | Irodori-TTS |
|---|---|---|
| Metode Operasi | Cloud (dioperasikan di browser) | Lokal (diproses di PC sendiri) |
| Set-up | Tidak diperlukan | Memerlukan pembangunan lingkungan Python, Git, dll. |
| Bahasa yang Didukung | Lebih dari 35 bahasa | Hanya bahasa Jepang |
| Cara Memilih Suara | Cukup pilih dari berbagai suara yang ada | Ditentukan melalui voice cloning, caption, atau emoji |
| Batas Pembuatan Sekali Jalan | Mendukung teks panjang | Hingga sekitar 30 detik |
| Penggunaan Komersial | Bisa (perlu pencantuman kredit untuk penggunaan gratis) | Bisa (Lisensi MIT) |
| Perangkat yang Mendukung | PC, Smartphone, Tablet | PC (GPU direkomendasikan) |
| Biaya | Tersedia paket gratis (jumlah karakter bertambah dengan paket berbayar) | Gratis (karena beroperasi secara lokal) |
Jika dibandingkan, Anda dapat memilih sesuai kebutuhan: **Ondoku untuk kemudahan dan penggunaan instan, sedangkan Irodori-TTS untuk Anda yang memiliki PC berperforma tinggi dan ingin merancang suara secara mendetail**.
Bagi Anda yang membutuhkan suara sekarang juga, memerlukan pembacaan multibahasa, atau ingin menggunakan di smartphone atau tablet, Ondoku sangat direkomendasikan.
Ondoku juga cocok bagi Anda yang ingin langsung membacakan teks panjang, tidak ingin membuang waktu untuk set-up, atau PC-nya tidak dilengkapi GPU.
Karena Anda dapat segera menghasilkan suara berkualitas tinggi hanya dengan membuka browser, mengapa tidak mencoba Ondoku secara gratis?
Kesimpulan Fitur, Set-up, dan Cara Penggunaan Irodori-TTS
Dalam artikel ini, kami telah menjelaskan tentang Irodori-TTS, software sintesis suara AI operasi lokal yang dikhususkan untuk bahasa Jepang.
Irodori-TTS adalah alat yang menarik bagi mereka yang mementingkan ekspresi suara, seperti desain kualitas suara melalui voice cloning dan caption, serta kontrol emosi menggunakan emoji.
Namun, **metode set-up dan cara penggunaannya ditujukan untuk pengguna tingkat lanjut**, di mana pembangunan lingkungan Python dan Git sangat diperlukan.
Selain itu, pada PC tanpa GPU, pembuatan suara akan memakan waktu.
Bagi Anda yang ingin menggunakan sintesis suara dengan mudah sekarang juga, "Ondoku" yang dapat digunakan hanya dengan browser sangat direkomendasikan.
Mengapa Anda tidak mencoba menciptakan suara berkualitas tinggi dengan sintesis suara AI gratis yang mudah digunakan ini?
■ Perangkat lunak sintesis ucapan AI “Ondoku”
"Ondoku" adalah alat text-to-speech online yang dapat digunakan tanpa biaya awal.
- Mendukung sekitar 50 bahasa termasuk Jepang, Inggris, Cina, Korea, Spanyol, Prancis, dan Jerman.
- Tersedia dari PC dan smartphone
- Cocok untuk bisnis, pendidikan, hiburan, dll.
- Tidak diperlukan instalasi, dapat langsung digunakan dari browser Anda
- Juga mendukung membaca dari gambar
Untuk menggunakannya, cukup masukkan teks atau unggah file dari situs. Hasilkan file suara alami dalam hitungan detik. Anda dapat menggunakan sintesis ucapan hingga 5.000 karakter secara gratis, jadi silakan mencobanya terlebih dahulu.
Email: ondoku3.com@gmail.com
Perangkat lunak Text-To-SpeechOndoku. Ini adalah layanan Text-To-Speech yang tidak memerlukan instalasi dan dapat digunakan oleh siapa saja secara gratis. Jika Anda mendaftar secara gratis, Anda bisa mendapatkan hingga 5000 karakter gratis setiap bulannya. Daftar sekarang secara gratis
- Apa itu Ondoku?
- Baca teks dengan Ondoku
- Pendaftaran gratis
- Paket harga
- Daftar artikel
- Coba layanan gratis lainnya