شرح برنامج Irodori-TTS: الميزات، التحذيرات، وكيفية الاستخدام
28 يوليو، 2026
ما هو برنامج القراءة بالذكاء الاصطناعي Irodori-TTS؟
ربما يتساءل الكثيرون عن برنامج القراءة الجديد بالذكاء الاصطناعي "Irodori-TTS".
في هذه المقالة، سنشرح بوضوح مميزات Irodori-TTS، وما يمكنه فعله، والتنبيهات، وكيفية الاستخدام.
علاوة على ذلك، بالنسبة لأولئك الذين يشعرون أن "الإعداد يبدو صعبًا"، سنقدم أيضًا طريقة لتركيب الكلام يمكن استخدامها الآن دون الحاجة إلى التثبيت.
ما ستعرفه من هذه المقالة
- ما هو برنامج Irodori-TTS؟
- ما يمكن فعله بـ Irodori-TTS والتنبيهات
- كيفية استخدام Irodori-TTS (من الإعداد إلى تعديل الصوت)
- الطريقة الموصى بها عندما يكون بناء البيئة صعبًا
ما هو Irodori-TTS؟ شرح برنامج تركيب الكلام الياباني بالذكاء الاصطناعي
في البداية، سنشرح باختصار مميزات Irodori-TTS وكيفية عمله كبرنامج لتركيب الكلام بالذكاء الاصطناعي.
Irodori-TTS هو نموذج لتركيب الكلام بالذكاء الاصطناعي يعمل محليًا
Irodori-TTS هو برنامج لتركيب الكلام بالذكاء الاصطناعي متخصص في اللغة اليابانية.
المطور هو Aratako، وهو متاح مجانًا كبرنامج مفتوح المصدر (ترخيص MIT).
أكبر ميزة له هي إمكانية "التشغيل المحلي"، حيث تكتمل عملية تركيب الكلام على جهاز الكمبيوتر الخاص بك فقط.
بما أن جميع عمليات توليد الصوت تتم على جهاز الكمبيوتر الخاص بك، فلن يتم إرسال النصوص أو البيانات الصوتية التي تم إنشاؤها إلى خوادم خارجية.
بعد الإعداد الأولي، يمكنك توليد الصوت دون اتصال بالإنترنت، ولا توجد قيود على عدد مرات التوليد.
ومع ذلك، يتطلب الإعداد أدوات برمجة مثل Python و Git.
أيضًا، للتشغيل بسرعة عالية، يوصى باستخدام جهاز كمبيوتر عالي الأداء مزود بـ GPU (بطاقة رسومات).
ما يمكن فعله وما لا يمكن فعله بـ Irodori-TTS
بعد ذلك، سنشرح ما يمكن وما لا يمكن فعله بـ Irodori-TTS.
ما يمكن فعله بـ Irodori-TTS
بما أن Irodori-TTS يعمل في بيئة محلية، يمكنك توليد الصوت بعدد غير محدود من المرات.
حتى في البيئات التي لا تتوفر فيها خدمة الإنترنت، يمكنك إنشاء الصوت بحرية بمجرد انتهاء الإعداد الأولي.
هناك عدة طرق متاحة لتوجيه نوع الصوت المراد إنشاؤه، وباستخدام ميزة Caption، يمكنك إنشاء جودة الصوت التي تفضلها بمجرد التوجيه النصي.
أيضًا، من الممكن إعادة إنتاج صوت تملكه من خلال استنساخ الصوت، أو إضافة تعبيرات عاطفية باستخدام Emoji.
بما أنه يخضع لترخيص MIT، فإن الاستخدام التجاري للأصوات الناتجة ممكن أيضًا.
تنبيهات حول Irodori-TTS
من ناحية أخرى، هناك بعض التنبيهات التي يجب معرفتها قبل استخدام Irodori-TTS.
مدة الصوت الذي يمكن إنشاؤه في المرة الواحدة هي حوالي 30 ثانية
الحد الأقصى للقراءة في عملية توليد واحدة هو حوالي 30 ثانية.
إذا كنت ترغب في قراءة نصوص طويلة، فستحتاج إلى تقسيم النص وتوليد الصوت عدة مرات.
من الصعب الحصول على الصوت أو طريقة التحدث كما تريد تمامًا
بدلاً من المرونة العالية، لا يوفر Irodori-TTS أصواتًا افتراضية (أصوات أساسية).
لذلك، إذا لم تقم بتحديد Caption أو صوت مرجعي، فسيتحسن الجنس والعمر بشكل عشوائي في كل مرة يتم فيها التوليد.
عندما تريد القراءة بنفس الصوت، يجب عليك تحميل صوت مرجعي (Reference Audio).
أيضًا، لا توجد وظيفة لضبط النبرة أو التنغيم يدويًا.
اللغة المدعومة هي اليابانية فقط
اللغة المدعومة هي اليابانية فقط، ولا يدعم اللغات الأجنبية مثل الإنجليزية.
أيضًا، قد تحدث أخطاء في قراءة الـ Kanji، لذا يجب الحذر.
يوصى بجهاز كمبيوتر بمواصفات عالية مزود بـ GPU
اعتمادًا على مواصفات الكمبيوتر، قد يستغرق توليد الصوت وقتًا طويلاً.
في أجهزة الكمبيوتر التي لا تحتوي على GPU، يستغرق التوليد حوالي دقيقة واحدة حتى للجمل القصيرة.
بالنسبة للمعالجات من الفئة الاقتصادية مثل Celeron أو N100، نشعر أن الاستخدام العملي صعب.
كيفية استخدام Irodori-TTS (خطوات الإعداد)
من هنا، سنشرح باختصار كيفية استخدام Irodori-TTS.
التدفق العام للإعداد هو كما يلي:
- تثبيت البرامج المطلوبة
- إنشاء مجلد عمل
- عمل Clone لـ Irodori-TTS من GitHub
- تثبيت الحزم المطلوبة
- تشغيل Irodori-TTS
- تحميل نموذج الذكاء الاصطناعي
- قراءة النص
1. تثبيت البرامج المطلوبة لـ Irodori-TTS
يتطلب إعداد Irodori-TTS بعض التحضيرات.
أولاً، قم بتثبيت هذه الأنواع الثلاثة:
- Python 3.10 أو أحدث: لغة برمجة
- Git: نظام إدارة الإصدارات (مطلوب لتنزيل Irodori-TTS)
- uv: مدير حزم Python
لتثبيت Python و Git و uv، أولاً، انقر بزر الماوس الأيمن على قائمة ابدأ وانقر على "Terminal" (لا يلزم التشغيل كمسؤول).
ستفتح شاشة الـ Terminal (PowerShell).
في هذه الشاشة، أدخل الأوامر التالية وقم بتنفيذها.
winget install --id Git.Git -e
winget install --id=astral-sh.uv -e
بهذا نكون قد قمنا بتثبيت ما يلزم لإعداد Irodori-TTS.
※ يتم إدارة Python بواسطة uv، لذا سيتم تثبيته تلقائيًا أثناء الإعداد.
بمجرد التثبيت، أغلق الـ Terminal (PowerShell) وافتحه مرة أخرى (من أجل تفعيل المسارات).
2. إنشاء مجلد عمل
بعد ذلك، قم بإنشاء مجلد عمل.
سيتم تثبيت Irodori-TTS هنا.
في هذا المثال، قمنا بإنشاء مجلد باسم "irodori-tts" مباشرة تحت القرص C.
بمجرد إنشاء المجلد، انتقل إلى ذلك المجلد في الـ Terminal.
cd C:\irodori-tts
3. عمل Clone لـ Irodori-TTS من GitHub
أدخل الأمر التالي في الـ Terminal لعمل Clone لمستودع Irodori-TTS من GitHub.
git clone https://github.com/Aratako/Irodori-TTS.git
ستنتهي عملية الـ Clone للمستودع في غضون ثوانٍ قليلة.
أدخل الأمر التالي للانتقال إلى مجلد المستودع الذي تم عمل Clone له.
cd Irodori-TTS
4. تثبيت الحزم المطلوبة
أدخل وقم بتنفيذ الأمر التالي لتثبيت الحزم اللازمة لتشغيل Irodori-TTS.
uv sync
سيستغرق الأمر بعض الوقت لتنزيل وتثبيت كمية كبيرة من الحزم.
سيتم تثبيت برنامج Python نفسه هنا أيضًا.
أثناء التنزيل والتثبيت، انتظر دون إغلاق شاشة الـ Terminal.
بما أنك ستقوم بتنزيل ملفات بحجم يقارب 3 جيجابايت، نوصي بالإعداد في مكان به اتصال إنترنت جيد.
5. تشغيل Irodori-TTS
بمجرد الانتهاء من تنزيل وتثبيت الحزم، يكون قد اكتمل الإعداد.
قم بتشغيل Irodori-TTS.
أدخل الأمر التالي وقم بتنفيذه، ثم انتظر قليلاً حتى يبدأ التشغيل.
uv run python gradio_app.py --server-name 0.0.0.0 --server-port 7860
عندما يظهر ما يلي في الـ Terminal، يكون التشغيل قد اكتمل.
Running on local URL: http://0.0.0.0:7860
افتح متصفح الويب واذهب إلى http://localhost:7860.
ستفتح واجهة مستخدم Irodori-TTS (WebUI) بهذا الشكل.
6. تحميل نموذج الذكاء الاصطناعي
لتحميل نموذج الذكاء الاصطناعي المستخدم في قراءة النصوص، انقر على "Load Model".
عند الاستخدام لأول مرة، سيبدأ تنزيل نموذج الذكاء الاصطناعي عند الضغط على هذا الزر.
عند ظهور رسالة اكتمال في Model Status (المكان المحاط باللون الأحمر في الصورة التالية)، يكون تحميل نموذج الذكاء الاصطناعي قد انتهى.
7. قراءة النصوص باستخدام Irodori-TTS
في Irodori-TTS، يمكنك إعطاء تعليمات حول كيفية القراءة، بما في ذلك التعبيرات العاطفية، ولكن لنقم أولاً بالقراءة دون تعليمات كمثال.
قم بالتمرير لأسفل حيث يوجد حقل لإدخال النص، ثم أدخل النص الذي تريد قراءته.
هذه المرة سنقوم بقراءة "こんにちは、これはイロドリTTSで作成された音声です。" (مرحبًا، هذا صوت تم إنشاؤه باستخدام إيرودوري TTS).
(بما أن كتابة "Irodori-TTS" بالأحرف اللاتينية لم تنجح في القراءة بشكل صحيح، فقد استخدمنا الكاتاكانا "イロドリTTS")
انقر على زر "Generate" لبدء توليد الصوت.
يستخدم Irodori-TTS الـ CPU أو الـ GPU (بطاقة الرسومات) الخاصة بجهاز الكمبيوتر لتوليد الصوت.
لذلك، يختلف الوقت المستغرق في التوليد بشكل كبير اعتمادًا على أداء جهاز الكمبيوتر الخاص بك.
هذه المرة، تم التوليد باستخدام كمبيوتر محمول لا يحتوي على GPU، وعلى الرغم من أنها جملة قصيرة، إلا أن التوليد استغرق حوالي دقيقة واحدة.
مرجع: تم اختبار التوليد في بيئة: CPU: Ryzen 5 4650U، ذاكرة: DDR4 32GB، Windows 11 Pro 24H2.
بمجرد انتهاء التوليد، ستظهر الموجة الصوتية بهذا الشكل، وستتمكن من تشغيل الصوت.
مثال على قراءة "こんにちは、これはイロドリTTSで作成された音声です。"
إذا لم تكن هناك مشكلة بعد الاستماع، انقر على زر التنزيل (أيقونة السهم للأسفل) لحفظ ملف الصوت.
سيتم حفظ ملف الصوت بصيغة WAV.
بهذا، تمكنت من تركيب الصوت باستخدام Irodori-TTS.
كيفية ضبط صوت Irodori-TTS
في Irodori-TTS، يمكنك ضبط تعبيرات الجنس والعواطف بطرق متنوعة.
تحديد التعبيرات العاطفية باستخدام الرموز التعبيرية (Emoji)
بالنقر على "Emoji Palette" الموجود أسفل حقل إدخال النص، يمكنك اختيار الرموز التعبيرية.
تم تخصيص تعبير عاطفي لكل رمز تعبيري.
- 😊 بمرح، بسعادة
- 😭 نشيج، بكاء
- 😰 بعجلة، ارتباك
- ⏩ كلام سريع
- 📖 سرد، مونولوج
بمجرد وضع الرمز التعبيري في حقل إدخال النص، يمكنك القراءة بالتعبير العاطفي المحدد.
مثال على قراءة "😊 こんにちは、これはイロドリTTSで作成された音声です。"
مثال على قراءة "📖 こんにちは、これはイロドリTTSで作成された音声です。"
ومع ذلك، بمجرد تحديد الرمز التعبيري، لا يمكنك تحديد الجنس أو العمر بشكل محدد.
تحميل صوت مرجعي للقراءة بنفس الصوت
في Irodori-TTS، يمكنك تحميل ملف صوتي مرجعي وجعل البرنامج يقرأ بالاعتماد على ذلك الصوت.
يتم تحميل الصوت المرجعي من الجزء المكتوب عليه "اسحب الصوت هنا - أو - انقر للتحميل".
لا يقتصر الأمر على القراءة بنفس الصوت فحسب، بل يمكن القراءة بجودة صوت أوضح مقارنة بحالة عدم تحديد أي شيء.
من الممكن أيضًا ضبط أسلوب القراءة مباشرة باستخدام ميزة Caption
في Irodori-TTS، يمكنك تحديد نوع الصوت الذي تريد القراءة به مباشرة عبر النص.
لاستخدام ميزة Caption، يجب تشغيل "نسخة VoiceDesign"، وسيتغير أمر تشغيل Irodori-TTS في الـ Terminal.
uv run python gradio_app_voicedesign.py --server-name 0.0.0.0 --server-port 7861
عند تنفيذ هذا الأمر، ستعمل شاشة تشغيل نسخة VoiceDesign.
تستخدم نسخة VoiceDesign نموذج ذكاء اصطناعي مختلفًا عن النسخة القياسية، لذا عند الاستخدام لأول مرة، يجب النقر على "Load Model" لتنزيل النموذج بشكل منفصل عن النسخة القياسية.
بما أن حجم نموذج الذكاء الاصطناعي يبلغ حوالي 2 جيجابايت، نوصي بتنزيله في مكان به اتصال إنترنت جيد.
في شاشة تشغيل نسخة VoiceDesign، يوجد مربع نص "Caption / Style Prompt (optional)".
هنا، أدخل نصًا يصف كيف تريد أن يكون صوت القراءة.
- يرجى القراءة بصوت نسائي هادئ، بنبرة قريبة وناعمة وطبيعية.
- يرجى التحدث بصوت رجالي مفعم بالحيوية، بشكل مشرق وواضح.
- يرجى القراءة بصوت رجالي منخفض، بهدوء مثل مذيع الأخبار.
بهذه الطريقة، يمكنك تحديد نوع الصوت المستخدم في القراءة.
على سبيل المثال، عند القراءة مع تحديد "يرجى القراءة بصوت نسائي هادئ، بنبرة قريبة وناعمة وطبيعية."، أصبح الصوت كالتالي:
مثال مع تحديد "يرجى القراءة بصوت نسائي هادئ، بنبرة قريبة وناعمة وطبيعية."
هنا أيضًا، تم الحصول على صوت قراءة بجودة واضحة وسهلة الاستماع.
ومع ذلك، هناك تنبيه بخصوص ميزة Caption.
تستغرق ميزة Caption وقتًا أطول لتوليد الصوت مقارنة بطرق القراءة الأخرى.
عند التوليد على كمبيوتر محمول هذه المرة، استغرق توليد هذه الجملة القصيرة حوالي 5 دقائق.
عند استخدام ميزة Caption، نوصي باستخدام جهاز كمبيوتر عالي المواصفات مزود بـ GPU.
ماذا يحدث عند قراءة نص بالإنجليزية؟
Irodori-TTS هو برنامج قراءة يدعم اللغة اليابانية فقط.
إذًا، ماذا يحدث إذا حاولنا قراءة نص بالإنجليزية؟
لنجرب إدخال جملة بسيطة كمثال.
مثال على قراءة "Hello, this is a voice recording created using Irodori-TTS."
بهذا الشكل، أصبحت كلمة Hello تُنطق بلكنة كاتاكانا "هارو"، وأصبح جزء recording غير مفهوم، ولم تنجح القراءة بشكل صحيح.
عندما تريد قراءة نص بالإنجليزية، نوصي باستخدام خدمة قراءة بالذكاء الاصطناعي تدعم اللغات الأجنبية.
طريقة تركيب كلام موصى بها عندما يكون "الإعداد صعبًا"
بعد قراءة ما سبق، ربما شعر البعض أن إعداد Irodori-TTS يبدو صعبًا بعض الشيء.
إذا لم تكن معتادًا على التعامل مع الـ Terminal، فإن مجرد خطوات تحضير أدوات مثل Python و Git، وتثبيت الحزم وتنزيل نماذج الذكاء الاصطناعي سيستغرق وقتًا.
أيضًا، إذا لم يكن لديك جهاز كمبيوتر مزود بـ GPU، فسيستغرق تركيب الصوت الواحد وقتًا طويلاً جدًا، مما يجعل استخدامه لأغراض مثل التعليق الصوتي للفيديوهات أمرًا صعبًا.
يجب تقسيم النصوص الطويلة إلى أجزاء مدتها حوالي 30 ثانية وتوليد الصوت عدة مرات.
بالنسبة لأولئك الذين يرغبون في إنشاء صوت من نص دون الحاجة للتثبيت أو الإعداد، سنقدم من هنا خدمة لتركيب الكلام بالذكاء الاصطناعي يمكن استخدامها عبر المتصفح.
『Ondoku』 صوت بالذكاء الاصطناعي يمكن استخدامه دون الحاجة للتثبيت
ما نوصي به عندما تريد تركيب الكلام بسهولة بأحدث تقنيات الذكاء الاصطناعي هو خدمة تركيب الكلام بالذكاء الاصطناعي 『Ondoku』.
『Ondoku』 هي خدمة لتركيب الكلام بالذكاء الاصطناعي تتيح لك إنشاء صوت بمجرد فتح المتصفح ولصق النص.
يمكنك إنشاء صوت مجانًا الآن على الكمبيوتر أو الهاتف الذكي أو الجهاز اللوحي.
بما أن توليد الصوت يتم في السحابة (من جهة الخادم)، فلا توجد مشكلة حتى لو لم يكن جهاز الكمبيوتر الخاص بك مزودًا بـ GPU.
يتوفر منذ البداية عدة أصوات مثل أصوات الرجال والنساء والأطفال، لذا يمكنك القراءة فورًا بمجرد الاختيار دون الحاجة لتحضير أصوات مرجعية أو Captions.
النصوص الطويلة يمكن قراءتها كما هي.
بالإضافة إلى ذلك، يدعم Ondoku اللغة الإنجليزية أيضًا!
وهو يدعم لغات متعددة مثل الفرنسية والإسبانية والكورية والصينية، لذا يمكن استخدامه للقراءة بغير اللغة اليابانية.
علاوة على ذلك، يمكنك تجربة قراءة أكثر طبيعية مع الجيل القادم من أصوات الذكاء الاصطناعي (OndokuBeta).
عندما تبحث عن طريقة لقراءة النص كصوت، لماذا لا تجرب 『Ondoku』 الذي يمكن استخدامه مجانًا وبسهولة؟
مقارنة الاختلافات بين Ondoku و Irodori-TTS
أخيرًا، سنقارن بين الاختلافات الرئيسية بين Ondoku و Irodori-TTS.
| البند | Ondoku | Irodori-TTS |
|---|---|---|
| طريقة التشغيل | سحابي (عبر المتصفح) | محلي (المعالجة على جهاز الكمبيوتر الخاص بك) |
| الإعداد | غير مطلوب | يتطلب بناء بيئة Python و Git وغيرها |
| اللغات المدعومة | أكثر من 35 لغة | اليابانية فقط |
| كيفية اختيار الصوت | مجرد الاختيار من بين عدة أصوات | تحديد عبر استنساخ الصوت، Caption، الرموز التعبيرية |
| حد التوليد في المرة الواحدة | يدعم النصوص الطويلة | حوالي 30 ثانية كحد أقصى |
| الاستخدام التجاري | ممكن (يجب ذكر الائتمان عند الاستخدام المجاني) | ممكن (ترخيص MIT) |
| الأجهزة المدعومة | كمبيوتر، هاتف ذكي، جهاز لوحي | كمبيوتر (يوصى بـ GPU) |
| الرسوم | توجد خطة مجانية (توسيع عدد الحروف في الخطط المدفوعة) | مجاني (بسبب التشغيل المحلي) |
بالمقارنة، يتفوق Ondoku في السهولة والاستخدام الفوري، بينما يمكن استخدام Irodori-TTS إذا كنت تملك جهاز كمبيوتر عالي الأداء وترغب في تصميم الصوت بدقة.
نوصي بـ Ondoku لمن يريد صوتًا الآن، أو يحتاج لقراءة بلغات متعددة، أو يريد استخدامه على الهاتف الذكي أو الجهاز اللوحي.
كما أنه مناسب لمن يريد قراءة نصوص طويلة كما هي، أو لا يريد قضاء وقت في الإعداد، أو لا يملك GPU في جهاز الكمبيوتر الخاص به.
بما أنه يمكنك توليد أصوات عالية الجودة فورًا بمجرد فتح المتصفح، لماذا لا تجرب Ondoku مجانًا أولاً؟
ملخص مميزات وإعداد وكيفية استخدام Irodori-TTS
في هذه المقالة، شرحنا برنامج Irodori-TTS لتركيب الكلام بالذكاء الاصطناعي الذي يعمل محليًا والمتخصص في اللغة اليابانية.
يعد Irodori-TTS أداة جذابة لمن يرغب في الاهتمام بتعبيرات الصوت، مثل تصميم جودة الصوت عبر استنساخ الصوت أو الـ Caption، والتحكم في المشاعر عبر الرموز التعبيرية.
ومع ذلك، فإن طريقة الإعداد والاستخدام مخصصة للمستخدمين المتقدمين، حيث يتطلب الإعداد بناء بيئة Python و Git.
أيضًا، في أجهزة الكمبيوتر التي لا تحتوي على GPU، يستغرق توليد الصوت وقتًا طويلاً.
بالنسبة لمن يقول "أريد استخدام تركيب الكلام بسهولة الآن"، نوصي بـ 『Ondoku』 الذي يمكن استخدامه عبر المتصفح فقط.
لماذا لا تقوم أنت أيضًا بإنشاء أصوات عالية الجودة باستخدام قراءة ذكاء اصطناعي مجانية وسهلة الاستخدام؟
■ برنامج تركيب الكلام بالذكاء الاصطناعي "Ondoku"
"Ondoku" هي أداة لتحويل النص إلى كلام عبر الإنترنت ويمكن استخدامها دون أي تكلفة أولية.
- يدعم ما يقرب من 50 لغة بما في ذلك اليابانية والإنجليزية والصينية والكورية والإسبانية والفرنسية والألمانية.
- متاح من كل من الكمبيوتر الشخصي والهاتف الذكي
- مناسب للأعمال والتعليم والترفيه وما إلى ذلك.
- لا يتطلب التثبيت، ويمكن استخدامه على الفور من المتصفح الخاص بك
- كما يدعم القراءة من الصور
لاستخدامه، ما عليك سوى إدخال نص أو تحميل ملف من الموقع. قم بإنشاء ملفات صوتية طبيعية في ثوانٍ. يمكنك استخدام تركيب الكلام لما يصل إلى 5000 حرف مجانًا، لذا يرجى تجربته أولاً.
Email: ondoku3.com@gmail.com
برنامج قراءة النص أوندوكو. إنها خدمة تحويل النص إلى كلام لا تتطلب التثبيت ويمكن لأي شخص استخدامها مجانًا. إذا قمت بالتسجيل مجانًا، فيمكنك الحصول على ما يصل إلى 5000 حرف مجانًا كل شهر. إشترك الآن مجانا
- ما هو أوندوكو؟
- اقرأ النص على أوندوكو
- تسجيل مجاني
- أسعار الباقات
- قائمة المقالات
- تجربة خدمات مجانية أخرى