VoiceStudio

بديل مفتوح المصدر ومحلي بالكامل لـ ElevenLabs، يوفر استنساخ الصوت، وتصميم الأصوات، ودبلجة الفيديو، والإملاء، والنسخ، وإنشاء الكتب الصوتية بأكثر من 646 لغة، مع تشغيل محلي دون اشتراكات أو رسوم أو حدود استخدام.
المنصات: Docker لينكس ماك ويندوز
الترخيص: مجاني بالكامل مفتوح المصدر


ملاحظة

المشروع في مرحلة بيتا نشطة (active beta). قد تحدث أعطال بين الإصدارات. يُوصى باستخدام الإصدارات المستقرة من صفحة الإصدارات (Releases) بدلاً من فرع `main`.

ملاحظة

يتطلب التطبيق تنزيل نماذج الذكاء الاصطناعي (حجمها يصل إلى 10 جيجابايت أو أكثر). تأكد من اتصال إنترنت مستقر لأول تشغيل.

ملاحظة

أجهزة Mac ذات معمارية Intel لا يمكنها تشغيل النواة الخلفية (Python backend) محلياً؛ يجب استخدام خادوم بعيد (remote backend).

نبذة مفصلة عن VoiceStudio

VoiceStudio (المعروف سابقًا باسم OmniVoice Studio) هو تطبيق سطح مكتب مفتوح المصدر (AGPL-3.0) يقدم مجموعة متكاملة من أدوات الصوت المدعومة بالذكاء الاصطناعي، ويعمل محليًا بالكامل دون الحاجة إلى مفاتيح API أو اتصال بالإنترنت. يهدف المشروع إلى أن يكون بديلاً مجانياً وقوياً لخدمة ElevenLabs، مع ميزات متقدمة تشمل استنساخ الصوت من عينة صوتية مدتها 3 ثوانٍ فقط (zero-shot cloning)، وتصميم أصوات جديدة بالتحكم في الجنس والعمر واللكنة والنبرة والسرعة، ودبلجة فيديو كاملة من رابط يوتيوب أو ملف محلي (نسخ، ترجمة، إعادة صوت، تصدير MP4)، وإملاء فوري من أي تطبيق عبر اختصار لوحة المفاتيح، وعزل الصوت باستخدام Demucs لفصل الكلام عن الموسيقى، وتحديد المتحدثين تلقائياً (Speaker Diarization)، ومعالجة دفعات تصل إلى 50 ملفاً، وخادم MCP للتكامل مع Claude وغيرها من العملاء، وعلامة مائية غير مرئية للذكاء الاصطناعي (AI Watermark).

يدعم التطبيق أكثر من 646 لغة للتركيب الصوتي، مع محركات TTS متعددة تشمل OmniVoice (الافتراضي) و MLX-Audio و CosyVoice 3 و PocketTTS و KittenTTS وغيرها، ومحركات ASR مثل WhisperX و MLX Whisper و Parakeet MLX و Moonshine. يعمل التطبيق على أنظمة Windows و macOS و Linux، مع دعم GPU (CUDA، MPS، ROCm) والتشغيل التلقائي على CPU عند الحاجة. الحد الأدنى للمتطلبات: 8 جيجابايت ذاكرة عشوائية و 10 جيجابايت مساحة تخزين، مع موصى به 16 جيجابايت ذاكرة و 20 جيجابايت مساحة تخزين على SSD. يمكن تشغيله عبر Docker مع دعم CUDA و ROCm و CPU.

المشروع في مرحلة بيتا نشطة, وهو مجاني للاستخدام الشخصي والتعليمي والبحثي والتجاري. لا يتم إرسال أي بيانات إلى خوادم خارجية، ولا توجد حسابات أو تتبع إجباري. تم تطويره بواسطة debpalash. يوفر التطبيق وثائق تثبيت مفصلة لكل نظام تشغيل، ويشمل أداة تشخيص ذاتي لحل المشاكل.

المنشئ: دولي

تعلم أكثر عن VoiceStudio

أسئلة شائعة عن VoiceStudio

هذه الأسئلة الأكثر طرحا حول VoiceStudio
هل VoiceStudio مجاني حقاً؟

نعم، VoiceStudio هو برنامج مفتوح المصدر تحت رخصة AGPL-3.0، وهو مجاني للاستخدام الشخصي والتعليمي والبحثي والتجاري. يمكنك تشغيله، وبيع المحتوى الصوتي الذي تنشئه به، ودبلجة فيديوهاتك أو فيديوهات عملائك، ونشره عبر فريقك دون أي رسوم. لا توجد اشتراكات أو ائتمانات أو حدود استخدام.

ما هي متطلبات النظام لتشغيل VoiceStudio؟

الحد الأدنى للمتطلبات: نظام تشغيل Windows 10 x64، أو macOS 13.3 على Apple Silicon، أو Linux x86_64 مع glibc 2.39+، ذاكرة عشوائية 8 جيجابايت، مساحة تخزين 10 جيجابايت. المتطلبات الموصى بها: 16 جيجابايت ذاكرة، 20 جيجابايت+ على SSD، وبطاقة رسوميات NVIDIA CUDA بسعة 8 جيجابايت VRAM أو Apple Silicon.

كيف يمكن تثبيت VoiceStudio؟

يمكن تثبيت VoiceStudio عبر تحميل الحزمة المناسبة من صفحة الإصدارات (Releases) على GitHub: ملف DMG لنظام macOS، ملف MSI لنظام Windows، ملف AppImage لنظام Linux، أو عبر Docker. يمكن أيضاً تشغيله من المصدر باستخدام Node.js 20+ و Python 3.11+.

ما هي اللغات التي يدعمها VoiceStudio؟

يدعم VoiceStudio أكثر من 646 لغة للتركيب الصوتي (TTS) عبر محركات متعددة. التغطية الفعلية وجودة الصوت تعتمدان على المحرك المختار.

هل يمكن استخدام VoiceStudio مع وكلاء الذكاء الاصطناعي؟

نعم، يوفر VoiceStudio خادم MCP (Model Context Protocol) يوفر أدوات للتوليد والنسخ لمستخدمي MCP، مما يسمح للتطبيقات والوكلاء الذكيين بالاستفادة من قدرات VoiceStudio.

أخر الأخبار و تحديثات حول VoiceStudio

بدائل و برامج مشابه لـ VoiceStudio

اللغات المدعومة

الإنجليزية

أخر تحديث للصفحة 14 سبتمبر، 2026