فيديو

الاستخدام التجاري 579 models لا يوجد علامة مائية لا يلزم التسجيل
النموذج:
+ GPT-5, Claude, Gemini
تحويل صورة الوجه وكتابة كتابة إلى فيديو رأس متحدث. اختار صورة رمزية أو قم بتحميل صورة شخصية (بموافقة). يقوم المسار بتشغيل TTS (174 صوت، 37 لغة) ويتم تزامن الشفتين مع الفم مع الصوت. الخرج هو MP4 نظيف في 9: 16 أو 16: 9.
All 8 stock avatars are licensed for commercial use. Pick the one whose age/gender/ethnicity best fits your content.

اسحب صورة هنا أو انقر لتحميلها

صورة رأسية أمامية، PNG/JPG/WebP، 10 ميغابايت كحد أقصى

أقل من 800 حرف تقريبا لكل عرض (أقل من 60 ثانية من الكلام) تقسيم النصوص الأطول إلى أجزاء. 0 / 830 · 0 words · 0s
أصوات من مكتبتنا التي تضم 174 صوتا، متصفح كامل على /voice/.

خط الأنابيب: Kokoro TTS، ثم نموذج صور حديثة عالية الجودة. يستخدم الرموز المشتراة فقط. يستغرق التوليد بضعة دقائق. المخرج MP4، لا علامة مائية. يمكنك إغلاق العلامة - المقطع يقع في لوحة التحكم الخاصة بك.

العلاوة: تسعير كل ثانية من المحادثة، وشراء الرموز فقط
0%
جيل جديد
.. صورةك المتكلمه

الذكاء الاصطناعي مولد حديث-أفاتار - لا رسم شهري، لا علامة مائية، دفع لكل ثانية من الكلام

تحويل صورة وكتابة مطبوعة إلى فيديو للصورة التي تتحدث كلماتك. اختار من 8 صور مخزون تغطي مجموعة متنوعة من الجنسين، والأعمار، والعرقيات، أو تحميل صورة خاصة بك (مع تأكيد الموافقة). الصوت يأتي من Kokoro TTS (174 أصوات عبر 37 لغة) ونموذج صورة حديثة عالية الجودة لتنشيط الوجه، لذلك كل عرض يستخدم الرموز المشتراة، سعر ثانية من الكلام. MP4 تنزيل نظيف بدون علامة مائية ومناسب للمحتوى التجاري عندما تمتلك حقوق الصورة.

أشرطة الفيديو المتعلقة بالتدريب والتعيين

إنشاء صورة متسقة للشركة التي تقدم كل وحدة تدريبية في نفس الصوت. تبادل النص لكل وحدة. تحديث جملة مرة واحدة وإعادة عرض في دقيقة - لا إعادة التصوير.

التسويق المتعدد اللغات

ترجمة سيناريو واحد إلى 37 لغة وجعل نفس الشخصية تتحدث في كل لغة. أرخص بكثير من استئجار ممثل صوت لكل لغة، ومتسق عبر الأسواق.

مقاطع يومية على وسائط التواصل الاجتماعي

المبدعون الذين لا يريدون التصوير يوميا يمكنهم كتابة أسبوع من قصص LinkedIn أو YouTube القصيرة مع صورة مستقرة - نفس الوجه، النص الجديد، صفر إضاءة أو ميكروفون مطلوب.

كيف تصنع فيديو شخصية ناطقة

اختار صورة رمزية أو قم بتحميل صورتك الخاصة

وهناك ثمانية من مقدمي الأسهم مرخص لهم مسبقا للاستخدام التجاري. وإذا قمت برفع صورتك الخاصة، ضع علامة في مربع الموافقة - هذا شرط قانوني واعتماد المنصة.

أدخل النص

Keep each render under about 800 characters (under 60 seconds of speech). Split longer scripts into separate takes.

اختار الصوت واللغة والجانب

174 صوتاً عبر 37 لغة. 9:16 هو الأفضل لـ ريلز / القصص القصيرة / تيك توك؛ 16:9 هو الأفضل لليوتيوب / لينكد إن / مقدمات الحلقات الدراسية على الإنترنت.

توليد وتحميل

ضع علامة على خيار "إنشاء". يستغرق الصوت والرسوم المتحركة بضعة دقائق. قم بتنزيل ملف MP4، أو شارك عبر رابط واحد، أو اترك العلامة - يتم حفظ الفيديو على لوحة حسابك عندما تكون جاهزًا.

كيف نقوم بالمقارنة على الافتاترات المتكلمين

Free.ai أفاتار دال - يد هيجين التوليف
الاشتراك الشهري رموز الدفع أولا بأول من 5.90 دولار/شهر من 29 دولارا/شهريا من 22 دولارا/شهريا
الحد الأقصى للدقائق المدرجة في فيديو ميزان مع رموز 10 دقائق 15 دقيقة 10 دقائق
العلامة المائية على المخرجات لا نعم نعم لا توجد فئة مجانية
مصرف الأصوات 174 صوتا/37 صوتاً ~120 ~300 ~120
تحميل صورة نعم نعم المستوى المدفوع فقط المؤسسات فقط
المقارنة تستند إلى التسعير العام لكل منصة وشروط المستويات اعتبارًا من عام 2026.
الخيارات المتقدمة
النتيجة
تريد نتائج أفضل؟ نماذج عالية الجودة (GPT-5, Claude, Gemini) توفر جودة أعلى. عرض الخطط

❤️ أحب Free.ai؟ أخبر أصدقائك!

تسجيل للحصول على رابط الإحالة وكسب 30 الرموز لكل صديق.

تريد المزيد؟ Sign up free: 30,000 tokens/day
التسجيل مجانا

... معالجة طلبك

إنشاء فيديوهات شخصية ناطقة من صورة ونص مع الذكاء الاصطناعي الأعلى، تسعير لكل ثانية من الكلام. مثالية للعروض ووسائط التواصل الاجتماعي.

كيف تستخدم فيديو

1
أدخل مدخلك

أدخل نص، أو تحميل ملف، أو وصف ما تريد. لا حساب مطلوب.

2
انقر على إنشاء

الذكاء الاصطناعي لدينا يقوم بمعالجة طلبك في ثوانٍ باستخدام أفضل نماذج المصدر المفتوح.

3
تنزيل وتقاسم

تحميل، نسخ، أو مشاركة نتائجك مجانا للاستخدام الشخصي والتجاري.

استخدام هذه الأداة عن طريق API

أتمتة هذه الأداة من شفرة الخاصة بك. OpenAI-متوافقة REST نقطة نهاية، حامل-رمز توثيق، لا إضافية SDK مطلوبة. تكاليف الرموز تتطابق مع واجهة شبكة الويب.

curl -X POST https://api.free.ai/v1/video/generate/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"prompt": "A cat playing piano", "duration": 4}'

فيديو - FAQ

تحويل صورة صورة وكتابة مكتوبة إلى فيديو رأس ناطق - الافتتاحية تتحدث كلماتك مع حركة الفم الشفافة المتزامنة. مسارين: اختار من 8 صور مخزون مرخصة مسبقاً (نوع الجنس / العمر / العرق) أو تحميل صورة شخصية مع تأكيد الموافقة الإلزامية. الصوت واللغة تأتي من بنكنا 174-صوت Kokoro. نموذج صورة ناطقة ممتازة تحرك الوجه، لذلك كل عرض يستخدم الرموز المشتراة.

نعم داخل مجمع الرموز اليومي. تتراوح التكلفة مع طول النص ومدة العرض - حوالي 2500 رموز في الثانية من المخرج (TTS + lip-sync)، مع حد أدنى 10000 رموز. يكلف رأس متحدث لمدة 20 ثانية حوالي 50000 رموز. يغطى المجمع اليومي المجاني لقطات قصيرة؛ الخطط المدفوعة أو حزم الرموز تغطي فيديوهات شرح أطول.

لا - يمكنك اختيار من 8 صور صور (إلينا، ماركوس، عائشة، دافيد، مي، راج، صوفيا، جيمس) التي تغطي مجموعة من الجنسين، الأعمار، والعرقيات. ونحن نملك تراخيص تجارية لكل منهم. إذا قمت بتحميل صورتك الخاصة بدلا من ذلك، يجب أن تضع علامة على مربع الموافقة للتأكد من أن لديك إذن لتحريك صورة ذلك الشخص.

37 languages via Kokoro TTS, including English (US / UK), Spanish, French, German, Italian, Portuguese, Mandarin, Japanese, Korean, Arabic, Hindi, Russian, and 24 more. The voice picker auto-syncs the language field when you select a voice. Lip-sync adapts convincingly to any language.

9:16 الصورة الرأسية (الافتراضية - أفضل ل ريلز / تيك توك / قصص قصيرة / قصص إنستغرام) و 16:9 المناظر الطبيعية (أفضل لليوتيوب، لينكد إن، مقدمات الحلقات الدراسية على الإنترنت، التدريب المؤسسي). يجلس الصورة في الإطار المناسب لكل من - إطار الصورة الرأسية على 9:16، الصورة المتوسطة على 16:9.

أقل من 60 ثانية لكل عرض، حوالي 800 حرف بمعدل 150 حرف في الدقيقة. بالنسبة للإنتاجات الأطول (شرح مدته 5 دقائق، وحدة دراسية مدتها 10 دقائق)، تقسيم النص إلى عدة مرات وجمعها معاً في أي محرر.

يقوم نموذج صوت حديث عالي الجودة بتنشيط الفم والرأس والتعبير من الصوت. وينتج تزامن مقنع لللغة الإنجليزية واللغات الأوروبية الرئيسية. وتظل الدقة طبيعية على وتيرة المحادثة حتى بالنسبة للغات النغمية مثل الماندرين والتايلاندية، على الرغم من أن الكلام السريع / المؤكد هو أصعب الحالة.

Yes - if you use a stock avatar (all 8 are pre-licensed for commercial use) or if you have rights to the uploaded portrait (your own face, a licensed stock photo, or explicit written consent). You must not impersonate real people without permission or misrepresent the avatar as a public figure. Platform terms require disclosure of AI-generated content where applicable (YouTube, TikTok).

إذا قمت بتحميل صورة، يجب أن تؤكد أنك تحصل على موافقة الشخص المعني على إحياء صورة مثلهم مع صوت متحدث. هذا يفرضه الطرف الخلفي - API يرفض التحميلات بدون `consent_given=1`. التحميلات التي تظهر بوضوح المشاهير، الشخصيات السياسية، أو الأطراف الثالثة غير موافقة يرفض. هذا هو على حد سواء شرط قانوني وسياسة الثقة والأمان للمنصة.

174 صوتا عبر 37 لغة عبر Kokoro. الأداة تظهر أكثر 14 شعبية في الخط؛ القائمة الكاملة يمكن البحث في / voice / tts /. استعراض أي صوت هناك قبل العودة إلى تمثيل الصورة، حتى الصوت-وجه التوافق يشعر بالصحة.

وتفرض شركات D-ID و HeyGen و Synthesia رسوماً تتراوح بين 5.90 دولاراً و29 دولاراً شهرياً مع 10-15 دقيقة مشمولة، ثم أسعار إضافية. ولا يدفع Free.ai أي رسوم شهرية - فأنت تدفع مقابل كل عرض مع الرموز المشتراة، وتسعير كل ثانية من الكلام.

نعم. ضع JSON إلى /v1/video/avatar/ مع `script`, `voice`, `language`, `avatar` (stock id like "stock_1") OR `avatar_url` + `consent_given=1`, `aspect_ratio`. يحتاج إلى رموز مشتراة وكتابة تحت 60 ثانية من الكلام. تكلفة قبل الطيران: GET /v1/video/avatar-quote/?chars=500. كامل Python + Node + cURL snippets at /api/.

Sign up free: 30,000 tokens/day

إنشاء حساب مجاني

لا تلزم بطاقة ائتمان

كيف تقيّمون هذه الأداة؟

أحب Free.ai؟ أخبر أصدقائك!