47 نموذجًا متاحًا
توليد وتحرير صور بأحدث ما وصلت إليه التقنية — من فئة Gemini
نموذج الاستدلال Kling O1 بجودة سينمائية محسّنة
GPT Image 1.5 يولّد صورًا عالية الدقة مع التزام قوي بالمُوجّه، محافظًا على التكوين والإضاءة والتفاصيل الدقيقة
توليد وتحرير الصور بمستوى Gemini — إصدار Nano Banana 2 الكامل.
نموذج صور من الجيل الجديد — عرض نص شبه مثالي (>99%)، وواقعية فوتوغرافية محسّنة، وتفاصيل بمستوى واجهات المستخدم ولقطات الشاشة، ونص متعدد اللغات متفوّق (JP/KR/HI/BN). يدعم اختياريًا التوليد الموجَّه بصورة مرجعية.
تحرير دقيق لصورة واحدة مع الحفاظ على التفاصيل. مبني على بنية GPT-Image 2.0 متعددة الوسائط أصلًا.
تحرير وتحويل الصور بشكل متقدم
Reve 2.1 — مصمّم للالتزام بالمُوجّه وإخراج طباعة نصية نظيفة داخل الصورة. يولّد حتى أربع نسخ لكل طلب، بجميع الإطارات من المربّع إلى العريض، مع ثبات التخطيط وموضع النص عبر المجموعة. سعره متميّز، وهو أوضح مُصيّر للنصوص في الكتالوج.
نموذج NVIDIA الرائد لتحويل النص إلى صورة واقعية مع تحسين وكيلي اختياري — يولّد عدة صور مرشّحة في كل جولة ويعيد كتابة المُوجّه بين الجولات لالتزام أدق بالمُوجّه. واقعية فائقة مدركة للفيزياء، مع دعم توسيع المُوجّه بصيغة JSON منظّمة.
نموذج صور متميز للتحويل الدقيق من النص إلى صورة والتحرير بمراجع متعددة — صور المنتجات وأصول التصميم والتخطيطات الكثيفة والأعمال الإبداعية التجارية. يقبل وضع التحرير حتى 10 صور مرجعية.
تكبير دقيق للصور بتقنية Gigapixel من Topaz Labs — يكبّر الصور بأمانة حتى 4x مع إبقاء الحواف حادة والتفاصيل نظيفة.
مكبّر الصور التوليدي Wonder 3.5 من Topaz Labs — يستعيد التفاصيل ويعيد بناءها في الصور منخفضة الجودة أو التالفة مع التكبير حتى 4x.
GPT-Image 2.5 Flare — نموذج الصور الافتراضي من OpenAI الذي أُطلق مع ChatGPT Images 2.5. توليد سريع وعالي الجودة بإضاءة طبيعية، وقوام غني، وتخطيطات معقّدة، وخلفيات شفافة (PNG/WebP).
GPT-Image 2.5 Flare لتعديل الصور — صف التغيير المطلوب على صورة مصدر، مع ما يصل إلى ثلاث صور مرجعية إضافية. يدعم الإخراج الشفاف.
GPT-Image 2.5 Sunburst — نموذج الصور الدقيق من OpenAI للأعمال البصرية الراقية. دقة أعلى في التفاصيل المعقّدة مقابل وقت توليد أطول.
GPT-Image 2.5 Sunburst لتعديل الصور — تعديلات دقيقة تحافظ على التفاصيل انطلاقاً من تعليمات وصورة مصدر، مع ما يصل إلى ثلاث صور مرجعية.
يتبع نموذج Muse Image من Meta التعليمات بأمانة ويقدّم دقة بصرية استثنائية، مع عرض التفاصيل الدقيقة مثل النصوص والرسوم البيانية ورموز QR بدقة. يولّد صورًا من مُوجّهات نصية بتسع نسب أبعاد بسعر ثابت $0.01 للصورة.
نموذج Muse Image من Meta في وضع التحرير — تعديلات دقيقة تغيّر ما تطلبه فقط، وتحافظ على الاتساق عبر الخطوات، وتدمج عدة صور مرجعية. يقبل 1-10 صور مرجعية مقابل $0.01 لكل صورة ناتجة.
نموذج صور Wan 2.7 بمستوى جودة أعلى — يجمع بين التحويل من النص إلى صورة وتحرير الصور.
الإصدار V4 من Ideogram — أفضل عرض للنص داخل الصورة في فئته، وطباعة نصية أوضح، والتزام أقوى بالمُوجّه، وثلاث سرعات للمعالجة (TURBO / BALANCED / QUALITY). دعم أصلي لنسب أبعاد متعددة، دون حاجة إلى ضبط دقيق للملصقات والشعارات والصور المصغّرة والإعلانات.
قسّم الصورة إلى طبقات قابلة للتحرير — الخلفية والموضوع وكل عنصر بصري رئيسي كملف PNG شفاف مستقل. مبني على فهم الصور في Seedream 5.0 Pro، فتبقى البنية والتفاصيل سليمة بعد الفصل. يعتمد عدد الطبقات على الصورة.
Grok Imagine Image 2.0 من xAI — تحويل text-to-image سريع مع خيار 2K، ومفتاح جودة منخفضة/متوسطة، وثلاث عشرة نسبة أبعاد من العريضة جدًا إلى الطويلة جدًا. حتى أربع صور لكل طلب.
Grok Imagine Image 2.0 من xAI بسعر منخفض وثابت — طباعة نصية حادة واتباع دقيق للمُوجّه، بخمس نسب أبعاد. صورة واحدة لكل طلب، دون أدوات تحكم في الجودة أو الدقة.
Grok Imagine Image 2.0 من xAI في وضع التحرير — امنحه حتى ثلاث صور فيحرّرها أو يدمجها أو يعيد تصميم أسلوبها مع الحفاظ على الهوية والأسلوب. نفس مستويات 1K/2K والجودة المنخفضة/المتوسطة كما في المولّد، وحتى أربع نتائج لكل طلب.
نموذج القياس الافتراضي من Google. يدمج صورة شخص مع صورة قطعة ملابس في لقطة قياس واقعية.
مكبّر الصور الإبداعي Bloom 2 من Topaz Labs — يعيد ابتكار التفاصيل لتحسين لافت. الأفضل للصور المولّدة بالذكاء الاصطناعي التي تستحق لمسة نهائية متميزة.
Krea 2 Turbo — توليد text-to-image محسّن للسرعة مع كامل المدى الجمالي لـ Krea 2. توليد أفكار سريع مع توسيع المُوجّه وأوضاع تسريع.
نموذج MAI-Image-2.5 من Microsoft — توليد من النص إلى صورة للاستخدام العام بواقعية فوتوغرافية عالية والتزام بالمُوجّه وعرض دقيق للنص داخل الصورة. يدعم حتى 4 صور لكل طلب وسبع نسب أبعاد.
نسخة الصور من Grok Imagine. تحويل text-to-image إضافة إلى تحرير التنويعات image-to-image مع التزام قوي بالمُوجّه. النموذج الشقيق لـ Grok Imagine Video.
تكبير الصور بـ SeedVR2 — تكبير سريع وغير مكلف حتى 4x. قيمة ممتازة للتكبير اليومي.
نموذج صور Wan 2.7 — يجمع بين التحويل من النص إلى صورة وتحرير الصور.
نموذج صور خفيف بحجم 6B من Tongyi-MAI — مخرجات واقعية، وتوليد في أقل من ثانية، وعرض دقيق لافت للنصوص ثنائية اللغة (الإنجليزية + الصينية). مرخّص بموجب Apache-2.0.
نموذج صور Gemini سريع وموفّر للتكلفة — توليد أفكار سريع، وإنتاج بكميات كبيرة، وتحرير خفيف. مصمّم لاستكشاف المفاهيم وصور الشبكات الاجتماعية ومسودات المنتجات والإنتاج الواسع.
ترجم النص داخل الصورة إلى لغة أخرى واحصل على نسخة نظيفة ومُوطَّنة — مثالي لتوطين الملصقات وقوائم الطعام ولقطات الشاشة وصور المنتجات.
توليد صور قياسي من Nano Banana
تحرير الصور بواسطة Nano Banana
تحرير من صورة إلى صورة باستخدام FLUX 2 Pro
توليد سريع من النص إلى صورة باستخدام FLUX 2 Flex
Seedream 4.0 من النص إلى صورة
Seedream 4.5 من النص إلى صورة بجودة محسّنة
Seedream 5.0 Lite سريع من النص إلى صورة
توليد صور متعدد الوسائط من GPT-4o
توليد من النص إلى صورة بواسطة Qwen
توليد محسّن من النص إلى صورة من Qwen 2
تكبير الصور بالذكاء الاصطناعي من Topaz مع تحسين التفاصيل
إزالة الخلفية من Recraft AI
تكبير صور واضح من Recraft AI
55 نموذجًا متاحًا
Sora 2 بجودة محسّنة ومدد أطول
نموذج توليد فيديو من أحدث طراز بجودة وفهم استثنائيين
نموذج توليد فيديو متميز مع صوت أصلي
أحدث نموذج فيديو من ByteDance. يولّد حتى 30 ثانية في لقطة واحدة مع صوت متزامن — حوار وموسيقى ومؤثرات في المرور نفسه — انطلاقًا من مُوجّه أو إطار بداية أو حتى 50 مرجعًا من الصور والفيديو والصوت.
المستوى المتميز من Wan 3.0 من Alibaba — إنجاز أسرع وحركة سينمائية واستمرارية بصرية أقوى. أوضاع النص والصورة والمرجع، ومقاطع أصلية بطول 30 ثانية في تمريرة واحدة، مع صوت.
MiniMax H3 بعد تدريب إضافي، ويحتل المركز #1 في الجودة الإجمالية وفهم المُوجّه والجماليات مقارنةً بأبرز نماذج الفيديو. مقاطع من 5-15 ثانية بدقة أصلية 480p أو 768p أو 1080p انطلاقًا من مُوجّه أو إطار بداية أو حتى 9 صور مرجعية و3 مقاطع حركة و3 مقاطع صوتية. توليد الفيديو من المراجع متاح الآن للجميع: أسرع بما يصل إلى مرتين، مع حفاظ أقوى بكثير على الشخصيات.
MiniMax H3 Max with a built-in camera rig. Your still frame stays frozen while the camera flies a path you choose — orbit around a subject, push in, crane overhead, or set up to 12 poses by hand. 5-15 second clips in native 480p, 768p or 1080p.
أحدث نموذج رائد من Kling بأفضل حركة في فئته وجودة سينمائية
أحدث نموذج فيديو من Alibaba. مقاطع أصلية بطول 30 ثانية في تمريرة واحدة — دون تجميع — مع صوت وحركة بمستوى الواقع، انطلاقاً من مُوجّه أو إطار بداية أو مراجع صورة وفيديو وصوت.
MiniMax H3 (Hailuo-03) مع دعم LoRA لتحويل image-to-video. حرّك الصور بنماذج LoRA مخصّصة عبر أربعة مستويات من الدقة (480p/720p/1080p/2K)، من 4-15 ثانية، مع صوت ستيريو أصلي. جودة أعلى من H3 الأساسي.
نموذج الفيديو متعدد الوسائط من الجيل التالي من MiniMax (Hailuo-03). يولّد فيديو حتى 2K مع صوت ستيريو أصلي انطلاقًا من مُوجّه نصي أو صورة مرجعية، مع اتباع قوي للتعليمات وحركة سلسة ونص واضح على الشاشة.
نموذج الفيديو من Google الذي يقبل أي مُدخل. أنشئ مقاطع من 4-10 ثوانٍ بصوت أصلي انطلاقًا من مُوجّه أو صورة أو ثلاث صور مرجعية أو فيديو موجود — ثم أعد تشكيل المشاهد بلغة عادية. يعتمد على معرفة Gemini بالعالم الحقيقي لفيزياء وحركة متسقة.
نموذج الفيديو Omni من Google بالإصدار v1.1 — الآن مع التحكم في الدقة (360p/720p/1080p/4K) وتحرير الفيديو. أنشئ أو حوّل مقاطع من 3-10 ثوانٍ بصوت أصلي انطلاقًا من نص أو صورة أو مراجع أو فيديو موجود. ترقية عن v1 بمرونة كاملة في الدقة.
MiniMax H3 Max on a faster inference stack at half the price. The same post-trained model tuned for prompt adherence and aesthetics — 5-15 second clips from a prompt or a start frame, in native 480p, 768p or 1080p.
أحدث إصدار من Kling بأفضل حركة وجودة في فئته
Grok Imagine Video 1.5 — تحويل image-to-video مع صوت متزامن، والتزام قوي بالمُوجّه، وجودة بصرية ثابتة. يحتل حاليًا المركز #1 في لوحة اختبارات Arena العمياء لفئة image-to-video، متفوقًا على Seedance 2.
نسخة أسرع وأكثر توفيراً من Veo 3.1
FLUX 3 من Black Forest Labs — تحويل النص إلى فيديو مع صوت متزامن يولّده النموذج نفسه. حتى 20 ثانية بدقة 1080p، دون الحاجة إلى صورة مرجعية.
Kling 2.0 بجودة وحركة محسّنتين بشكل ملحوظ
Wan 2.7 — من النص إلى فيديو ومن صورة إلى فيديو (الإطار الأول / الإطار الأول والأخير / المتابعة).
مكبّر الفيديو الإبداعي Astra 2 من Topaz Labs — يعيد تخيّل التفاصيل الدقيقة ويقدّم عادةً مخرجات 4K. مقاطع حتى 5 دقائق.
تحويل احترافي من SDR إلى HDR عبر Hyperion 2.5 من Topaz Labs — يعيد توزيع السطوع واللون مع الحفاظ على تفاصيل النصوص والوجوه والحركة.
توليد فيديو عالي الجودة
الإصدار الأحدث Runway Gen 4.5 — من النص إلى فيديو مع صورة مرجعية اختيارية، 5/10s.
Seedance 2.0 — من النص إلى فيديو ومن صورة إلى فيديو.
رفع دقة الفيديو حتى 4K بواسطة FLUX 3 من Black Forest Labs، مع وضع Precise الأمين للمصدر ووضع Creative لتعزيز التفاصيل. مقاطع حتى 20 ثانية.
مكبّر الفيديو التوليدي الاحترافي Starlight من Topaz Labs (Starlight Precise 2.6) — يعيد بناء تفاصيل غير موجودة في المصدر، حتى 4K.
توليد فيديو سينمائي
مزامنة شفاه احترافية
نقل الحركة من صورة مرجعية + فيديو مرجعي. اختر وضعية أي شخصية تقود النتيجة عبر مفتاح اتجاه الشخصية.
Kling 3.0 محسّن للسرعة — توليد أسرع بجودة بصرية عالية. text-to-video (مُوجّهات حتى 2,500 حرف)، وimage-to-video من الإطار الأول، ولوحة قصصية متعددة اللقطات (حتى 6 لقطات موجّهة في مقطع واحد). فئة Standard بدقة 720p وفئة Pro بدقة 1080p.
Runway Gen-4 Turbo video generation from text or a reference image. 5 or 10 seconds; 1080p supports 5 seconds.
أحدث إصدار من Kling 1.x بجودة محسّنة
توليد فيديو عالي الجودة من Luma AI
نموذج فيديو قصير سينمائي مُحدَّث — حركة أكثر سلاسة، واتباع أقوى للتعليمات، وسلوك صوتي أصلي، ومزامنة شفاه متعددة اللغات. text-to-video، وimage-to-video من الإطار الأول، وفيديو من صور مرجعية (حتى 9 صور مرجعية).
توليد فيديو عالي الجودة بحركة قوية
مزامنة شفاه من فيديو إلى فيديو — تطابق حركة الفم في فيديو موجود مع الصوت المستهدف. تدعم الدبلجة متعددة اللغات.
إزالة خلفية الفيديو المرخّصة بجودة المؤسسات من Bria مع تصحيح انعكاس الشاشة الخضراء. أزل الخلفيات من مقاطع الفيديو بنظافة، مع تصحيح انسكاب اللون الأخضر لنتائج فصل احترافية.
نموذج فيديو قصير سينمائي — حركة متفوقة، وإضاءة بمستوى السينما، والتزام قوي بالمُوجّه، وسرد بلقطات متعددة. نقطة نهاية واحدة لـ text-to-video + image-to-video.
كبّر الفيديو وحسّن حدّته إلى دقة أعلى. اختر معامل تكبير من 1x إلى 8x (الافتراضي 2x).
أحدث نموذج لتوليد الفيديو من Pika
توليد فيديو سريع من الصور
أزل الخلفية من الفيديو واحصل على قصاصة نظيفة للموضوع جاهزة للدمج في أي مشهد. تمرير الصوت ولون الخلفية اختياريان.
نموذج مزامنة شفاه في الفضاء الكامن
نموذج فيديو سريع واقتصادي — من النص إلى فيديو ومن صورة إلى فيديو (الإطار الأول أو الأخير أو مرجع) مع صوت متزامن اختياري. مثالي للمسودات السريعة ومقاطع التواصل الاجتماعي بكميات كبيرة.
ترجم الفيديوهات القصيرة — ينسخ الكلام نصياً ويولّد صوتاً مدبلجاً وترجمات باللغة المستهدفة. حتى 6 دقائق لكل مقطع.
أنشئ فيديو قابلاً للمشاركة لمقطع صوتي، مع اعتمادات اختيارية للفنان والموقع.
نسخة أسرع وأرخص من Seedance 2.0 — من النص إلى فيديو ومن صورة إلى فيديو.
نموذج توليد فيديو من فئة Standard
Veo 3.1 Lite — توليد فيديو اقتصادي بأوضاع من النص إلى فيديو ومن صورة إلى فيديو ومن مرجع إلى فيديو
توليد فيديو عالي الجودة باستخدام MiniMax Hailuo 2.3 Pro
توليد فيديو باستخدام MiniMax Hailuo 2.3 Standard
توليد فيديو باستخدام MiniMax Hailuo 02 Pro
Wan 2.6 Flash سريع من صورة إلى فيديو
تكبير الفيديو بالذكاء الاصطناعي من Topaz
13 نموذجًا متاحًا
تحويل نص إلى كلام متعدد اللغات بجودة عالية
نموذج متميّز لتحويل النص إلى كلام
توليد الموسيقى بالذكاء الاصطناعي — أنشئ أغاني ومقطوعات موسيقية وموسيقى تصويرية
تحويل نص إلى كلام سريع بجودة جيدة
نموذج تحويل النص إلى كلام
تحويل نص إلى كلام بجودة عالية
Google DeepMind's latest music generation model. Generate almost any type of music from text descriptions, with optional image inspiration.
تحويل النص إلى كلام مع Gemini 3.1 Flash. 30 صوتًا جاهزًا، أكثر من 80 لغة، وسوم تعبيرية داخل النص ([sigh]، [laughing])، تعليمات أسلوب حتى 4K حرف، ودعم تعدد المتحدثين.
افصل المقطع الصوتي إلى مسارَي الغناء والموسيقى، أو إلى اثني عشر مساراً منفصلاً للآلات.
أكمل مقطعًا موجودًا من أي نقطة مع الحفاظ على أسلوبه.
غنِّ فوق موسيقى تقوم برفعها.
أنشئ موسيقى مصاحبة أسفل الأصوات التي ترفعها.
إعادة توليد نطاق زمني واحد من المقطع مع ترك الباقي دون تغيير.
3 نماذج متاحة
يعيد بناء شبكة ثلاثية الأبعاد من أربع زوايا كحدّ أقصى للجسم نفسه. يحلّ الجوانب التي لا تظهر في صورة واحدة. يصدّر GLB وFBX وOBJ وUSDZ وSTL.
حوّل صورة واحدة إلى شبكة ثلاثية الأبعاد مكسوّة. تحكّم في البنية الشبكية وعدد المضلعات، مع خرائط PBR وتركيب هيكل تلقائي اختياريين. يصدّر GLB وFBX وOBJ وUSDZ وSTL.
توليد شبكة ثلاثية الأبعاد مكسوّة بالخامات من وصف نصي. طوبولوجيا وعدد مضلعات قابلان للتحكم، مع خرائط PBR وتجهيز هيكل تلقائي اختياريين. يصدّر GLB وFBX وOBJ وUSDZ وSTL.