صف الفيديو في محادثة تيليجرام، واستلم صورة مصغّرة ليوتيوب بنسبة 16:9، بعنوان عريض ووجه معبّر وألوان تبرز في الصفحة الرئيسية. البوت مولّد صور مصغّرة بالذكاء الاصطناعي يعمل كأي محادثة عادية: تكتب ما يجب أن تُظهره الصورة المصغّرة وما يجب أن تقوله، فيرد بالصورة خلال دقيقة تقريباً. أول 5 أرصدة مجانية، ولا شيء لتثبيته.
صانع ثمبنيل بالذكاء الاصطناعي يعيش داخل محادثة
أغلب أدوات الصور المصغّرة محرّرات قوالب: تسحب صورة جاهزة إلى لوحة، وتكتب عنواناً، ثم تعبث بالحدود والظلال. هنا تتخطّى اللوحة. تكتب رسالة واحدة تقول ما تُظهره الصورة المصغّرة، وما يقوله العنوان، والإحساس الذي يجب أن تعطيه، فتعود الصورة كاملة جاهزة، والنص معها.
وهذا يغطّي الصور المصغّرة التي يحتاجها الناس فعلاً:
- صور مصغّرة بردّة فعل، وجه كبير معبّر بجانب الشيء الذي يدور حوله الفيديو.
- صور مصغّرة يقودها العنوان، حيث تحمل ثلاث أو أربع كلمات ضخمة النقرة كلها.
- وجهك أنت، مرفقاً كصورة، لتبدو كل صورة مصغّرة في القناة كأنها أنت.
- نسخ سريعة، الفكرة نفسها في نسختين أو ثلاث لتختبر أيها يحصد نقرات أكثر.
البوت لا يرتبط بـ YouTube أو Google. هو يصنع الصورة، وأنت ترفعها إلى الفيديو بنفسك.
كيف تصنع صورة مصغّرة ليوتيوب في تيليجرام
- افتح البوت في تيليجرام واضغط Start.
- احصل على 5 أرصدة مجانية. اشترك في @zosee_channel، ثم عد إلى البوت واضغط زر المطالبة. الاشتراك وحده لا يمنح شيئاً، والضغطة هي ما يحرّر الرصيد. راجع صفحة الرصيد المجاني.
- اختر GPT-Image-2 من قائمة النماذج، ونسبة 16:9.
- أرسل البرومبت في رسالة عادية، مع نص العنوان بين علامتي تنصيص. تصلك الصورة المصغّرة في المحادثة.
إن كان شيء ما ليس في مكانه، فرد على النتيجة بالتصحيح، مثل “make the text bigger” أو “change the background to green”، فيعدّل البوت مخرجاته نفسها بدل البدء من الصفر.
برومبتات صور مصغّرة للّصق
هذه هي البرومبتات التي صُنع بها المثالان في هذه الصفحة، دون أي تغيير.
فيديو طبخ (الرامن):
YouTube thumbnail for a cooking video, 16:9. On the left, a close-up of a surprised young chef with wide eyes and an open-mouth smile, holding a wooden spoon, warm kitchen light. On the right, a steaming bowl of glossy red ramen with a soft-boiled egg. Huge bold white title text with a thick black outline reading “10 MINUTE RAMEN” across the top right. Bright saturated colors, high contrast, clean uncluttered background, readable at small size.
مراجعة تقنية (الهاتف):
YouTube thumbnail for a tech review video, 16:9. On the right, a man in his thirties with short dark hair and a skeptical raised eyebrow, looking straight at the camera, lit by a cyan rim light. On the left, a sleek unbranded black smartphone floating at an angle with a glowing screen. Huge bold yellow title text with a thick black outline reading “WORTH IT?” on the left. Dark blue gradient background, high contrast, simple composition, readable at small size.
الترتيب واحد في الاثنين: نوع الفيديو، ثم من في الإطار وبأي تعبير، ثم الشيء الوحيد الذي يدور حوله الفيديو، ثم العنوان بين علامتي تنصيص مع لونه وحدوده، ثم المظهر العام. بدّل الموضوع والعنوان وأبقِ الباقي، فتبدأ صورك المصغّرة في الظهور كأنها قناة واحدة.
صور مصغّرة بوجهك أنت
الصورة المصغّرة التي تحمل وجه صانع المحتوى تتفوّق عادة على صورة تحمل وجه غريب، لأن المشاهدين يتعلّمون التعرّف إليك. أرفق صورة حادة ومضاءة جيداً لك، وضع البرومبت في تعليق الرسالة نفسها. صورة مرسلة بمفردها، أو برومبت في رسالة ثانية، لن يقترنا.
YouTube thumbnail, 16:9, built around the person in the attached photo with a shocked expression, on the left. On the right, a stack of cash. Huge bold yellow title text with a thick black outline reading “I WAS WRONG”. High contrast, clean background, readable at small size. Keep the face from the attached photo unchanged.
التعبير تحت إدارتك: “shocked” أو “laughing” أو “skeptical, one eyebrow raised”، كما تشاء. وفي صفحة مولّد الأفاتار بالذكاء الاصطناعي مزيد عن الحفاظ على الوجه سليماً خلال التعديل.
أي نموذج تختار للصور المصغّرة
النص داخل الصورة هو المهمة كلها هنا، فالاختيار يدور أساساً حول الكتابة:
- GPT-Image-2 هو ما تبدأ به. يرسم العناوين القصيرة بدقة، ويتبع التخطيط الذي تصفه حرفياً، وهو الأرخص: رصيد واحد بدقة 1K، ورصيدان بدقة 2K، و3 أرصدة بدقة 4K. المثالان أعلاه صُنعا به.
- Qwen3 هو المتخصص الآخر في الكتابة، وهو ما تستخدمه حين يكون البرومبت طويلاً ومفصّلاً ويجب أن يتحقّق كل جزء منه. رصيدان بدقة 1K أو 2K، وQwen3 Pro من 4 إلى 6 أرصدة.
- NanoBanana Pro لمشهد مزدحم وواقعي فوتوغرافياً يجب أن يكون بلا عيب، من 4 إلى 5 أرصدة.
- NanoBanana 2 يتعامل بنظافة مع كلمة واحدة قصيرة، وهو نموذج متعدّد الاستخدامات جيد من رصيدين إلى 4 أرصدة.
الأربعة كلها توفّر نسبة 16:9.
كم يكلّف
من رصيد واحد إلى 6 أرصدة للصورة المصغّرة حسب النموذج والدقة، والرصيد لا تنتهي صلاحيته. تكلّف صورة مصغّرة من GPT-Image-2 بدقة 1K رصيداً واحداً، فاختبار ثلاث نسخ لفيديو واحد يكلّف 3 أرصدة. والدفع عبر Telegram Stars أو العملات الرقمية أو بطاقة بنكية من أي دولة ($) أو بطاقة بنكية روسية (₽). تجد الباقات في صفحة الأسعار.
نصائح لصور مصغّرة تحصد النقرات
- اجعل العنوان من 3 إلى 5 كلمات. الصورة المصغّرة تُرى بحجم صورة مصغّرة. الجملة الطويلة تتحوّل إلى ضجيج رمادي، والعناوين القصيرة هي أيضاً ما يكتبه النموذج صحيحاً في كل مرة.
- ضع النص الدقيق بين علامتي تنصيص. اكتب
reading "10 MINUTE RAMEN"لا “a title about quick ramen” في البرومبت. النموذج ينسخ النص الموضوع بين علامتي تنصيص، ويخترع النص غير المحدّد. - وجه واحد محوري. شخص واحد، تعبير واحد واضح، ينظر إلى الكاميرا. الوجهان يتنافسان، والحشد لا يُقرأ إطلاقاً بالحجم الصغير.
- اطلب التباين. نص ساطع بحدود داكنة سميكة على خلفية بسيطة، واكتب “high contrast” صراحة في البرومبت. الخلفيات المزدحمة تبتلع العنوان.
- افحصها صغيرة. انظر إلى النتيجة مصغّرة على هاتفك قبل رفعها. إن لم تستطع قراءة العنوان بنظرة واحدة، فرد بعبارة “make the text bigger and the background simpler” على النتيجة.
- اقرأ النص قبل النشر. افحص كل حرف. إن خرجت كلمة خاطئة، فرد بالتهجئة الصحيحة بين علامتي تنصيص فيصلحها البوت.
لمزيد عن ضبط النص داخل الصورة، راجع كيف تكتب برومبت لـ GPT-Image-2 وكيف تكتب برومبت لـ Qwen3.
ذات صلة
- كيف تكتب برومبت لـ GPT-Image-2، الدليل الكامل للنموذج الذي صُنعت به هذه الأمثلة.
- مولّد الأفاتار بالذكاء الاصطناعي، لصورة شخصية للقناة مصنوعة من صورتك أنت.
- تعديل الصور بالذكاء الاصطناعي، لإصلاح لقطة شاشة أو صورة قبل أن تدخل الصورة المصغّرة.
- تغيير خلفية الصورة، لتخرج نفسك من غرفة فوضوية.
- كيف تستخدم البوت، الشرح الكامل من Start حتى أول صورة لك.
- مولّد أفاتار قناة تيليجرام، لصورة قناة أو مجموعة أو بوت تصمد أمام القصّ الدائري.
- صور تيك توك بالذكاء الاصطناعي، لعروض الصور العمودية بنسبة 9:16 والأغلفة وتعديلات الترندات.
- مولّد صور إنستجرام، لمنشورات وستوري جمالية من سيلفي واحدة.