كيف تكتب برومبت لـ GPT-Image-2

دليل عملي لبرومبتات GPT-Image-2: صيغة البرومبت، كيف تشير إلى الصور المرفقة عبر ‎@image1، كيف تحصل على نص عربي واضح داخل الصورة، وما الذي يرفضه الفلتر.

يقرأ GPT-Image-2 البرومبت حرفياً، لذلك تكتب له بتسمية الأشياء لا بالتلميح إليها: الموضوع، وما يفعله، والإضاءة، والتأطير، والكلمات الدقيقة التي تريد طباعتها داخل الصورة. اختره من قائمة النماذج في بوتنا، ثم اكتب رسالة واحدة تذكر فيها كل ذلك. كل ما تتركه دون ذكر يملأه النموذج من عنده، وهذا وحده سبب عودة معظم المحاولات الأولى وكأنها فكرة شخص آخر.

صيغة البرومبت لـ GPT-Image-2

ستة عناصر تغطي أي برومبت تقريباً: الموضوع، والفعل، والمكان، والإضاءة والعدسة، والتأطير، والأسلوب. اكتبها بهذا الترتيب وبجمل عادية:

A cream colored A3 poster taped by its four corners to a weathered wooden wall, warm side light from the left, shot straight on, the poster reads “FRESH BREW” in bold black letters with a smaller line under it reading “2 FOR 1 UNTIL FRIDAY”, with an illustrated latte cup below the text

الموضوع هو الشيء الوحيد الذي تدور حوله الصورة: اسم مع صفتين أو ثلاث، لا فئة عامة. الفعل هو ما يجري الآن، وهو ما يمنع البورتريه من أن يبدو كصورة هوية. المكان يضع الموضوع في موقع محدد ويحمل معه الإكسسوارات: جدار خشبي وشريط لاصق يُقرآن بشكل مختلف تماماً عن إطار في معرض.

الإضاءة والعدسة تؤديان معظم العمل البصري: ضوء جانبي دافئ، نهار غائم، مصباح واحد قاسٍ، عدسة 35 مم واسعة، عدسة 85 مم للبورتريه بعمق ميدان ضحل. يطبّقها GPT-Image-2 حرفياً بدل أن يمزجها في أسلوب موحّد خاص به. التأطير يحدد لقطة قريبة أو نصفية أو عامة، إضافة إلى زاوية الكاميرا. الأسلوب يختم البرومبت: واقعي فوتوغرافياً، تحريري، رسم مسطّح، رندر ثلاثي الأبعاد.

الحرفية سلاح ذو حدّين، ولهذا تؤتي هذه الصيغة ثمارها هنا أسرع من أي مكان آخر. لن يخترع النموذج أجواءً ليغطي برومبتاً غامضاً، ولن يُسقِط بهدوء تعليمة غريبة أيضاً. أضف عنصراً، وسترى هذا العنصر في التوليد التالي.

الملصقان أسفل الصفحة هما الفكرة نفسها، نُفِّذت مرتين. الأول جاء من سطر واحد، “a poster about a coffee sale”، فكتب النموذج نصه بنفسه: عنوان واسم علامة وخصم وتاريخ انتهاء، ولم يُطلب أي منها. والثاني يسمّي الصياغة الدقيقة والسطح والإضاءة. تسمية الكلمات هي ما يضع كلماتك أنت في الصورة بدل كلمات النموذج.

إرفاق الصور: @image1 و@image2

للتعديل، أرسل حتى 4 صور في رسالة واحدة واكتب التعليمات كتعليق على الرسالة نفسها. الصور في رسالة والنص في الرسالة التالية هما رسالتان منفصلتان، ولن يقترنا. يشرح الدليل خطوة بخطوة قاعدة الرسالة الواحدة بالكامل.

عندما تُرفق عدة صور، خاطبها بالأرقام. يتبع GPT-Image-2 هذه الإشارات بدقة، وهذا ما يجعله المتخصص في التعديل:

Put the face from @image1 onto the person in @image2, keep the hairstyle and the jacket from @image2 unchanged, match the skin tone to @image1, studio light, waist up

قل ما يجب الحفاظ عليه بنفس وضوح ما يجب تغييره. “Keep the background unchanged” و”do not alter the pose” تعليمات يتبعها النموذج فعلاً، وبدونها يعيد التعديل رسم جزء من الكادر أكبر مما أردت. احذف الأرقام، وسيقرر النموذج بنفسه أي مرجع لأي غرض.

أين يتفوق GPT-Image-2 وأين يخذلك

نقاط القوةنقاط الضعف
نص واضح داخل الصورةفقرات نصية طويلة
تعديلات على صورك المرفقةلا خيار فائق العرض 21:9، وهو متاح في البوت لدى Seedream وحده
اتباع تعليمات حرفية متعددة الأجزاءالبرومبتات الإيحائية الفضفاضة من سطر واحد
صور المنتجات واللافتات والملصقات والتغليفكل ما يرصده الفلتر الصارم
تجريب رخيص برصيد واحد لصورة 1Kالرسم المنمّق بشدة والفن التصويري

للفن المنمّق ابدأ من Seedream، ولأقصى جودة في مشهد معقّد استخدم NanoBanana Pro.

كيف تضبط النص داخل الصورة

النص هو سبب اختيار معظم الناس لهذا النموذج، فاقرأ هذا القسم مرتين.

اكتب الصياغة الدقيقة بين علامتي اقتباس. كل ما تعيد صياغته بكلماتك يعيد النموذج كتابته. “A sign that mentions the opening hours” يعطيك ساعات عمل مخترَعة، بينما the sign reads "OPEN 8 TO 6" يعطيك هذه الكلمات بالذات.

سمِّ السطح المطبوع عليه النص: ملصق مثبّت على جدار، كوب قهوة ورقي، مظلة محل، غلاف كتاب، شاشة هاتف. السطح يحدد الخط والمنظور وكيفية توزّع الحروف، والنموذج يتعامل مع الثلاثة بشكل أفضل حين يعرف على ماذا يكتب.

حدّد اللغة حين لا تكون الإنجليزية، مثلاً Arabic text reading "مفتوح". هذه النقطة مهمة بالعربية تحديداً: بدون تحديدها تنزلق البرومبتات مختلطة الحروف إلى الإنجليزية والحروف اللاتينية. وحتى مع تحديدها، توقّع أن يأتي الخط العربي مفكّك الوصلات، أو الحروف منفصلة بدل أن تتصل، أو ترتيب الكلمات معكوساً. أبقِ النص كلمة أو كلمتين، والصقه بين علامتي اقتباس كما تريده حرفاً بحرف، وأعد التوليد بدل إطالة النص إذا عاد مكسوراً.

أبقِه قصيراً. عنوان واحد مع سطر مساعد واحد على الأكثر هو السقف الموثوق. تنخفض الموثوقية بحدّة متى تجاوز النص طول عنوان قصير، وفقرة كاملة من النص لن تخرج نظيفة على أي نموذج متاح اليوم.

حين يعود سطر مشوّهاً، أعد تشغيل البرومبت نفسه بدل إضافة كلمات. يتغير رسم الحروف بين تشغيل وآخر، وبرصيد واحد لصورة 1K تكون المحاولة الثانية أرخص من إعادة الكتابة. وإذا فشلت محاولتان، اختصر النص.

هذه أوضح فجوة في المجموعة: ينجح GPT-Image-2 في النصوص القصيرة التي يميل NanoBanana 2 إلى خلطها. وإن كنت تحتاج نصاً مع مظهر أقرب إلى الرسم، راجع دليل NanoBanana لتعرف إلى أي حد يمكن دفع ذلك النموذج.

ما الذي يرفضه الفلتر

يمتلك GPT-Image-2 أشد فلتر محتوى بين نماذج البوت. أربعة أشياء تفسّر تقريباً كل حالات الرفض: أشخاص حقيقيون بأسمائهم، وعلامات وشعارات تجارية، والعنف، والمحتوى الصريح. الرفض يأتي كـ”لا” صريحة لا كصورة أضعف، لذلك يكون الإصلاح دائماً في البرومبت.

أعد الصياغة بوصف النوع بدل تسمية الحالة بعينها:

بدل “Keanu Reeves in a black suit on a rainy street” اكتب “a man in his fifties with long dark hair and a beard, black suit, rainy neon lit street at night, cinematic”.

وبدل “a can of Coca-Cola on a table” اكتب “a red aluminium soda can with an unbranded white script logo, on a wooden table, studio light”.

كلاهما يحافظ على الفكرة ويمرّ. فلتر Seedream أكثر تساهلاً، ويشرح دليل Seedream أين يتفوق ذلك النموذج فعلاً، وهو أساساً العمل المنمّق وفائق العرض. القواعد نفسها تسري هناك أيضاً، فالبرومبت الذي يُرفض لمبدئه لا لصياغته لن ينفع نقله إلى نموذج آخر.

مشكلات شائعة وحلولها

العَرَضما تغيّره في البرومبت
الحروف تعود مشوّهةاختصر النص، ضعه بين علامتي اقتباس، سمِّ السطح، ثم أعد التوليد بدل إعادة الكتابة
النموذج كتب عنوانه بنفسهأعطِ الصياغة الدقيقة بين علامتي اقتباس بدل وصف معنى العبارة
عُدّلت الصورة المرفقة الخطأرقّم مراجعك، @image1 و@image2، وقل أيها المصدر وأيها الهدف
تعليمة واحدة جرى تجاهلهااقسم الجملة إلى اثنتين، وضع التعليمة في عبارة مستقلة، وحدّد ما يجب أن يبقى كما هو
النتيجة تبدو مسطّحة وبلا شخصيةأضف الإضاءة والعدسة: الاتجاه والطابع والبعد البؤري وعمق الميدان
التعديل غيّر أكثر مما طلبتأضف “keep everything else unchanged” وسمِّ الأجزاء التي يجب الحفاظ عليها

برومبتات جاهزة

أسرع طريقة لتعلّم نموذج هي تشغيل برومبت يعمل بالفعل، ثم تغيير عنصر واحد في كل مرة. تحتوي مكتبة برومبتات GPT-Image-2 على برومبتات جاهزة للّصق مع الصور التي أنتجتها، وتسرد صفحة النموذج الدقّات ونسب الأبعاد وتكلفة الرصيد.

افتح بوتنا، اختر GPT-Image-2، والصق أحدها.

فكرة واحدة، برومبتان

البرومبت: 'a poster about a coffee sale'. مولّدة بـ GPT-Image-2.
الفكرة نفسها مع تحديد الصياغة الدقيقة والسطح والإضاءة. مولّدة بـ GPT-Image-2.

الأسئلة الشائعة

كيف أحصل على نص واضح داخل الصورة؟

اكتب الصياغة الدقيقة بين علامتي اقتباس، وحدّد السطح المكتوبة عليه (لافتة، ملصق، عبوة، بطاقة)، وأبقِها قصيرة. عنوان واحد مع سطر قصير أكثر موثوقية بكثير من فقرة كاملة. GPT-Image-2 هو الأقوى في البوت لهذه المهمة.

كيف أخبر النموذج أي صورة مرفقة يستخدم؟

أرسل حتى 4 صور في رسالة واحدة مع تعليماتك كتعليق عليها، ثم أشر إليها بالأرقام داخل البرومبت: خذ الوجه من ‎@image1 والسترة من ‎@image2.‎ بدون الأرقام يقرر النموذج بنفسه أي مرجع لأي غرض.

لماذا رفض GPT-Image-2 برومبتي؟

فلتر المحتوى لديه من أشد الفلاتر في البوت. الأسباب المعتادة هي أشخاص حقيقيون بأسمائهم، وشعارات العلامات التجارية، والعنف، والمحتوى الصريح. صف نوع الشخص أو المنتج بدل تسمية شخص أو علامة بعينها، وغالباً تمرّ الفكرة نفسها.

كم تكلّف صورة GPT-Image-2؟

1K برصيد واحد، و2K برصيدين، و4K بثلاثة أرصدة، وهي الفئة الأرخص في البوت، ما يجعلها النموذج الطبيعي لتجربة البرومبت وتحسينه. الرصيد لا تنتهي صلاحيته.

zosee منتج مستقل. غير مرتبط بـ Telegram أو Google أو ByteDance أو OpenAI أو Midjourney ولا معتمد أو مموّل منها. أسماء النماذج علامات تجارية تخص أصحابها.

جرّب مجاناً في Telegram

اشترك في قناة البرومبتات @zosee_channel واحصل على 5 أرصدة مجانية، تكفي حتى 5 صور. الرصيد لا تنتهي صلاحيته.