Nano Banana 2.1 يصل بتحسينات كبيرة لتوليد الصور وتحريرها

أطلقت جوجل Nano Banana 2.1 كتحديث جديد لنموذجها المخصص لإنشاء الصور وتحريرها بالذكاء الاصطناعي، مع تركيز واضح على المشكلات التي تظهر بعد الاستخدام المتكرر أكثر من مجرد تحسين الصورة الأولى. الإصدار الجديد يقدم جودة بصرية أعلى، وثباتًا أفضل للشخصيات والعناصر بين التعديلات، وتحسينات في معالجة النصوص والتصميم، إلى جانب قدرات أقوى عند العمل على صور مرجعية متعددة.
الإجابة السريعة
Nano Banana 2.1 هو أحدث إصدار مستقر من عائلة نماذج الصور لدى Google، ويحمل في Gemini API المعرّف gemini-nano-banana-2.1. أبرز التحسينات تشمل جودة وواقعية أعلى، دقة أفضل في تنفيذ التعليمات، ثبات الشخصية خلال التعديلات المتتابعة، معالجة أفضل للنصوص والتصميمات، ودعم الصور بدقة تصل إلى 4K.
ما الجديد في Nano Banana 2.1؟
جوجل تصف الإصدار الجديد بأنه تحديث يرفع مستوى الأداء مقارنة بالنماذج السابقة في أكثر من جانب، وليس مجرد تعديل صغير على السرعة. من أبرز المناطق التي ركزت عليها الشركة التصميم البصري، والتحرير الموجه لأجزاء محددة من الصورة، والحفاظ على هوية الشخص أو العنصر عند تنفيذ سلسلة من التعديلات، وهي نقاط مهمة جدًا في الاستخدام الاحترافي لأن جودة الصورة وحدها لا تكفي إذا تغير الوجه أو الملابس أو تكوين المشهد مع كل Prompt جديد.
كما يأتي Nano Banana 2.1 بتحسينات في الواقعية وجودة التفاصيل عند دقات 1K و2K و4K، مع معالجة مشكلات ظهرت سابقًا في الصور شديدة العرض أو الطول. وتوضح وثائق Google أن النموذج الجديد أصلح أيضًا بعض مشكلات التكرار أو التقطيع في نسب الأبعاد البانورامية عند استخدام الدقات الأعلى.
| الميزة | Nano Banana 2.1 |
|---|---|
| الدقة | 1K و2K و4K |
| جودة التصميم | تحسين واضح في التكوين والواقعية |
| ثبات الشخصيات | أفضل خلال التعديلات المتتابعة |
| النص داخل الصور | تحسين في الدقة وتوزيع العناصر |
| الصور المرجعية | حتى 14 صورة في عملية الدمج |
| البحث | يدعم Grounding عبر Google Web وImage Search |
ثبات الشخصية أصبح نقطة أساسية
واحدة من أكثر مشكلات أدوات الصور التوليدية إزعاجًا تظهر عندما تنشئ شخصية ناجحة ثم تطلب تعديلًا بسيطًا في الملابس أو الخلفية، فتجد أن ملامح الوجه نفسها تغيرت. Nano Banana 2.1 يستهدف هذه المشكلة مباشرة، حيث تشير Google إلى تحسين Multi-turn character consistency، أي الحفاظ على الشخصية نفسها خلال عدة جولات من التحرير داخل المحادثة.
وهذا يجعل التحديث أكثر أهمية لمن يعملون على حملات دعائية أو قصص مصورة أو صور منتجات أو شخصيات متكررة. بدل إعادة بناء الوصف كاملًا في كل مرة، يفترض أن يصبح من الأسهل الاحتفاظ بالهوية البصرية نفسها مع تغيير عنصر محدد فقط في المشهد.
حتى 14 صورة مرجعية في عملية واحدة
يوسع Nano Banana 2.1 أيضًا قدرات العمل مع الصور المرجعية. وفق وثائق Gemini API يستطيع النموذج دمج ما يصل إلى 14 صورة مرجعية، مع الحفاظ على ثبات ما يصل إلى أربع شخصيات، بالإضافة إلى دقة التعامل مع ما يصل إلى عشرة عناصر أو أجسام مرجعية مختلفة.
هذه القدرة مهمة عندما تكون المهمة أكثر تعقيدًا من مجرد صورة شخص واحد. يمكن مثلًا العمل على مشهد يحتوي عدة أشخاص ومنتجات وعناصر تصميمية، مع تقديم مراجع بصرية منفصلة لكل منها، ثم مطالبة النموذج بإنتاج مشهد جديد يحافظ قدر الإمكان على خصائص العناصر الأصلية.
- تحسين جودة الصور وواقعيتها في الدقات المختلفة.
- ثبات أفضل للشخصيات والعناصر عبر أكثر من تعديل.
- تحسين دقة النصوص والإنفوجرافيك داخل الصورة.
- دعم حتى 14 صورة مرجعية في عمليات الدمج.
- تحسين التعامل مع الصور البانورامية ونسب الأبعاد غير التقليدية.
النصوص داخل الصور أصبحت أدق
أحد المجالات التي ركزت عليها جوجل بقوة خلال أجيال Nano Banana هو كتابة النصوص داخل الصورة. النماذج القديمة لإنشاء الصور كانت تستطيع رسم مشهد معقد ثم تفشل في كتابة عبارة قصيرة بشكل صحيح، لكن التطور خلال العامين الأخيرين جعل توليد اللافتات والبوسترات والإنفوجرافيك أكثر قابلية للاستخدام.
مع Nano Banana 2.1 تقول Google إن Text Rendering وInfographic Layout حصلا على تحسين إضافي، وهو ما يهم المصممين وصناع المحتوى الذين يريدون إنشاء تصميم يحتوي نصًا فعليًا وليس مجرد مشهد بصري. التحسين لا يعني أن كل نص سيخرج مثاليًا من المحاولة الأولى، لكنه يقلل الحاجة إلى إعادة إنشاء الصورة كاملة بسبب كلمة مكتوبة خطأ.
تحرير جزء محدد بدل تغيير الصورة بالكامل
الصورة التي شاركتها Google تركز كذلك على mask-based editing، وهو اتجاه مهم في أدوات التحرير الحديثة. الفكرة أن المستخدم يستطيع تحديد منطقة بعينها ثم طلب تغييرها، بينما يحاول النموذج الحفاظ على بقية المشهد كما هو. وهذه النقطة ترتبط مباشرة بأحد أهم وعود Nano Banana 2.1: تقليل الانحراف غير المطلوب أثناء التحرير.
في التطبيقات العملية يمكن أن يعني ذلك تغيير لون قطعة ملابس، إزالة عنصر من الخلفية، استبدال منتج، أو تعديل جزء من الوجه أو الديكور دون إعادة بناء الصورة بالكامل. القيمة هنا ليست في قدرة النموذج على تنفيذ التعديل فقط، بل في قدرته على معرفة ما يجب ألا يتغير.
ثلاث مستويات للتفكير قبل إنشاء الصورة
النسخة الجديدة لا تعتمد فقط على سرعة Flash المعروفة في هذه العائلة. توفر وثائق Google ثلاثة مستويات لما تسميه Thinking: minimal وmedium وhigh، مع استخدام المستوى المتوسط افتراضيًا. هذا يسمح للمطور بالموازنة بين السرعة وبين الوقت الذي يقضيه النموذج في فهم المهمة المعقدة قبل إنشاء الصورة.
في مهمة بسيطة مثل تغيير لون الخلفية قد يكون التفكير الأدنى كافيًا، بينما يمكن أن تستفيد تصميمات معقدة تحتوي عدة شخصيات أو نصوص أو عناصر مرجعية من مستوى أعلى. وهذا يجعل Nano Banana 2.1 أقرب إلى محرك بصري يمكن ضبط طريقة عمله حسب نوع المهمة، وليس مولد صور بإعداد واحد للجميع.
البحث على الويب والصور يدخل في عملية التوليد
يدعم النموذج أيضًا Grounding باستخدام Google Web Search وImage Search. هذه القدرة تسمح له باستخدام معلومات حديثة أو مراجع بصرية من البحث عندما تحتاج المهمة إلى شيء موجود في العالم الحقيقي بدل الاعتماد فقط على المعرفة الموجودة داخل النموذج.
هذا مهم خصوصًا في تصميمات المنتجات أو المواقع أو الأشياء المعروفة، لأن Nano Banana 2.1 يمكنه الاستفادة من معلومات أحدث بدل تخمين شكل عنصر تغير مؤخرًا. ومع ذلك تظل النتيجة صورة مولدة، ولذلك يجب مراجعة التفاصيل عندما تكون الدقة الواقعية شرطًا أساسيًا.
أين يقع Nano Banana 2.1 داخل عائلة جوجل؟
أصبحت عائلة Nano Banana واسعة أكثر من السابق. النموذج الأصلي ما زال موجودًا كخيار أقدم، بينما قدمت Google لاحقًا Nano Banana Pro للمهام الاحترافية الثقيلة، ثم Nano Banana 2 كنموذج أسرع وأكثر كفاءة، وNano Banana 2 Lite للعمليات ذات التكلفة والكمية العالية. والآن يأتي Nano Banana 2.1 كتحديث مباشر يركز على رفع جودة نموذج الاستخدام العام من دون تحويله إلى فئة Pro.
وسبق أن تناولنا في سوالف سوفت دخول Nano Banana إلى منتجات أخرى من Google، ومنها Google Pics التي تستخدم Nano Banana في إنشاء التصميمات وتحريرها. وجود النموذج في أكثر من منتج يوضح أن Google لا تنظر إليه كمولد صور منفصل فقط، بل كمحرك بصري يمكن دمجه عبر منظومتها.
النموذج أصبح موثقًا للمطورين وليس مجرد اسم متداول
قبل أيام كان اسم Nano Banana 2.1 يظهر في تقارير وتجارب مبكرة من دون وجود صفحة رسمية واضحة، لكن الوضع تغير الآن. وثائق Google AI for Developers أصبحت تسجل النموذج رسميًا كإصدار Stable، وتعرض معرفه البرمجي وخصائصه وحدود الإدخال والإخراج وقدرات البحث والتوليد.
هذا فارق مهم للمطورين؛ ظهور اسم داخل واجهة تطبيق لا يعني وحده أن النموذج جاهز للاستخدام الإنتاجي، بينما إدراجه ضمن دليل النماذج المستقرة يمنح فرق التطوير نقطة مرجعية واضحة للـAPI. ويمكن مراجعة صفحة Google الرسمية الخاصة بـNano Banana 2.1 للتفاصيل التقنية الكاملة.
Nano Banana 2.1: تحديث يركز على ما يحدث بعد الصورة الأولى
الأهم في Nano Banana 2.1 ليس مجرد أن الصورة الأولى يمكن أن تبدو أجمل، بل أن Google ركزت على ما يحدث عندما تبدأ في العمل عليها: تعدل عنصرًا، تحفظ شخصية، تدخل نصًا، تستخدم عدة صور مرجعية، ثم تعود لتغيير تفصيلة أخرى. هذه هي المرحلة التي تكشف عادة نقاط ضعف نماذج الصور بسرعة.
إذا نجحت التحسينات كما تصفها Google، فالقيمة الحقيقية للإصدار الجديد ستكون في تقليل عدد المحاولات اللازمة للوصول إلى التصميم النهائي. وهذا هو الفارق بين أداة ممتعة لتوليد صورة واحدة وبين أداة يمكن إدخالها في سير عمل فعلي للمصممين وصناع المحتوى. ومع بدء وصول Nano Banana 2.1 إلى أدوات Google المختلفة، سيكون الاختبار العملي خلال الأيام المقبلة هو أفضل وسيلة لمعرفة حجم الفارق الحقيقي عن الجيل السابق.
لا يسمح بنقل هذا المحتوى من سوالف دون الاشارة برابط مباشر





