جوجل تطلق نموذج توليد الصور Nano Banana 2.1 بتحسينات كبيرة في إجراء التعديلات وثبات العناصر
أعلنت جوجل إطلاق Nano Banana 2.1، وهو الإصدار المطوّر من نموذجها لتوليد الصور وتحريرها بالذكاء الاصطناعي، مع تحسينات ملحوظة في التصميم البصري، وتعديل أجزاء محددة من الصور، والحفاظ على ثبات هوية العناصر والشخصيات.
ويأتي النموذج الجديد استنادًا إلى تقنيات Gemini 3.6 Image، ويطوّر القدرات التي قدمها الإصدار السابق Nano Banana 2، المعروف أيضًا باسم Gemini 3.1 Flash Image، الذي جمع بين جودة الصور المرتفعة وسرعة نماذج Flash.
وتركّز جوجل في Nano Banana 2.1 على ثلاثة جوانب رئيسية، أولها التصميم البصري، إذ أصبح النموذج قادرًا على إنتاج تركيبات أكثر جاذبية وأصول بصرية أكثر صقلًا.
ويحصل المستخدمون أيضًا على تحسينات في التحرير باستخدام الأقنعة Mask-based Editing، التي تتيح تحديد جزء معين من الصورة وتعديله بدقة، بدلًا من إعادة توليد المشهد كاملًا عند إجراء تغيير محدود.
وأما التحسين الثالث فيتعلق بـثبات العناصر والشخصيات، إذ أصبح النموذج أكثر قدرة على الحفاظ على مظهر الشخص أو العنصر وهويته عند إجراء تعديلات متتالية أو إنشاء عدة صور مرتبطة بالمشهد نفسه.
وتكتسب هذه الميزة أهمية خاصة عند إنشاء صور لشخصية أو منتج في مشاهد متعددة، إذ تساعد في الحفاظ على الملامح والهوية البصرية نفسها عبر عمليات التوليد المختلفة.
وبدأت جوجل طرح Nano Banana 2.1 في عدد من خدماتها، منها تطبيق Gemini، ووضع AI Mode في بحث جوجل، ومنصة Google AI Studio، وأداة Google Flow، ومنصة Stitch، وإعلانات جوجل، بالإضافة إلى منصة Gemini Enterprise.
وأصبح النموذج متاحًا للمطورين بصورة عامة تحت المعرّف gemini-nano-banana-2.1، مع دعم مدخلات النصوص والصور والصوت والفيديو، وإمكانية إنشاء الصور بدقات قدرها 1K و 2K و 4K.