الائتمان: VentureBeat ، تم إنشاؤه مع Midjourney
تريد رؤى أكثر ذكاء في صندوق الوارد الخاص بك؟ اشترك في النشرات الإخبارية الأسبوعية لدينا للحصول على ما يهم فقط للمؤسسات AI والبيانات وقادة الأمن. اشترك الآن
جوجل تم إصدار Gemini 2.5 Flash Image ، وهو نموذج جديد عرفه العديد من مستخدمي Beta باسم Nanobanana ، والذي يمنح المؤسسات المزيد من الخيارات للمشاريع الإبداعية. يمكّنهم من تغيير مظهر الصور التي يحتاجونها بسرعة ومع تحكم أكثر من النماذج السابقة المقدمة.
سيتم دمج النموذج في تطبيق Gemini.
النموذج ، مبني على رأسه”https://venturebeat.com/ai/google-launches-production-ready-gemini-2-5-ai-models-to-challenge-openais-enterprise-dominance/”> Gemini 2.5 Flash، يضيف المزيد من القدرات إلى تحرير الصور الأصلي على تطبيق Gemini. تحتفظ Gemini 2.5 Flash Image بآثار الأحرف بين الصور المختلفة ولديها المزيد من الاتساق عند تحرير الصور. إذا قام المستخدم بتحميل صورة لحيوانه الأليف ثم يطلب من النموذج تغيير الخلفية أو إضافة قبعة إلى كلبهم ، فإن صورة الفلاش Gemini 2.5 ستفعل ذلك دون تغيير موضوع الصورة.
وقالت نيكول بريشتوفا ، الرائدة في مجال الجيميني ، الرائدة في مجال جيلدز ، الرائدة في مجال “جوز” ، إن تحرير الصور لنفسك أو للأشخاص الذين تعرفهم جيدًا ، فإن العيوب الخفية ، وهي عبارة عن تصوير “غير متماثل ولكن ليس تمامًا”. “لهذا السبب تم تصميم آخر تحديث لدينا لصنع صور لأصدقائك وعائلتك وحتى حيواناتك الأليفة تبدو باستمرار مثل نفسها.”
يتساقط تحجيم الذكاء الاصطناعى حدوده
تتم إعادة تشكيل قبعات الطاقة ، وارتفاع تكاليف الرمز المميز ، والتأخيرات الاستدلال. انضم إلى صالوننا الحصري لاكتشاف كيف هي الفرق الكبرى:
- تحويل الطاقة إلى ميزة استراتيجية
- تعليم الاستدلال الفعال لتحقيق مكاسب الإنتاجية الحقيقية
- فتح العائد على الاستثمار التنافسي مع أنظمة الذكاء الاصطناعى المستدامة
تأمين مكانك للبقاء في المقدمة:”https://bit.ly/4mwGngO”> https://bit.ly/4mwgngo
تتمثل إحدى الشركات في الشكاوى وبعض المستخدمين الأفراد في حدوث تعديلات على الصور التي أنشأتها الذكاء الاصطناعى ، فإن التعديلات الطفيفة تغير الصورة كثيرًا. على سبيل المثال ، قد يقوم شخص ما بتوجيه النموذج إلى تحريك موقف الشخص في الصورة ، وبينما يفعل النموذج ما يقال له ، يتم تغيير وجه الشخص قليلاً.
ستشمل جميع الصور التي تم إنشاؤها على Gemini علامة مائية Synthid من Google. النموذج متاح لجميع المستخدمين المجانيين المدفوعين لتطبيق Gemini.
التكهنات بأن Google تخطط لإصدار نموذج جديد للتقاط الصور على منصات التواصل الاجتماعي. رأى المستخدمون في LM Arena نموذجًا جديدًا غامضًا يسمى Nanobanana يتبع “تعليمات معقدة متعددة الخطوات بدقة مثيرة للإعجاب” ، كما وضعت شريك Andressen Horowitz Justine Moore في منشور.
“en” dir=”ltr”>
طراز تحرير الصور الجديد الغامض ضرب الساحة؟
“Nano-banana” يتيح لك تحميل صورتين ومطالبة بالجمع بينهما.
يمكن أن تتبع التعليمات المعقدة متعددة الخطوات بدقة رائعة.”https://t.co/Ylu54w7ge4″> pic.twitter.com/ylu54w7ge4
– Justine Moore (VeventureTwins)”https://twitter.com/venturetwins/status/1957155767888548160?ref_src=twsrc%5Etfw”> 17 أغسطس 2025
سرعان ما لاحظ الناس أن نموذج نانوبانانا بدا أنه يأتي من Google قبل أن يؤكد العديد من المختبرين المبكرين. على الرغم من أنه في ذلك الوقت ، لم تؤكد Google ما خططت له مع النموذج على LM Arena.
“en” dir=”ltr”>
نانو بانيانا هو الموز! ؟
على محمل الجد ، استغرق الأمر فقط صورة ملفي الشخصي وهذا موجه: “Medium shot of the man facing the camera playing guitar on a stage in a bar”
ما هو النموذج هذا؟ أراهن على Imagen 5! ؟ أي تخمينات؟”https://t.co/SAQRcdW2zL”> pic.twitter.com/saqrcdw2zl
– Anis Aydar (anisaydar)”https://twitter.com/anisaydar/status/1956362028882255963?ref_src=twsrc%5Etfw”> 15 أغسطس 2025
“en” dir=”ltr”>
نانوبانانا من Google؟ تدور حول Drop a AI Model الذي يقدم تعديلات Photoshop المؤيدة للمستوى في ثوانٍ ، مع نص فقط.
هذا الجيل القادم من ماذا “filters” لقد وعدنا إلى الأبد.
إليك موضوع من 10 أمثلة:
تغيير تعبيرات الوجه والطقس.
1/11″https://t.co/M8WCf7JFNT”> pic.twitter.com/m8wcf7jfnt
– ديدي (deedydas)”https://twitter.com/deedydas/status/1959068336903659778?ref_src=twsrc%5Etfw”> 23 أغسطس 2025
حتى هذا الأسبوع ، استمرت التكهنات حول وقت ظهور النموذج ، وهو نبوي بطريقة ما.
يأتي الكثير من الإثارة في الوقت الذي يتم فيه القتال بين مقدمي الخدمات النموذجية لتقديم المزيد من الصور والتعديلات الواقعية والواقعية ، مما يدل على مدى قوة النماذج متعددة الوسائط.
ومع ذلك ، لا تزال Google بحاجة إلى محاربة المنافسين مثل”https://chat.qwen.ai/” الهدف=”_blank” rel=”noreferrer noopener”> Qwen وتم إصداره مؤخرًا”https://venturebeat.com/ai/qwen-image-edit-gives-photoshop-a-run-for-its-money-with-ai-powered-text-to-image-edits-that-work-in-seconds/”> QWEN-IMAGE EDIT و”https://openai.com/” الهدف=”_blank” rel=”noreferrer noopener”> Openai، الذي أضاف تحرير صور الذكاء الاصطناعي إلى chatgpt وأيضا صنع”https://venturebeat.com/ai/openai-makes-chatgpts-image-generation-available-as-api/”> النموذج المتاح كأبي آر.
بالطبع،”https://www.adobe.com/” الهدف=”_blank” rel=”noreferrer noopener”> Adobeمنذ فترة طويلة تعتبر واحدة من القادة في مساحة تحرير الصور ، وأضاف لها”https://venturebeat.com/ai/adobe-launches-first-photoshop-mobile-app-and-it-has-amazing-firefly-ai-powered-object-detection-editing-and-effects/”> النموذج الرئيسي Firefly إلى Photoshop ومنصات تحرير الصور الأخرى.
تحرير الصور الأصلي
وأضاف الجوزاء”https://venturebeat.com/ai/googles-native-multimodal-ai-image-generation-in-gemini-2-0-flash-impresses-with-fast-edits-style-transfers/”> تحرير صورة AI الأصلي على الجوزاء في مارس ، والتي عرضت على مستخدمي منصة الدردشة.
سيتيح إحضار ميزات تحرير الصور مباشرة إلى منصة الدردشة للمؤسسات إصلاح الصور أو الرسوم البيانية دون تحريك Windows.
يمكن للمستخدمين تحميل صورة إلى Gemini ، ثم أخبر النموذج عن التغييرات التي يريدونها. بمجرد رضاهم ، يمكن إعادة تحميل الصور الجديدة إلى Gemini وتحويلها إلى مقطع فيديو.
بخلاف إضافة زي أو تغيير في الموقع ، يمكن لـ Gemini 2.5 Flash Image مزج صور مختلفة ، وتوفر أنماط تحرير ومزج بين صورة واحدة إلى صورة أخرى.
الرؤى اليومية حول حالات استخدام الأعمال مع VB يوميا
إذا كنت ترغب في إقناع رئيسك في العمل ، فقد غطيت VB Daily. نمنحك السبق الصحفي الداخلي على ما تفعله الشركات مع الذكاء الاصطناعي التوليدي ، من التحولات التنظيمية إلى عمليات النشر العملية ، حتى تتمكن من مشاركة رؤى لأقصى عائد على الاستثمار.
اقرأ لدينا”http://venturebeat.com/terms-of-service/”> سياسة الخصوصية
شكرا على الاشتراك. تحقق أكثر”http://venturebeat.com/newsletters/”> النشرات الإخبارية VB هنا.
حدث خطأ.