المنصة – أعلنت شركة “OpenAI” يوم الثلاثاء عن إطلاق نموذجها الجديد والمتطور لتوليد الصور بالذكاء الاصطناعي، والذي يحمل اسم ChatGPT Images 2.0. ويمثل هذا الإصدار قفزة نوعية في قدرة الأداة على فهم الأوامر المعقدة وتحويلها إلى محتوى بصري عالي الدقة.
ميزات تقنية غير مسبوقة
أظهرت الاختبارات الأولية للنموذج الجديد تفوقاً ملحوظاً في مستويات التفاصيل البصرية، وقدرة استثنائية على رصد وإنتاج الصور المتعددة من أمر نصي واحد (Prompt)؛ حيث بات بإمكان المستخدمين الآن توليد حزم كاملة من الصور المتصلة، مثل تصميم “كتيب دراسي” متكامل بضغطة زر واحدة.
وفي تطور تقني بارز، نجح النموذج في تجاوز إحدى أكبر العقبات التي واجهت النسخ السابقة، وهي “توليد النصوص داخل الصور”؛ إذ أصبح بإمكانه الآن إدراج نصوص دقيقة ومقروءة، بما في ذلك اللغات غير الإنجليزية مثل الصينية والهندية، رغم أن بعض التقارير التقنية تشير إلى أن النموذج لا يزال يواجه بعض التحديات الطفيفة في إتقان اللغات الأجنبية مقارنة باللغة الإنجليزية.
التوفر والاشتراكات
أكدت الشركة أن الإصدار الجديد متاح حالياً للمستخدمين على مستوى العالم عبر منصتي ChatGPT و Codex. وبينما سيتمكن مستخدمو النسخة المجانية من الوصول إلى ميزات النموذج الأساسية، خصصت “OpenAI” نسخة أكثر قوة وكفاءة للمشتركين في الخدمات المدفوعة، لضمان تجربة إنتاجية أسرع وأكثر تعقيداً.
يُذكر أن هذا الإطلاق يأتي في إطار التنافس المحموم بين شركات التكنولوجيا الكبرى لتعزيز قدرات الوسائط المتعددة (Multimodal) في نماذج الذكاء الاصطناعي التوليدي، ودمج الوظائف البصرية والنصية في واجهة استخدام واحدة.








