اوپنایآی نسخهی جدید ابزار تولید تصویر خود با نام ChatGPT Images 2.0 را منتشر کرد؛ قابلیتی که حالا با توانایی تحلیل پیش از تولید (Reasoning) میتواند تصاویر دقیقتر، باکیفیتتر و منطبقتر با دستور کاربر بسازد.
نسخهی تازه که بر پایهی مدل GPT Image 2 توسعه یافته، بهبود قابل توجهی در دنبالکردن دستورات پیچیده، حفظ جزئیات بصری و تولید متن داخل تصویر دارد. این قابلیت برای کاربران اشتراکی ChatGPT Plus، Pro، Business و Enterprise فعال شده و امکان تحلیل ساختار تصویر پیش از تولید را فراهم میکند.
جستوجو در وب و تحلیل فایلهای آپلودشده
یکی از قابلیتهای مهم این نسخه، امکان استفاده از جستوجوی وب برای الهام یا تکمیل اطلاعات پیش از تولید تصویر است. همچنین کاربران میتوانند فایل یا تصویر مرجع آپلود کنند تا مدل بر اساس آن، خروجی بصری جدید تولید کند.
تولید همزمان ۸ تصویر با سبک یکسان

در آپدیت جدید، امکان تولید همزمان تا هشت تصویر با حفظ سبک بصری، کاراکترها و انسجام طراحی فراهم شده است. این ویژگی برای ساخت محتوای سریالی مانند صفحات مانگا، استوریبورد، کمیک یا طراحی محیطهای مختلف با هویت بصری ثابت کاربرد دارد.
وضوح بالاتر و نسبتهای تصویر متنوع
کیفیت خروجیها نیز ارتقا یافته و حالا تصاویر با وضوح حداکثر 2K و نسبتهای تصویر متنوع (از ۳:۱ تا ۱:۳) تولید میشوند.
همچنین عملکرد سیستم در تولید متن داخل تصویر بهبود یافته؛ بهویژه برای زبانهایی مانند ژاپنی، کرهای، چینی، هندی و بنگالی که پیشتر چالشهای بیشتری داشتند.
رقابت فشرده در بازار ابزارهای تصویری
ابزار تولید تصویر چتجیپیتی نخستینبار سال گذشته معرفی شد و در بهروزرسانیهای بعدی سرعت تولید و ویرایش آن افزایش یافت. اکنون، در شرایطی که ابزارهایی مانند NanoBanana Pro گوگل و MAI-Image-2 مایکروسافت نیز در حال توسعه هستند، این آپدیت جدید تلاشی برای تقویت جایگاه OpenAI در بازار تولید محتوای تصویری مبتنی بر هوش مصنوعی محسوب میشود.
نسخهی جدید از امروز برای کاربران ChatGPT و Codex در دسترس قرار گرفته است.


