اوپن‌ای‌آی نسخه‌ی جدید ابزار تولید تصویر خود با نام ChatGPT Images 2.0 را منتشر کرد؛ قابلیتی که حالا با توانایی تحلیل پیش از تولید (Reasoning) می‌تواند تصاویر دقیق‌تر، باکیفیت‌تر و منطبق‌تر با دستور کاربر بسازد.

نسخه‌ی تازه که بر پایه‌ی مدل GPT Image 2 توسعه یافته، بهبود قابل توجهی در دنبال‌کردن دستورات پیچیده، حفظ جزئیات بصری و تولید متن داخل تصویر دارد. این قابلیت برای کاربران اشتراکی ChatGPT Plus، Pro، Business و Enterprise فعال شده و امکان تحلیل ساختار تصویر پیش از تولید را فراهم می‌کند.

جست‌وجو در وب و تحلیل فایل‌های آپلودشده

یکی از قابلیت‌های مهم این نسخه، امکان استفاده از جست‌وجوی وب برای الهام یا تکمیل اطلاعات پیش از تولید تصویر است. همچنین کاربران می‌توانند فایل یا تصویر مرجع آپلود کنند تا مدل بر اساس آن، خروجی بصری جدید تولید کند.

تولید هم‌زمان ۸ تصویر با سبک یکسان

در آپدیت جدید، امکان تولید هم‌زمان تا هشت تصویر با حفظ سبک بصری، کاراکترها و انسجام طراحی فراهم شده است. این ویژگی برای ساخت محتوای سریالی مانند صفحات مانگا، استوری‌بورد، کمیک یا طراحی محیط‌های مختلف با هویت بصری ثابت کاربرد دارد.

وضوح بالاتر و نسبت‌های تصویر متنوع

کیفیت خروجی‌ها نیز ارتقا یافته و حالا تصاویر با وضوح حداکثر 2K و نسبت‌های تصویر متنوع (از ۳:۱ تا ۱:۳) تولید می‌شوند.
همچنین عملکرد سیستم در تولید متن داخل تصویر بهبود یافته؛ به‌ویژه برای زبان‌هایی مانند ژاپنی، کره‌ای، چینی، هندی و بنگالی که پیش‌تر چالش‌های بیشتری داشتند.

رقابت فشرده در بازار ابزارهای تصویری

ابزار تولید تصویر چت‌جی‌پی‌تی نخستین‌بار سال گذشته معرفی شد و در به‌روزرسانی‌های بعدی سرعت تولید و ویرایش آن افزایش یافت. اکنون، در شرایطی که ابزارهایی مانند NanoBanana Pro گوگل و MAI-Image-2 مایکروسافت نیز در حال توسعه هستند، این آپدیت جدید تلاشی برای تقویت جایگاه OpenAI در بازار تولید محتوای تصویری مبتنی بر هوش مصنوعی محسوب می‌شود.

نسخه‌ی جدید از امروز برای کاربران ChatGPT و Codex در دسترس قرار گرفته است.