OpenAI نسل جدید سیستم تولید و ویرایش تصویر خود را با نام ChatGPT Images 2.5 معرفی کرد. نسخه جدید علاوهبر افزایش کیفیت تصاویر، سرعت بالاتری دارد و ابزارهای تازهای مانند Sketch، Templates و کامنتگذاری مستقیم روی تصاویر را در اختیار کاربران قرار میدهد.
یکی از جذابترین قابلیتهای جدید، Sketch است؛ ابزاری که اجازه میدهد ایده خود را بهصورت یک نقاشی ساده بکشید و سپس از ChatGPT بخواهید همان طرح اولیه را به یک تصویر کامل و پرجزئیات تبدیل کند.
تولید تصویر تا ۵۰ درصد سریعتر
OpenAI میگوید Images 2.5 در مقایسه با Images 2.0 تا ۵۰ درصد تأخیر کمتری در تولید تصویر دارد. این تغییر خصوصاً زمانی اهمیت پیدا میکند که کاربر قصد دارد چند نسخه مختلف از یک تصویر بسازد یا طی چند مرحله آن را اصلاح کند.
کیفیت خروجی نیز بهبود پیدا کرده است. تصاویر جدید نورپردازی طبیعیتر، بافتهای غنیتر و جزئیات دقیقتری دارند.
قابلیت Sketch؛ ایدهتان را بکشید، ChatGPT آن را میسازد
قابلیت Sketch یکی از مهمترین ویژگیهای Images 2.5 محسوب میشود.
کاربر میتواند مستقیماً در ChatGPT یک طرح ساده بکشد و آن را بهعنوان راهنمای بصری در اختیار مدل قرار دهد. سپس با توضیح سبک، محیط، جزئیات و نتیجه موردنظر، هوش مصنوعی طرح اولیه را به یک تصویر کامل تبدیل میکند.
برای مثال میتوان محل تقریبی مبلمان یک اتاق، فرم یک لباس یا حتی یک طرح بسیار ساده را کشید و سپس از ChatGPT خواست نسخه واقعگرایانه یا هنری آن را تولید کند.
ویرایش تصاویر دقیقتر شده است
OpenAI روی یکی از مشکلات مهم نسلهای قبلی تصویرسازهای هوش مصنوعی نیز کار کرده است: تغییر ناخواسته قسمتهایی از تصویر که کاربر اصلاً درخواست ویرایش آنها را نداده بود.
Images 2.5 بهتر تشخیص میدهد کدام قسمت باید تغییر کند و تلاش میکند سایر اجزای تصویر را دستنخورده نگه دارد.
این قابلیت برای ویرایش تصاویر محصول، طراحی تبلیغات و کار با تصاویر دارای هویت بصری ثابت اهمیت زیادی دارد.
چهره و سوژه اصلی بهتر حفظ میشود
عملکرد مدل هنگام استفاده از تصاویر مرجع نیز ارتقا پیدا کرده است.
اگر تصویری از یک شخص، حیوان، محصول یا سوژه مشخص در اختیار ChatGPT قرار دهید و بخواهید محیط، سبک یا ترکیببندی آن تغییر کند، Images 2.5 بهتر از گذشته ویژگیهای اصلی سوژه را حفظ میکند.
این موضوع خصوصاً در ویرایش چهره اهمیت دارد؛ زیرا مدلهای قبلی ممکن بود طی ویرایشهای متعدد، جزئیات ظاهری فرد را تغییر دهند.
ویرایش چندمرحلهای بدون خرابشدن تصویر
OpenAI میگوید Images 2.5 در گفتوگوهای طولانی نیز ثبات بیشتری دارد.
یعنی میتوانید ابتدا پسزمینه را تغییر دهید، سپس یک شیء اضافه کنید، نور را عوض کنید و بعد سراغ جزئیات دیگری بروید؛ بدون اینکه مدل در هر مرحله تغییرات قبلی را فراموش کند یا کیفیت تصویر بهمرور افت کند.
این قابلیت Images 2.5 را برای فرایندهای حرفهای و چندمرحلهای تولید محتوا کاربردیتر میکند.
Templates و کامنتگذاری روی تصاویر
قابلیت Templates نیز به ChatGPT اضافه شده است. کاربران میتوانند برای قالبهای پرکاربرد مانند پوستر، تصاویر محصول و برخی طرحهای گرافیکی از یک ساختار آماده شروع کنند و سپس جزئیات موردنظرشان را تغییر دهند.
امکان ثبت کامنت مستقیم روی تصویر نیز فراهم شده است تا کاربر بتواند دقیقاً مشخص کند کدام قسمت نیاز به تغییر دارد.
علاوهبراین، کاربران میتوانند پرامپت تصاویر خود را هنگام اشتراکگذاری در اختیار دیگران قرار دهند تا افراد دیگر همان ایده را با تصاویر و جزئیات خودشان امتحان کنند.
دو مدل جدید برای توسعهدهندگان
OpenAI همزمان دو مدل جدید GPT-Image-2.5 Flare و GPT-Image-2.5 Sunburst را برای API معرفی کرده است.
Flare گزینه سریعتر برای تولید روزمره و پرتعداد تصاویر محسوب میشود و OpenAI میگوید نسبت به GPT-Image-2 کیفیت بالاتر را با ۵۰ درصد تأخیر کمتر ارائه میکند.
Sunburst در مقابل برای پروژههایی طراحی شده که کنترل و دقت بیشتری در فرایند تولید و ویرایش نیاز دارند؛ مانند تصاویر نهایی کمپینهای تبلیغاتی یا عکاسی حرفهای محصول.
ChatGPT Images 2.5 برای چه کسانی منتشر شده است؟
OpenAI انتشار Images 2.5 را برای کاربران ChatGPT، ChatGPT Work و Codex در دسکتاپ، موبایل و وب آغاز کرده است.
نسخه جدید نشان میدهد رقابت تولید تصویر با هوش مصنوعی دیگر فقط روی کیفیت یک تصویر نهایی متمرکز نیست. هدف جدید، تبدیل مدلهای تصویرساز به ابزارهایی است که بتوان با آنها یک پروژه گرافیکی را مرحلهبهمرحله ساخت و اصلاح کرد.
Sketch، ویرایش هدفمند و حفظ بهتر سوژه در چند مرحله، دقیقاً در همین مسیر قرار دارند و میتوانند نحوه استفاده کاربران عادی و طراحان از هوش مصنوعی برای تولید محتوای تصویری را تغییر دهند.






دیدگاهها