نسل جدید تصویرساز ChatGPT آمد؛ ویرایش دقیق‌تر و قابلیت جذاب Sketch

تبلیغات
تبلیغات

OpenAI نسل جدید سیستم تولید و ویرایش تصویر خود را با نام ChatGPT Images 2.5 معرفی کرد. نسخه جدید علاوه‌بر افزایش کیفیت تصاویر، سرعت بالاتری دارد و ابزارهای تازه‌ای مانند Sketch، Templates و کامنت‌گذاری مستقیم روی تصاویر را در اختیار کاربران قرار می‌دهد.

یکی از جذاب‌ترین قابلیت‌های جدید، Sketch است؛ ابزاری که اجازه می‌دهد ایده خود را به‌صورت یک نقاشی ساده بکشید و سپس از ChatGPT بخواهید همان طرح اولیه را به یک تصویر کامل و پرجزئیات تبدیل کند.

تولید تصویر تا ۵۰ درصد سریع‌تر

OpenAI می‌گوید Images 2.5 در مقایسه با Images 2.0 تا ۵۰ درصد تأخیر کمتری در تولید تصویر دارد. این تغییر خصوصاً زمانی اهمیت پیدا می‌کند که کاربر قصد دارد چند نسخه مختلف از یک تصویر بسازد یا طی چند مرحله آن را اصلاح کند.

کیفیت خروجی نیز بهبود پیدا کرده است. تصاویر جدید نورپردازی طبیعی‌تر، بافت‌های غنی‌تر و جزئیات دقیق‌تری دارند.

قابلیت Sketch؛ ایده‌تان را بکشید، ChatGPT آن را می‌سازد

قابلیت Sketch یکی از مهم‌ترین ویژگی‌های Images 2.5 محسوب می‌شود.

کاربر می‌تواند مستقیماً در ChatGPT یک طرح ساده بکشد و آن را به‌عنوان راهنمای بصری در اختیار مدل قرار دهد. سپس با توضیح سبک، محیط، جزئیات و نتیجه موردنظر، هوش مصنوعی طرح اولیه را به یک تصویر کامل تبدیل می‌کند.

برای مثال می‌توان محل تقریبی مبلمان یک اتاق، فرم یک لباس یا حتی یک طرح بسیار ساده را کشید و سپس از ChatGPT خواست نسخه واقع‌گرایانه یا هنری آن را تولید کند.

ویرایش تصاویر دقیق‌تر شده است

OpenAI روی یکی از مشکلات مهم نسل‌های قبلی تصویرسازهای هوش مصنوعی نیز کار کرده است: تغییر ناخواسته قسمت‌هایی از تصویر که کاربر اصلاً درخواست ویرایش آنها را نداده بود.

Images 2.5 بهتر تشخیص می‌دهد کدام قسمت باید تغییر کند و تلاش می‌کند سایر اجزای تصویر را دست‌نخورده نگه دارد.

این قابلیت برای ویرایش تصاویر محصول، طراحی تبلیغات و کار با تصاویر دارای هویت بصری ثابت اهمیت زیادی دارد.

چهره و سوژه اصلی بهتر حفظ می‌شود

عملکرد مدل هنگام استفاده از تصاویر مرجع نیز ارتقا پیدا کرده است.

اگر تصویری از یک شخص، حیوان، محصول یا سوژه مشخص در اختیار ChatGPT قرار دهید و بخواهید محیط، سبک یا ترکیب‌بندی آن تغییر کند، Images 2.5 بهتر از گذشته ویژگی‌های اصلی سوژه را حفظ می‌کند.

این موضوع خصوصاً در ویرایش چهره اهمیت دارد؛ زیرا مدل‌های قبلی ممکن بود طی ویرایش‌های متعدد، جزئیات ظاهری فرد را تغییر دهند.

ویرایش چندمرحله‌ای بدون خراب‌شدن تصویر

OpenAI می‌گوید Images 2.5 در گفت‌وگوهای طولانی نیز ثبات بیشتری دارد.

یعنی می‌توانید ابتدا پس‌زمینه را تغییر دهید، سپس یک شیء اضافه کنید، نور را عوض کنید و بعد سراغ جزئیات دیگری بروید؛ بدون اینکه مدل در هر مرحله تغییرات قبلی را فراموش کند یا کیفیت تصویر به‌مرور افت کند.

این قابلیت Images 2.5 را برای فرایندهای حرفه‌ای و چندمرحله‌ای تولید محتوا کاربردی‌تر می‌کند.

Templates و کامنت‌گذاری روی تصاویر

قابلیت Templates نیز به ChatGPT اضافه شده است. کاربران می‌توانند برای قالب‌های پرکاربرد مانند پوستر، تصاویر محصول و برخی طرح‌های گرافیکی از یک ساختار آماده شروع کنند و سپس جزئیات موردنظرشان را تغییر دهند.

امکان ثبت کامنت مستقیم روی تصویر نیز فراهم شده است تا کاربر بتواند دقیقاً مشخص کند کدام قسمت نیاز به تغییر دارد.

علاوه‌براین، کاربران می‌توانند پرامپت تصاویر خود را هنگام اشتراک‌گذاری در اختیار دیگران قرار دهند تا افراد دیگر همان ایده را با تصاویر و جزئیات خودشان امتحان کنند.

دو مدل جدید برای توسعه‌دهندگان

OpenAI هم‌زمان دو مدل جدید GPT-Image-2.5 Flare و GPT-Image-2.5 Sunburst را برای API معرفی کرده است.

Flare گزینه سریع‌تر برای تولید روزمره و پرتعداد تصاویر محسوب می‌شود و OpenAI می‌گوید نسبت به GPT-Image-2 کیفیت بالاتر را با ۵۰ درصد تأخیر کمتر ارائه می‌کند.

Sunburst در مقابل برای پروژه‌هایی طراحی شده که کنترل و دقت بیشتری در فرایند تولید و ویرایش نیاز دارند؛ مانند تصاویر نهایی کمپین‌های تبلیغاتی یا عکاسی حرفه‌ای محصول.

ChatGPT Images 2.5 برای چه کسانی منتشر شده است؟

OpenAI انتشار Images 2.5 را برای کاربران ChatGPT، ChatGPT Work و Codex در دسکتاپ، موبایل و وب آغاز کرده است.

نسخه جدید نشان می‌دهد رقابت تولید تصویر با هوش مصنوعی دیگر فقط روی کیفیت یک تصویر نهایی متمرکز نیست. هدف جدید، تبدیل مدل‌های تصویرساز به ابزارهایی است که بتوان با آنها یک پروژه گرافیکی را مرحله‌به‌مرحله ساخت و اصلاح کرد.

Sketch، ویرایش هدفمند و حفظ بهتر سوژه در چند مرحله، دقیقاً در همین مسیر قرار دارند و می‌توانند نحوه استفاده کاربران عادی و طراحان از هوش مصنوعی برای تولید محتوای تصویری را تغییر دهند.

م
محمدعلی قبادی

دانشجوی مهندسی صنایع و فعال حوزه رسانه و تکنولوژی با تمرکز بر تولید محتوا، توسعه رسانه، طراحی محصول و پروژه‌های دیجیتال است.

مشاهده کلیه مقالات منتشر شده
گفت‌وگوی کاربران

دیدگاه‌ها

۰ دیدگاه

دیدگاه شما

نشانی ایمیل شما منتشر نخواهد شد.

اپلیکیشن و نرم‌افزار

معرفی نرم افزار و اپلیکیشن

مشاهده بیشتر