OpenAI در تازهترین بهروزرسانی ChatGPT اعلام کرده است که کاربران هر هفته بیش از ۳ میلیارد تصویر را با استفاده از ChatGPT Images و مدلهای GPT-Image در API تولید میکنند. این شرکت اکنون دامنه امکانات قابل تولید با ChatGPT Images ۲.۵ را گسترش داده است.
مدل جدید تولید تصویر OpenAI با هدف ارائه جزئیات واضحتر، ویرایش دقیقتر و تولید سریعتر تصاویر برای فرایندهای خلاقانه طراحی شده است.
بر اساس اطلاعات منتشرشده در وبسایت رسمی OpenAI ،ChatGPT Images ۲.۵ نورپردازی طبیعیتر و بافتهای غنیتری ایجاد میکند، در حفظ سوژههای موجود در تصاویر مرجع عملکرد بهتری دارد و دستورهای ویرایشی را در چندین مرحله با قابلیت اطمینان بیشتری دنبال میکند.
OpenAI همچنین اعلام کرده است که زمان تأخیر در تولید تصاویر را در مقایسه با ChatGPT Images ۲.۰ تا ۵۰ درصد کاهش داده است. این موضوع به کاربران اجازه میدهد تصاویر را سریعتر تولید کرده و ایدههای خود را با سرعت بیشتری اصلاح کنند.
در ChatGPT، قابلیتهای جدیدی برای کنترل بیشتر کاربران بر فرایند خلاقانه معرفی شده است.
قابلیت Sketch یکی از امکانات جدید است که به کاربران اجازه میدهد مستقیماً در ChatGPT یک طرح مرجع بکشند و از آن برای تولید تصویر نهایی استفاده کنند.
قابلیت Templates نیز فرایند ساخت قالبهای بصری پرکاربرد، مانند بروشورها و تصاویر محصولات، را سادهتر میکند.
کاربران اکنون میتوانند مستقیماً روی تصاویر نظر بدهند تا ویرایشهای متمرکزتری انجام شود. همچنین امکان بهاشتراکگذاری دستورهایی که پیشتر استفاده شدهاند فراهم شده است تا دیگران نیز بتوانند همان ایدهها را با تصاویر و جزئیات خود امتحان کنند.
Images ۲.۵ برای تمام کاربران ChatGPT، ChatGPT Work و Codex روی دسکتاپ، موبایل و وب در دسترس قرار گرفته است.
برای توسعهدهندگان نیز دو مدل جدید API معرفی شده است. GPT-Image-۲.۵ Flare همان بهبودهای مربوط به کیفیت، ویرایش و سرعت را ارائه میکند و GPT-Image-۲.۵ Sunburst دقت بیشتری را برای وظایف خلاقانه و جزئیتر در اختیار کاربران قرار میدهد، هرچند زمان بیشتری برای تولید تصویر نیاز دارد.
تصاویر معنادار معمولاً ریشه در افراد واقعی، مکانها و خاطراتی دارند که از آنها ساخته میشوند.
Images ۲.۵ در استفاده از تصاویر مرجع عملکرد بهتری دارد و میتواند سوژههای آشنا را در محیطها، سبکهای بصری و ترکیببندیهای جدید قرار دهد.
سوژهها در تصاویر تولیدشده قابل شناساییتر هستند، نورپردازی و بافتها طبیعیتر به نظر میرسند و ویژگیهای متمایز سوژه نیز با احتمال بیشتری به شکل مناسبی منتقل میشوند.
برای تیمهایی که از API استفاده میکنند، همین میزان وفاداری باعث میشود فرایندهای مبتنی بر تصاویر مرجع قابلاعتمادتر باشند و تغییرات ارتباط خود را با منبع اصلی حفظ کنند.
OpenAI ویرایشهای متمرکز را آسانتر کرده است تا تصاویر نهایی هماهنگی بیشتری با چیزی داشته باشند که کاربر در ذهن دارد.
Images ۲.۵ در ویرایش عنصر موردنظر عملکرد بهتری دارد و میتواند سایر جزئیات تصویر را ثابت نگه دارد؛ حتی زمانی که سوژه یا پسزمینه پیچیدهتر باشد.
این قابلیت به توسعهدهندگانی که از Images API استفاده میکنند اجازه میدهد تنها یک عنصر، مانند محصول، پسزمینه یا متن را بهروزرسانی کنند و در عین حال سوژه و ترکیببندی تصویر را حفظ کنند.
Images ۲.۵ دستورهای ویرایشی مشخص را در مکالمات طولانیتر و پس از چندین مرحله ویرایش، با اطمینان بیشتری دنبال میکند.
تغییرات اولیه نیز با ثبات بیشتری حفظ میشوند و هر ویرایش جدید میتواند بر پایه کار قبلی انجام شود، بدون اینکه کیفیت تصویر در طول زمان کاهش پیدا کند.
این پایداری برای فرایندهای تولیدی اهمیت زیادی دارد؛ جایی که توسعهدهندگان به تغییرات هدفمند نیاز دارند و نمیخواهند برای هر اصلاح، کل محتوا را از ابتدا بازسازی کنند.
مدل جدید در درک دستورهای بصری پیچیده و تبدیل آنها به نتایج منسجم نیز عملکرد بهتری دارد.
تصاویر حاوی اطلاعات مربوط به دنیای واقعی، محتوای دقیقتری دارند و مدل میتواند چیدمانهای پیچیدهتر، از جمله پسزمینههای شفاف، را نیز مدیریت کند.
Images ۲.۵ همچنین در بازتاب سبکهای بصری عملکرد بهتری دارد و به این ترتیب تصاویر تولیدشده هماهنگی بیشتری با نگاه هنری موردنظر خواهند داشت.
این قابلیت به توسعهدهندگان و کسبوکارها کمک میکند بریفهای خلاقانه پیچیده را با قابلیت اطمینان بیشتری اجرا کنند. همچنین انتظار میرود جهتگیری بصری، ترکیببندی و جزئیات موردنیاز فرد بهتر حفظ شوند و با دقیقتر شدن دستورها، تغییرات ناخواسته کمتری در آنها ایجاد شود.
این ویژگی برای مجموعههای محتوای خلاقانه برندها، طراحی مفاهیم رابط کاربری که نیازمند حفظ سلسلهمراتب مشخص هستند و تصاویر ارائهای که باید با ساختار تعریفشده هماهنگ باشند، اهمیت دارد.
گاهی سادهترین و واضحترین راه برای توضیح یک ایده، کشیدن آن است.
قابلیت Sketch به کاربران اجازه میدهد مستقیماً در ChatGPT طرح خود را بکشند و از آن بهعنوان یک راهنمای بصری استفاده کنند.
کاربر میتواند بهسرعت طرح یک اتاق، خطوط کلی یک لباس یا حتی یک نقاشی ساده و بامزه را ترسیم کند و ChatGPT آن اثر خام را به یک تصویر کامل تبدیل کند.
همچنین میتوان توضیحاتی درباره سبک و سایر جزئیات موردنظر اضافه کرد تا خروجی نهایی بیشترین هماهنگی را با نگاه و ایده کاربر داشته باشد.
تصویر زیر، یک جاشمعی را نشان میدهد که با الهام از ایده ترسیمی کاربر ارائه شده است.
لازم نیست یک هنرمند حرفهای باشید؛ این فقط یک راه دیگر برای نزدیکتر کردن تصویر نهاییتان به چیزی است که در ذهن دارید.
منبع: ایسنا