ChatGPT Images 2.5 معرفی شد؛ نسل جدید ساخت و ویرایش تصویر با ChatGPT

OpenAI در ۸ سپتامبر ۲۰۲۶ از ChatGPT Images 2.5 رونمایی کرد؛ نسل جدید مدل ساخت و ویرایش تصویر در ChatGPT که تمرکز اصلی آن روی کنترل دقیق‌تر نتیجه قرار دارد.

حفظ بهتر سوژه در تصاویر مرجع، Precision Editing، ثبات بیشتر در ویرایش‌های چندمرحله‌ای، درک بهتر Promptهای پیچیده و تولید سریع‌تر تصویر از مهم‌ترین پیشرفت‌های این نسخه هستند.

OpenAI می‌گوید کاربران هر هفته بیش از ۳ میلیارد تصویر با ChatGPT Images و مدل‌های GPT-Image می‌سازند. اما Images 2.5 در عمل چقدر بهتر شده است؟ در ادامه قابلیت‌های جدید آن را بررسی می‌کنیم و Precision Editing و Multi-turn Editing را با تست‌های واقعی GPTYAR می‌سنجیم.

ChatGPT Images 2.5 چیست؟

ChatGPT Images 2.5 نسل جدید مدل تولید و ویرایش تصویر OpenAI در ChatGPT است. این مدل می‌تواند از توضیحات متنی تصویر بسازد، تصاویر موجود را ویرایش کند و با استفاده از تصاویر مرجع، خروجی‌های جدید تولید کند.

در کنار ارتقای خود مدل، OpenAI قابلیت‌هایی مانند Sketch، Templates، Comment مستقیم روی تصویر و اشتراک‌گذاری Prompt را نیز به تجربه Images اضافه کرده است.

تفاوت ChatGPT Images 2.5 با Images 2.0 چیست؟

اگر قبلاً از تصویرساز ChatGPT استفاده کرده باشید، مهم‌ترین سؤال این است که Images 2.5 در عمل چه چیزی را بهتر انجام می‌دهد؟

ویژگی

Images 2.0

ChatGPT Images 2.5

سرعت تولید

مبنای مقایسه

تا ۵۰٪ latency کمتر

حفظ سوژه مرجع

پشتیبانی می‌شود

حفظ بهتر ویژگی‌های متمایز سوژه

نور و Texture

کیفیت بالا

طبیعی‌تر و غنی‌تر

Precision Editing

ویرایش تصویر

کنترل بهتر روی تغییر فقط بخش درخواستی

Multi-turn Editing

ویرایش متوالی

ثبات بهتر تغییرات در چند مرحله

دستورهای پیچیده

پشتیبانی می‌شود

درک بهتر Creative Brief پیچیده

Layout پیچیده

پشتیبانی می‌شود

عملکرد بهتر

Transparent Background

پشتیبانی می‌شود

عملکرد بهبودیافته

Sketch

اضافه شده

Templates

اضافه شده

Comment روی تصویر

اضافه شده

اشتراک Prompt

اضافه شده

API

GPT-Image-2

Flare و Sunburst

نکته مهم این است که بعضی از این موارد کاملاً جدید نیستند. برای مثال، Images 2.0 خودش در instruction following و تولید جزئیات پیچیده پیشرفت قابل‌توجهی داشت. تفاوت Images 2.5 بیشتر در دقت، ثبات و کنترل‌پذیری بیشتر هنگام تولید و مخصوصاً ویرایش دیده می‌شود.

۱. حفظ بهتر سوژه؛ Image Fidelity در Images 2.5

یکی از مهم‌ترین پیشرفت‌های Images 2.5 مربوط به حفظ سوژه در Reference Image است. وقتی عکس یک شخص، محصول، حیوان یا مکان را برای بازسازی در محیط یا سبک دیگری به ChatGPT می‌دهید، مدل‌های تصویرساز ممکن است برخی ویژگی‌های سوژه اصلی را تغییر دهند.

OpenAI می‌گوید Images 2.5 در این زمینه بهتر عمل می‌کند؛ سوژه‌های مرجع قابل‌شناسایی‌تر باقی می‌مانند، ویژگی‌های متمایز آن‌ها بهتر حفظ می‌شوند و نور و Texture نیز طبیعی‌تر به نظر می‌رسند.

نمونه رسمی OpenAI؛ حفظ سوژه هنگام تغییر ظاهر

حفظ سوژه در ویرایش تصویر با ChatGPT Images 2.5 و اضافه کردن لباس به سگ
نمونه رسمی OpenAI از قابلیت Image Fidelity در ChatGPT Images 2.5؛ اضافه‌کردن لباس به سوژه با حفظ ظاهر، ویژگی‌ها و محیط اصلی تصویر.

در این نمونه، ظاهر سوژه تغییر قابل‌توجهی کرده است، اما هویت بصری و ساختار اصلی آن همچنان قابل تشخیص باقی مانده است.

این پیشرفت برای کاربردهایی مانند تصاویر محصول، مدلینگ با هوش مصنوعی، Creativeهای تبلیغاتی و تولید مجموعه‌ای از تصاویر با یک شخصیت یا سوژه ثابت اهمیت زیادی دارد.

بازسازی تصاویر مرجع

حفظ چهره و جزئیات تصویر مرجع در ChatGPT Images 2.5
نمونه رسمی OpenAI از بهبود Image Fidelity در ChatGPT Images 2.5؛ بازسازی تصویر مرجع با حفظ بهتر چهره و ویژگی‌های اصلی سوژه.

این نمونه نیز نشان می‌دهد هدف Images 2.5 فقط ایجاد تصویری مشابه Reference نیست؛ حفظ ویژگی‌های متمایز سوژه بخش مهمی از فرایند تولید تصویر است.

۲. Precision Editing؛ فقط همان چیزی را تغییر بده که خواسته شده

یکی از مهم‌ترین پیشرفت‌های Images 2.5، Precision Editing است. فرض کنید تصویر تقریباً ایده‌آلی دارید و فقط می‌خواهید لباس، محصول یا بخشی از پس‌زمینه را تغییر دهید؛ در مدل‌های تصویرساز ممکن است هنگام این ویرایش، بخش‌های دیگری مثل چهره، نور یا ترکیب‌بندی نیز ناخواسته تغییر کنند.

OpenAI می‌گوید Images 2.5 بهتر می‌تواند فقط بخش درخواست‌شده را ویرایش کند و سایر جزئیات تصویر را ثابت نگه دارد.

نمونه اول؛ ویرایش سوژه انسانی

نمونه Precision Editing در ChatGPT Images 2.5 و تغییر لباس با حفظ چهره
نمونه رسمی OpenAI از Precision Editing در ChatGPT Images 2.5؛ تغییر لباس سوژه با حفظ چهره و ویژگی‌های اصلی تصویر.

در این نمونه تغییر مشخصی روی ظاهر سوژه انجام شده، در حالی که ویژگی‌های اصلی چهره و ساختار تصویر حفظ شده‌اند.

این دقیقاً همان چیزی است که Precision Editing برای آن اهمیت پیدا می‌کند: مدل فقط نباید بداند چه چیزی را تغییر دهد؛ باید بفهمد چه چیزهایی را نباید تغییر دهد.

نمونه دوم؛ Precision Editing فقط برای چهره نیست

مقایسه ویرایش تصویر در ChatGPT Images 2.5 با قابلیت Precision Editing
نمونه رسمی OpenAI از Precision Editing در ChatGPT Images 2.5؛ مرتب‌کردن تخت با حفظ ساختار و جزئیات اصلی اتاق.

در این نمونه وضعیت تخت تغییر کرده، اما ساختار اتاق، زاویه دید و بسیاری از عناصر محیط حفظ شده‌اند.

بنابراین Precision Editing فقط برای تغییر چهره یا لباس کاربرد ندارد؛ بلکه می‌تواند در طراحی داخلی، تصاویر محصول، تبلیغات و اصلاح عناصر مشخص یک صحنه نیز مفید باشد.

تست جی‌پی‌تی‌یار : آیا Images 2.5 واقعاً فقط بخش موردنظر را تغییر می‌دهد؟

برای اینکه عملکرد Precision Editing را فقط بر اساس نمونه‌های رسمی OpenAI قضاوت نکنیم، این قابلیت را در GPTyar نیز آزمایش کردیم. تصویری شامل جزئیات متعدد مثل چهره، لباس، لپ‌تاپ، فنجان، موبایل، گیاهان و نوشته‌های پس‌زمینه را در اختیار ChatGPT قرار دادیم و از آن خواستیم فقط رنگ لباس را از قرمز به سبز زیتونی تغییر دهد و سایر بخش‌های تصویر را دست‌نخورده نگه دارد.

پرامپت تست:

فقط رنگ لباس را به سبز زیتونی تغییر بده. چهره، حالت صورت، مو، ژست، فرم بدن، پس‌زمینه، نورپردازی، کادربندی و تمام جزئیات دیگر تصویر را بدون تغییر نگه دار.

تست Precision Editing در ChatGPT Images 2.5 توسط GPTyar
تست اختصاصی GPTYAR از Precision Editing در ChatGPT Images 2.5؛ تغییر رنگ لباس از قرمز به سبز زیتونی با حفظ چهره، ژست، نور و جزئیات محیط.

در خروجی، رنگ لباس با موفقیت از قرمز به سبز زیتونی تغییر کرد و در عین حال چهره، حالت صورت، مو، ژست، کادربندی و بیشتر جزئیات محیط تقریباً ثابت باقی ماندند. در تست GPTyar، Images 2.5 توانست این ویرایش محدود را بدون ایجاد تغییر محسوس در سایر اجزای اصلی تصویر انجام دهد؛ نتیجه‌ای که Precision Editing را برای تغییر رنگ لباس، محصول یا بخش مشخصی از تصویر کاربردی‌تر می‌کند.

۳. ویرایش چندمرحله‌ای باثبات‌تر؛ Multi-turn Editing

یکی دیگر از پیشرفت‌های Images 2.5، ثبات بیشتر در ویرایش‌های چندمرحله‌ای است. یعنی اگر روی یک تصویر چند تغییر متوالی مثل تغییر لباس، پس‌زمینه یا اضافه‌کردن یک شیء انجام دهید، مدل بهتر می‌تواند تغییرات مراحل قبلی را حفظ کند.

OpenAI می‌گوید Images 2.5 در ویرایش‌های متوالی، دستورها را باثبات‌تر دنبال می‌کند و هر Edit جدید بهتر روی مراحل قبلی بنا می‌شود. این قابلیت برای Workflowهای حرفه‌ای مهم است؛ چون می‌توان یک تصویر را مرحله‌به‌مرحله اصلاح کرد، بدون اینکه هر بار مجبور به تولید مجدد آن از ابتدا شد.

تست حرفه‌ای جی‌پی‌تی‌یار؛ آیا تغییرات در چند ویرایش متوالی حفظ می‌شوند؟

برای بررسی عملکرد Multi-turn Editing در ChatGPT Images 2.5، یک تصویر را طی چند مرحله و در همان گفت‌وگو ویرایش کردیم. هدف این بود که ببینیم مدل هنگام دریافت درخواست‌های جدید، تا چه اندازه تغییرات مراحل قبلی و ویژگی‌های اصلی تصویر را حفظ می‌کند.

در مرحله اول، رنگ لباس از قرمز به سبز زیتونی تغییر کرد. سپس پس‌زمینه به یک کافه مدرن و مینیمال با دکور روشن تبدیل شد. در مراحل بعدی، یک عینک آفتابی مشکی روی سر سوژه قرار گرفت و در نهایت رنگ فنجان قهوه به مشکی مات تغییر کرد.

تست Multi-turn Editing در ChatGPT Images 2.5 توسط GPTyar
تست اختصاصی GPTYAR از Multi-turn Editing در ChatGPT Images 2.5؛ حفظ چهره و ساختار اصلی تصویر پس از چند ویرایش متوالی شامل تغییر لباس، پس‌زمینه، اضافه‌کردن عینک و تغییر رنگ فنجان.

در خروجی نهایی، لباس سبز زیتونی، پس‌زمینه جدید، عینک و فنجان مشکی همگی حفظ شدند و در عین حال چهره، حالت صورت، ژست، لپ‌تاپ، موبایل و ترکیب‌بندی اصلی تصویر تا حد زیادی ثابت باقی ماندند. البته در برخی جزئیات ظریف محیط و نور تفاوت‌هایی دیده می‌شود. در مجموع، تست GPTyar نشان داد Images 2.5 می‌تواند چند ویرایش متوالی را بدون از دست دادن تغییرات اصلی مراحل قبل انجام دهد، هرچند نباید انتظار ثبات کاملاً پیکسل‌به‌پیکسل داشت.

۴. درک بهتر Promptهای پیچیده و Creative Brief

Images 2.5 فقط در کیفیت ظاهری تصاویر پیشرفت نکرده است. OpenAI اعلام کرده مدل در درک دستورهای بصری پیچیده نیز بهتر شده و می‌تواند Layoutهای پیچیده‌تر را مدیریت کند، اطلاعات واقعی را با دقت بیشتری در تصویر منعکس کند و Visual Style درخواست‌شده را بهتر دنبال کند.

این پیشرفت برای کسب‌وکارها و تیم‌های طراحی اهمیت زیادی دارد؛ زیرا در Creative Briefهای پیچیده، مدل باید Visual Direction، Composition و جزئیات مشخص‌شده را بهتر حفظ کند و از دستور اولیه فاصله نگیرد.

۵. Transparent Background نیز بهتر شده است

OpenAI اعلام کرده ChatGPT Images 2.5 در مدیریت Layoutهای پیچیده، از جمله Transparent Background، عملکرد بهتری دارد. این قابلیت برای ساخت تصاویر محصول، Assetهای طراحی، عناصر UI، آیکون‌ها و تصاویر کاتالوگ و بنر بسیار کاربردی است.

برای مثال، می‌توانید تصویر یک محصول را به ChatGPT بدهید و از آن بخواهید بدون تغییر در ظاهر محصول، پس‌زمینه را کاملاً شفاف کند.

۶. Sketch؛ ایده‌تان را بکشید تا ChatGPT آن را بسازد

یکی از جذاب‌ترین قابلیت‌های جدید، Sketch است.

به‌جای اینکه همیشه ایده خود را فقط با متن توضیح دهید، حالا می‌توانید مستقیماً داخل ChatGPT یک طرح ساده بکشید و از آن به‌عنوان Visual Guide برای تصویر نهایی استفاده کنید.

مثلاً می‌توانید Layout تقریبی یک اتاق، فرم یک لباس یا حتی یک Doodle ساده را رسم کنید و سپس با متن توضیح دهید خروجی نهایی چه سبکی داشته باشد.

برای استفاده از آن می‌توان @Sketch را در ChatGPT وارد کرد. OpenAI در Release Notes توضیح داده که در موبایل نیز می‌توان با تایپ @ و انتخاب Sketch وارد این ابزار شد.

۷. Templates؛ برای ساخت تصویر لازم نیست همیشه از صفر شروع کنید

قابلیت جدید Templates به کاربران اجازه می‌دهد به‌جای شروع از صفر، یکی از قالب‌های آماده را انتخاب کرده و سپس محتوا، عناصر طراحی و Style موردنظرشان را به آن اضافه کنند. OpenAI قالب‌هایی مانند Poster و Merch را مثال زده و Templates از بخش Images قابل انتخاب است.

این قابلیت مخصوصاً برای افرادی مفید است که نوع خروجی موردنظرشان را می‌دانند، اما نمی‌دانند Prompt را از کجا شروع کنند.

نکته
  • طبق Release Notes فعلی OpenAI، Templates در زمان انتشار این مقاله هنوز در Work mode در دسترس نیست.

۸. Comment مستقیم روی تصویر؛ ویرایش هدفمندتر

یکی از قابلیت‌های جدید Images 2.5، امکان قرار دادن Comment مستقیم روی تصویر است. به‌جای توضیح متنی مثل «شیء سمت راست را تغییر بده»، می‌توانید مستقیماً بخش موردنظر را مشخص کنید و تغییر دلخواهتان را روی همان قسمت توضیح دهید.

این قابلیت در کنار Precision Editing می‌تواند ویرایش تصاویر را هدفمندتر و ساده‌تر کند. OpenAI در Release Notes توضیح داده که در موبایل می‌توان تصویر تولیدشده را به‌صورت Full-screen باز کرد و برای مشخص‌کردن تغییرات، مستقیماً روی آن Comment گذاشت.

۹. ChatGPT Images 2.5 چقدر سریع‌تر شده است؟

یکی از تغییرات مهم Images 2.5، کاهش زمان تولید تصویر است. OpenAI اعلام کرده latency تولید تصویر در این نسخه نسبت به Images 2.0 تا ۵۰ درصد کاهش یافته است؛ موضوعی که به‌خصوص هنگام ساخت چندین تصویر یا انجام ویرایش‌های متوالی می‌تواند محسوس باشد.

البته عبارت up to 50% به معنی دو برابر شدن سرعت در تمام درخواست‌ها نیست و میزان بهبود می‌تواند بسته به نوع تصویر و شرایط متفاوت باشد.

۱۰. Prompt تصاویر را هم می‌توانید به اشتراک بگذارید

یکی از قابلیت‌های جالب تجربه جدید Images، اشتراک‌گذاری Prompt همراه تصویر است.

تا قبل از این ممکن بود یک تصویر جذاب ببینید، اما ندانید دقیقاً با چه دستوری ساخته شده است.

حالا هنگام Share کردن یک تصویر، کاربر می‌تواند Prompt سازنده آن را نیز همراه تصویر به اشتراک بگذارد. شخص دیگری می‌تواند همان ایده را با عکس‌ها و جزئیات خودش اجرا و شخصی‌سازی کند.

این قابلیت برای تیم‌های تولید محتوا، اشتراک Workflowهای خلاقانه و مخصوصاً ترندهای تصویری ChatGPT جالب است.

۱۱. GPT-Image-2.5 Flare و Sunburst؛ مدل‌های جدید API

Images 2.5 فقط به ChatGPT محدود نیست و OpenAI دو مدل جدید GPT-Image-2.5 Flare و Sunburst را نیز برای توسعه‌دهندگان عرضه کرده است.

Flare مدل سریع‌تر و انتخاب پیش‌فرض برای اکثر اپلیکیشن‌هاست. این مدل نسبت به GPT-Image-2 با تا ۵۰ درصد latency کمتر برای تولید سریع تصویر، محتوای شبکه‌های اجتماعی، Rapid Prototyping و تولید در حجم بالا مناسب است.

Sunburst برای Workflowهایی طراحی شده که کیفیت، Precision Editing و کنترل دقیق‌تر روی ویرایش‌ها اهمیت بیشتری دارد؛ مانند تصاویر حرفه‌ای محصول و Creativeهای نهایی کمپین‌های تبلیغاتی.

مدل

مناسب برای

Flare

سرعت، تولید انبوه، اپلیکیشن‌ها و Rapid Prototyping

Sunburst

Precision Editing، تصاویر حرفه‌ای محصول و Creativeهای نهایی

به زبان ساده، Flare برای سرعت و مقیاس مناسب‌تر است و Sunburst برای دقت و کنترل بیشتر روی خروجی.

۱۲. قیمت GPT-Image-2.5 Flare و Sunburst چقدر است؟

طبق مستندات فعلی OpenAI، قیمت Token در هر دو مدل Flare و Sunburst یکسان است:

نوع

قیمت در هر دو مدل

Text Input / 1M tokens

$5

Cached Text Input / 1M

$1.25

Image Input / 1M

$8

Cached Image Input / 1M

$2

Image Output / 1M

$30

هر دو مدل از Qualityهای low، medium، high، xhigh، max و auto پشتیبانی می‌کنند و می‌توانند Text و Image را به‌عنوان ورودی دریافت کنند.

Model ID این دو مدل به‌ترتیب gpt-image-2.5-flare و gpt-image-2.5-sunburst است و Snapshot زمان عرضه نیز نسخه 2026-09-08 محسوب می‌شود. این اطلاعات به‌خصوص برای توسعه‌دهندگانی که قصد استفاده از Images 2.5 در API یا مهاجرت از GPT-Image-2 را دارند، کاربردی است.

۱۳. ChatGPT Images 2.5 برای چه کسانی در دسترس است؟

Images 2.5 از ۸ سپتامبر ۲۰۲۶ در حال عرضه برای کاربران ChatGPT، ChatGPT Work و Codex در تمام Tierها روی Desktop، Mobile و Web است. اگر قصد استفاده از قابلیت‌های جدید تصویرسازی ChatGPT را دارید، می‌توانید با خرید اکانت ChatGPT از جی‌پی‌تی‌یار به ChatGPT دسترسی داشته باشید.

مدل‌های GPT-Image-2.5 Flare و Sunburst نیز در API در دسترس توسعه‌دهندگان قرار گرفته‌اند. از آنجا که OpenAI از عبارت rolling out استفاده کرده، ممکن است زمان ظاهر شدن همه قابلیت‌های جدید برای تمام حساب‌ها یکسان نباشد.

OpenAI همچنین اعلام کرده محدودیت‌های فعلی Image Generation تغییر نکرده‌اند؛ بنابراین عرضه Images 2.5 به معنی نامحدود شدن ساخت تصویر در همه پلن‌ها نیست.

۱۴. امنیت تصاویر ساخته‌شده با Images 2.5

OpenAI می‌گوید Images 2.5 بر پایه Safeguardهای موجود این شرکت توسعه پیدا کرده و Promptها و تصاویر برای جلوگیری از تولید خروجی‌های مضر بررسی می‌شوند.

OpenAI همچنین همچنان از C2PA Metadata و Invisible Watermarking برای کمک به شناسایی تصاویر ساخته‌شده با ابزارهای این شرکت استفاده می‌کند.

جمع‌بندی؛ مهم‌ترین تغییر ChatGPT Images 2.5 چیست؟

مهم‌ترین تغییر ChatGPT Images 2.5 را می‌توان در یک کلمه خلاصه کرد: کنترل. مدل جدید تلاش می‌کند بهتر تشخیص دهد چه چیزی باید تغییر کند و چه بخش‌هایی باید دست‌نخورده باقی بمانند؛ موضوعی که در حفظ سوژه‌های مرجع، Precision Editing و ویرایش‌های چندمرحله‌ای اهمیت زیادی دارد.

در کنار این پیشرفت‌ها، قابلیت‌هایی مثل Sketch، Templates، Comment روی تصویر و اشتراک Prompt تجربه ساخت تصویر در ChatGPT را تعاملی‌تر کرده‌اند. تست‌های GPTyar نیز نشان دادند Precision Editing و Multi-turn Editing در استفاده واقعی عملکرد قابل‌توجهی دارند، هرچند ثبات کامل تمام جزئیات در چندین مرحله ویرایش همچنان تضمین‌شده نیست.