ChatGPT Images 2.5 معرفی شد؛ نسل جدید ساخت و ویرایش تصویر با ChatGPT
OpenAI در ۸ سپتامبر ۲۰۲۶ از ChatGPT Images 2.5 رونمایی کرد؛ نسل جدید مدل ساخت و ویرایش تصویر در ChatGPT که تمرکز اصلی آن روی کنترل دقیقتر نتیجه قرار دارد.
حفظ بهتر سوژه در تصاویر مرجع، Precision Editing، ثبات بیشتر در ویرایشهای چندمرحلهای، درک بهتر Promptهای پیچیده و تولید سریعتر تصویر از مهمترین پیشرفتهای این نسخه هستند.
OpenAI میگوید کاربران هر هفته بیش از ۳ میلیارد تصویر با ChatGPT Images و مدلهای GPT-Image میسازند. اما Images 2.5 در عمل چقدر بهتر شده است؟ در ادامه قابلیتهای جدید آن را بررسی میکنیم و Precision Editing و Multi-turn Editing را با تستهای واقعی GPTYAR میسنجیم.
ChatGPT Images 2.5 چیست؟
ChatGPT Images 2.5 نسل جدید مدل تولید و ویرایش تصویر OpenAI در ChatGPT است. این مدل میتواند از توضیحات متنی تصویر بسازد، تصاویر موجود را ویرایش کند و با استفاده از تصاویر مرجع، خروجیهای جدید تولید کند.
در کنار ارتقای خود مدل، OpenAI قابلیتهایی مانند Sketch، Templates، Comment مستقیم روی تصویر و اشتراکگذاری Prompt را نیز به تجربه Images اضافه کرده است.
تفاوت ChatGPT Images 2.5 با Images 2.0 چیست؟
اگر قبلاً از تصویرساز ChatGPT استفاده کرده باشید، مهمترین سؤال این است که Images 2.5 در عمل چه چیزی را بهتر انجام میدهد؟
ویژگی | Images 2.0 | ChatGPT Images 2.5 |
|---|---|---|
سرعت تولید | مبنای مقایسه | تا ۵۰٪ latency کمتر |
حفظ سوژه مرجع | پشتیبانی میشود | حفظ بهتر ویژگیهای متمایز سوژه |
نور و Texture | کیفیت بالا | طبیعیتر و غنیتر |
Precision Editing | ویرایش تصویر | کنترل بهتر روی تغییر فقط بخش درخواستی |
Multi-turn Editing | ویرایش متوالی | ثبات بهتر تغییرات در چند مرحله |
دستورهای پیچیده | پشتیبانی میشود | درک بهتر Creative Brief پیچیده |
Layout پیچیده | پشتیبانی میشود | عملکرد بهتر |
Transparent Background | پشتیبانی میشود | عملکرد بهبودیافته |
Sketch | — | اضافه شده |
Templates | — | اضافه شده |
Comment روی تصویر | — | اضافه شده |
اشتراک Prompt | — | اضافه شده |
API | GPT-Image-2 | Flare و Sunburst |
نکته مهم این است که بعضی از این موارد کاملاً جدید نیستند. برای مثال، Images 2.0 خودش در instruction following و تولید جزئیات پیچیده پیشرفت قابلتوجهی داشت. تفاوت Images 2.5 بیشتر در دقت، ثبات و کنترلپذیری بیشتر هنگام تولید و مخصوصاً ویرایش دیده میشود.
۱. حفظ بهتر سوژه؛ Image Fidelity در Images 2.5
یکی از مهمترین پیشرفتهای Images 2.5 مربوط به حفظ سوژه در Reference Image است. وقتی عکس یک شخص، محصول، حیوان یا مکان را برای بازسازی در محیط یا سبک دیگری به ChatGPT میدهید، مدلهای تصویرساز ممکن است برخی ویژگیهای سوژه اصلی را تغییر دهند.
OpenAI میگوید Images 2.5 در این زمینه بهتر عمل میکند؛ سوژههای مرجع قابلشناساییتر باقی میمانند، ویژگیهای متمایز آنها بهتر حفظ میشوند و نور و Texture نیز طبیعیتر به نظر میرسند.
نمونه رسمی OpenAI؛ حفظ سوژه هنگام تغییر ظاهر

در این نمونه، ظاهر سوژه تغییر قابلتوجهی کرده است، اما هویت بصری و ساختار اصلی آن همچنان قابل تشخیص باقی مانده است.
این پیشرفت برای کاربردهایی مانند تصاویر محصول، مدلینگ با هوش مصنوعی، Creativeهای تبلیغاتی و تولید مجموعهای از تصاویر با یک شخصیت یا سوژه ثابت اهمیت زیادی دارد.
بازسازی تصاویر مرجع

این نمونه نیز نشان میدهد هدف Images 2.5 فقط ایجاد تصویری مشابه Reference نیست؛ حفظ ویژگیهای متمایز سوژه بخش مهمی از فرایند تولید تصویر است.
۲. Precision Editing؛ فقط همان چیزی را تغییر بده که خواسته شده
یکی از مهمترین پیشرفتهای Images 2.5، Precision Editing است. فرض کنید تصویر تقریباً ایدهآلی دارید و فقط میخواهید لباس، محصول یا بخشی از پسزمینه را تغییر دهید؛ در مدلهای تصویرساز ممکن است هنگام این ویرایش، بخشهای دیگری مثل چهره، نور یا ترکیببندی نیز ناخواسته تغییر کنند.
OpenAI میگوید Images 2.5 بهتر میتواند فقط بخش درخواستشده را ویرایش کند و سایر جزئیات تصویر را ثابت نگه دارد.
نمونه اول؛ ویرایش سوژه انسانی

در این نمونه تغییر مشخصی روی ظاهر سوژه انجام شده، در حالی که ویژگیهای اصلی چهره و ساختار تصویر حفظ شدهاند.
این دقیقاً همان چیزی است که Precision Editing برای آن اهمیت پیدا میکند: مدل فقط نباید بداند چه چیزی را تغییر دهد؛ باید بفهمد چه چیزهایی را نباید تغییر دهد.
نمونه دوم؛ Precision Editing فقط برای چهره نیست

در این نمونه وضعیت تخت تغییر کرده، اما ساختار اتاق، زاویه دید و بسیاری از عناصر محیط حفظ شدهاند.
بنابراین Precision Editing فقط برای تغییر چهره یا لباس کاربرد ندارد؛ بلکه میتواند در طراحی داخلی، تصاویر محصول، تبلیغات و اصلاح عناصر مشخص یک صحنه نیز مفید باشد.
تست جیپیتییار : آیا Images 2.5 واقعاً فقط بخش موردنظر را تغییر میدهد؟
برای اینکه عملکرد Precision Editing را فقط بر اساس نمونههای رسمی OpenAI قضاوت نکنیم، این قابلیت را در GPTyar نیز آزمایش کردیم. تصویری شامل جزئیات متعدد مثل چهره، لباس، لپتاپ، فنجان، موبایل، گیاهان و نوشتههای پسزمینه را در اختیار ChatGPT قرار دادیم و از آن خواستیم فقط رنگ لباس را از قرمز به سبز زیتونی تغییر دهد و سایر بخشهای تصویر را دستنخورده نگه دارد.
پرامپت تست:
فقط رنگ لباس را به سبز زیتونی تغییر بده. چهره، حالت صورت، مو، ژست، فرم بدن، پسزمینه، نورپردازی، کادربندی و تمام جزئیات دیگر تصویر را بدون تغییر نگه دار.

در خروجی، رنگ لباس با موفقیت از قرمز به سبز زیتونی تغییر کرد و در عین حال چهره، حالت صورت، مو، ژست، کادربندی و بیشتر جزئیات محیط تقریباً ثابت باقی ماندند. در تست GPTyar، Images 2.5 توانست این ویرایش محدود را بدون ایجاد تغییر محسوس در سایر اجزای اصلی تصویر انجام دهد؛ نتیجهای که Precision Editing را برای تغییر رنگ لباس، محصول یا بخش مشخصی از تصویر کاربردیتر میکند.
۳. ویرایش چندمرحلهای باثباتتر؛ Multi-turn Editing
یکی دیگر از پیشرفتهای Images 2.5، ثبات بیشتر در ویرایشهای چندمرحلهای است. یعنی اگر روی یک تصویر چند تغییر متوالی مثل تغییر لباس، پسزمینه یا اضافهکردن یک شیء انجام دهید، مدل بهتر میتواند تغییرات مراحل قبلی را حفظ کند.
OpenAI میگوید Images 2.5 در ویرایشهای متوالی، دستورها را باثباتتر دنبال میکند و هر Edit جدید بهتر روی مراحل قبلی بنا میشود. این قابلیت برای Workflowهای حرفهای مهم است؛ چون میتوان یک تصویر را مرحلهبهمرحله اصلاح کرد، بدون اینکه هر بار مجبور به تولید مجدد آن از ابتدا شد.
تست حرفهای جیپیتییار؛ آیا تغییرات در چند ویرایش متوالی حفظ میشوند؟
برای بررسی عملکرد Multi-turn Editing در ChatGPT Images 2.5، یک تصویر را طی چند مرحله و در همان گفتوگو ویرایش کردیم. هدف این بود که ببینیم مدل هنگام دریافت درخواستهای جدید، تا چه اندازه تغییرات مراحل قبلی و ویژگیهای اصلی تصویر را حفظ میکند.
در مرحله اول، رنگ لباس از قرمز به سبز زیتونی تغییر کرد. سپس پسزمینه به یک کافه مدرن و مینیمال با دکور روشن تبدیل شد. در مراحل بعدی، یک عینک آفتابی مشکی روی سر سوژه قرار گرفت و در نهایت رنگ فنجان قهوه به مشکی مات تغییر کرد.

در خروجی نهایی، لباس سبز زیتونی، پسزمینه جدید، عینک و فنجان مشکی همگی حفظ شدند و در عین حال چهره، حالت صورت، ژست، لپتاپ، موبایل و ترکیببندی اصلی تصویر تا حد زیادی ثابت باقی ماندند. البته در برخی جزئیات ظریف محیط و نور تفاوتهایی دیده میشود. در مجموع، تست GPTyar نشان داد Images 2.5 میتواند چند ویرایش متوالی را بدون از دست دادن تغییرات اصلی مراحل قبل انجام دهد، هرچند نباید انتظار ثبات کاملاً پیکسلبهپیکسل داشت.
۴. درک بهتر Promptهای پیچیده و Creative Brief
Images 2.5 فقط در کیفیت ظاهری تصاویر پیشرفت نکرده است. OpenAI اعلام کرده مدل در درک دستورهای بصری پیچیده نیز بهتر شده و میتواند Layoutهای پیچیدهتر را مدیریت کند، اطلاعات واقعی را با دقت بیشتری در تصویر منعکس کند و Visual Style درخواستشده را بهتر دنبال کند.
این پیشرفت برای کسبوکارها و تیمهای طراحی اهمیت زیادی دارد؛ زیرا در Creative Briefهای پیچیده، مدل باید Visual Direction، Composition و جزئیات مشخصشده را بهتر حفظ کند و از دستور اولیه فاصله نگیرد.
۵. Transparent Background نیز بهتر شده است
OpenAI اعلام کرده ChatGPT Images 2.5 در مدیریت Layoutهای پیچیده، از جمله Transparent Background، عملکرد بهتری دارد. این قابلیت برای ساخت تصاویر محصول، Assetهای طراحی، عناصر UI، آیکونها و تصاویر کاتالوگ و بنر بسیار کاربردی است.
برای مثال، میتوانید تصویر یک محصول را به ChatGPT بدهید و از آن بخواهید بدون تغییر در ظاهر محصول، پسزمینه را کاملاً شفاف کند.
۶. Sketch؛ ایدهتان را بکشید تا ChatGPT آن را بسازد
یکی از جذابترین قابلیتهای جدید، Sketch است.
بهجای اینکه همیشه ایده خود را فقط با متن توضیح دهید، حالا میتوانید مستقیماً داخل ChatGPT یک طرح ساده بکشید و از آن بهعنوان Visual Guide برای تصویر نهایی استفاده کنید.
مثلاً میتوانید Layout تقریبی یک اتاق، فرم یک لباس یا حتی یک Doodle ساده را رسم کنید و سپس با متن توضیح دهید خروجی نهایی چه سبکی داشته باشد.
برای استفاده از آن میتوان @Sketch را در ChatGPT وارد کرد. OpenAI در Release Notes توضیح داده که در موبایل نیز میتوان با تایپ @ و انتخاب Sketch وارد این ابزار شد.
۷. Templates؛ برای ساخت تصویر لازم نیست همیشه از صفر شروع کنید
قابلیت جدید Templates به کاربران اجازه میدهد بهجای شروع از صفر، یکی از قالبهای آماده را انتخاب کرده و سپس محتوا، عناصر طراحی و Style موردنظرشان را به آن اضافه کنند. OpenAI قالبهایی مانند Poster و Merch را مثال زده و Templates از بخش Images قابل انتخاب است.
این قابلیت مخصوصاً برای افرادی مفید است که نوع خروجی موردنظرشان را میدانند، اما نمیدانند Prompt را از کجا شروع کنند.
طبق Release Notes فعلی OpenAI، Templates در زمان انتشار این مقاله هنوز در Work mode در دسترس نیست.
۸. Comment مستقیم روی تصویر؛ ویرایش هدفمندتر
یکی از قابلیتهای جدید Images 2.5، امکان قرار دادن Comment مستقیم روی تصویر است. بهجای توضیح متنی مثل «شیء سمت راست را تغییر بده»، میتوانید مستقیماً بخش موردنظر را مشخص کنید و تغییر دلخواهتان را روی همان قسمت توضیح دهید.
این قابلیت در کنار Precision Editing میتواند ویرایش تصاویر را هدفمندتر و سادهتر کند. OpenAI در Release Notes توضیح داده که در موبایل میتوان تصویر تولیدشده را بهصورت Full-screen باز کرد و برای مشخصکردن تغییرات، مستقیماً روی آن Comment گذاشت.
۹. ChatGPT Images 2.5 چقدر سریعتر شده است؟
یکی از تغییرات مهم Images 2.5، کاهش زمان تولید تصویر است. OpenAI اعلام کرده latency تولید تصویر در این نسخه نسبت به Images 2.0 تا ۵۰ درصد کاهش یافته است؛ موضوعی که بهخصوص هنگام ساخت چندین تصویر یا انجام ویرایشهای متوالی میتواند محسوس باشد.
البته عبارت up to 50% به معنی دو برابر شدن سرعت در تمام درخواستها نیست و میزان بهبود میتواند بسته به نوع تصویر و شرایط متفاوت باشد.
۱۰. Prompt تصاویر را هم میتوانید به اشتراک بگذارید
یکی از قابلیتهای جالب تجربه جدید Images، اشتراکگذاری Prompt همراه تصویر است.
تا قبل از این ممکن بود یک تصویر جذاب ببینید، اما ندانید دقیقاً با چه دستوری ساخته شده است.
حالا هنگام Share کردن یک تصویر، کاربر میتواند Prompt سازنده آن را نیز همراه تصویر به اشتراک بگذارد. شخص دیگری میتواند همان ایده را با عکسها و جزئیات خودش اجرا و شخصیسازی کند.
این قابلیت برای تیمهای تولید محتوا، اشتراک Workflowهای خلاقانه و مخصوصاً ترندهای تصویری ChatGPT جالب است.
۱۱. GPT-Image-2.5 Flare و Sunburst؛ مدلهای جدید API
Images 2.5 فقط به ChatGPT محدود نیست و OpenAI دو مدل جدید GPT-Image-2.5 Flare و Sunburst را نیز برای توسعهدهندگان عرضه کرده است.
Flare مدل سریعتر و انتخاب پیشفرض برای اکثر اپلیکیشنهاست. این مدل نسبت به GPT-Image-2 با تا ۵۰ درصد latency کمتر برای تولید سریع تصویر، محتوای شبکههای اجتماعی، Rapid Prototyping و تولید در حجم بالا مناسب است.
Sunburst برای Workflowهایی طراحی شده که کیفیت، Precision Editing و کنترل دقیقتر روی ویرایشها اهمیت بیشتری دارد؛ مانند تصاویر حرفهای محصول و Creativeهای نهایی کمپینهای تبلیغاتی.
مدل | مناسب برای |
|---|---|
Flare | سرعت، تولید انبوه، اپلیکیشنها و Rapid Prototyping |
Sunburst | Precision Editing، تصاویر حرفهای محصول و Creativeهای نهایی |
به زبان ساده، Flare برای سرعت و مقیاس مناسبتر است و Sunburst برای دقت و کنترل بیشتر روی خروجی.
۱۲. قیمت GPT-Image-2.5 Flare و Sunburst چقدر است؟
طبق مستندات فعلی OpenAI، قیمت Token در هر دو مدل Flare و Sunburst یکسان است:
نوع | قیمت در هر دو مدل |
|---|---|
Text Input / 1M tokens | $5 |
Cached Text Input / 1M | $1.25 |
Image Input / 1M | $8 |
Cached Image Input / 1M | $2 |
Image Output / 1M | $30 |
هر دو مدل از Qualityهای low، medium، high، xhigh، max و auto پشتیبانی میکنند و میتوانند Text و Image را بهعنوان ورودی دریافت کنند.
Model ID این دو مدل بهترتیب gpt-image-2.5-flare و gpt-image-2.5-sunburst است و Snapshot زمان عرضه نیز نسخه 2026-09-08 محسوب میشود. این اطلاعات بهخصوص برای توسعهدهندگانی که قصد استفاده از Images 2.5 در API یا مهاجرت از GPT-Image-2 را دارند، کاربردی است.
۱۳. ChatGPT Images 2.5 برای چه کسانی در دسترس است؟
Images 2.5 از ۸ سپتامبر ۲۰۲۶ در حال عرضه برای کاربران ChatGPT، ChatGPT Work و Codex در تمام Tierها روی Desktop، Mobile و Web است. اگر قصد استفاده از قابلیتهای جدید تصویرسازی ChatGPT را دارید، میتوانید با خرید اکانت ChatGPT از جیپیتییار به ChatGPT دسترسی داشته باشید.
مدلهای GPT-Image-2.5 Flare و Sunburst نیز در API در دسترس توسعهدهندگان قرار گرفتهاند. از آنجا که OpenAI از عبارت rolling out استفاده کرده، ممکن است زمان ظاهر شدن همه قابلیتهای جدید برای تمام حسابها یکسان نباشد.
OpenAI همچنین اعلام کرده محدودیتهای فعلی Image Generation تغییر نکردهاند؛ بنابراین عرضه Images 2.5 به معنی نامحدود شدن ساخت تصویر در همه پلنها نیست.
۱۴. امنیت تصاویر ساختهشده با Images 2.5
OpenAI میگوید Images 2.5 بر پایه Safeguardهای موجود این شرکت توسعه پیدا کرده و Promptها و تصاویر برای جلوگیری از تولید خروجیهای مضر بررسی میشوند.
OpenAI همچنین همچنان از C2PA Metadata و Invisible Watermarking برای کمک به شناسایی تصاویر ساختهشده با ابزارهای این شرکت استفاده میکند.
جمعبندی؛ مهمترین تغییر ChatGPT Images 2.5 چیست؟
مهمترین تغییر ChatGPT Images 2.5 را میتوان در یک کلمه خلاصه کرد: کنترل. مدل جدید تلاش میکند بهتر تشخیص دهد چه چیزی باید تغییر کند و چه بخشهایی باید دستنخورده باقی بمانند؛ موضوعی که در حفظ سوژههای مرجع، Precision Editing و ویرایشهای چندمرحلهای اهمیت زیادی دارد.
در کنار این پیشرفتها، قابلیتهایی مثل Sketch، Templates، Comment روی تصویر و اشتراک Prompt تجربه ساخت تصویر در ChatGPT را تعاملیتر کردهاند. تستهای GPTyar نیز نشان دادند Precision Editing و Multi-turn Editing در استفاده واقعی عملکرد قابلتوجهی دارند، هرچند ثبات کامل تمام جزئیات در چندین مرحله ویرایش همچنان تضمینشده نیست.




نظرات (0)
در حال بارگذاری نظرات...