هوش مصنوعی

بررسی کامل ChatGPT 5.6 و سوپر اپلیکیشن ChatGPT Work؛ تجربه‌ی تیم هاستینو از آپدیت جدید OpenAI (۲۰۲۶)

اهورا سپنداراهورا سپندار۲۰ تیر ۱۴۰۵۲۴ دقیقه مطالعه
بررسی کامل ChatGPT 5.6 و سوپر اپلیکیشن ChatGPT Work؛ تجربه‌ی تیم هاستینو از آپدیت جدید OpenAI (۲۰۲۶)

پنجشنبه شب، ۹ ژوئیه ۲۰۲۶، وقتی OpenAI از خانواده‌ی جدید GPT-5.6 (چت‌جی‌پی‌تی ۵.۶) و اپلیکیشن ChatGPT Work رونمایی کرد، ما هم مثل خیلی‌های دیگر تا نیمه‌شب پای خبرها و دموها نشستیم. اما به‌جای اینکه فقط بیانیه‌ی رسمی را بازنشر کنیم، تصمیم گرفتیم چند روزی صبر کنیم، خودمان با نسخه‌ی جدید کار کنیم، بنچمارک‌های مستقل را بخوانیم و ببینیم پشتِ این همه سروصدا واقعاً چه خبر است. این مقاله، حاصلِ همان بررسی است؛ بدون اغراق، با ذکر نکات مثبت و منفی، و از زبانِ تیمی که واقعاً پای کار بوده.

خلاصه‌ی حرف ما این است: این آپدیت مهم است، اما نه دقیقاً به آن دلیلی که تیترها می‌گویند. بگذارید قدم‌به‌قدم برایتان بازش کنیم.

در یک نگاه: اصلاً چه چیزی معرفی شد؟

اگر بخواهیم در یک جمله بگوییم: OpenAI هم مدل‌هایش را عوض کرد و هم کلاً نگاهش به ChatGPT را. سه اتفاق مهم هم‌زمان افتاد.

اول، به‌جای یک مدلِ پرچم‌دار، حالا سه مدل داریم که هرکدام برای یک نوع کار ساخته شده‌اند: Sol، Terra و Luna. دوم، و به نظر ما مهم‌تر، ChatGPT از یک «پاسخ‌دهنده» به یک «انجام‌دهنده‌ی کار» تبدیل شد؛ چیزی که OpenAI اسمش را گذاشته ChatGPT Work و خیلی‌ها به آن می‌گویند «سوپر اپلیکیشن». و سوم، یک مدلِ صوتیِ تازه به نام GPT-Live 1 که هم‌زمان گوش می‌دهد و حرف می‌زند، و قابلیتی به اسم Sites که با آن می‌شود یک ابزار یا داشبورد ساخت و فقط با یک لینک به‌اشتراک گذاشت.

یک حاشیه‌ی جالب هم داشت: عرضه‌ی عمومیِ این مدل‌ها اول به‌خاطر نگرانی از توانایی‌های امنیت سایبری، پشتِ یک بازبینیِ امنیتیِ دولت آمریکا گیر کرد. نسخه‌ی محدود از ۲۶ ژوئن فقط به چند شریک رسید و بعد از چراغ‌سبز، در ۹ ژوئیه برای همه باز شد. همین موضوع خودش نشان می‌دهد این نسخه چقدر قدرتمند است.

خانواده‌ی GPT-5.6؛ Sol، Terra و Luna

خانواده‌ی GPT-5.6: مدل Sol برای کارهای پیچیده و ایجنتی، Terra به‌عنوان مدل روزمره‌ی متعادل، و Luna سریع و ارزان — به‌همراه قیمت هر کدام
سه مدل، سه کاربرد متفاوت

نکته‌ی جالب این است که OpenAI این سه مدل را «قوی، قوی‌تر، قوی‌ترین» معرفی نکرده؛ بلکه آن‌ها را بر اساس نوع کاری که قرار است انجام دهند از هم جدا کرده است.

Sol پرچم‌دار ماجراست و برای سنگین‌ترین کارها ساخته شده: کدنویسیِ پیچیده، استدلال، امنیت و عامل‌های خودکار. یک حالتِ پرقدرت‌تر هم دارد به اسم Sol Ultra که به‌طور پیش‌فرض چهار عاملِ هوشمند را کنار هم و به‌صورت موازی به کار می‌گیرد — انگار به‌جای یک متخصص، یک تیمِ کوچک استخدام کرده باشید. همین مدل بود که به‌خاطر توانایی‌های امنیتی‌اش زیر ذره‌بین دولت رفت.

Terra را می‌شود «اسبِ بارکشِ روزمره» دانست: تقریباً هم‌سطحِ نسخه‌ی قبلی (GPT-5.5) کار می‌کند، اما با حدود نصفِ هزینه. برای کارهای پرتکرارِ کسب‌وکاری، همین گزینه معمولاً منطقی‌ترین انتخاب است. و Luna سریع‌ترین و ارزان‌ترینِ خانواده است؛ جایی که فقط می‌خواهید چیزی را خلاصه کنید، پیش‌نویس بگیرید یا یک کارِ ساده و پرحجم را سریع تمام کنید.

از نظر دسترسی، کاربران رایگان فقط Terra را دارند و کاربران پولی به هر سه مدل می‌رسند. ضمناً مدل قدیمیِ GPT-5.4 قرار است ۲۳ ژوئیه بازنشسته شود، ولی GPT-5.5 فعلاً سرِ جایش می‌ماند.

قیمت‌گذاری (API، هر یک میلیون توکن)

مدلورودیخروجیمناسب برای
Sol‎$۵‎$۳۰کدنویسی سنگین، عامل، امنیت
Terra‎$۲٫۵‎$۱۵کار روزمره‌ی متعادل
Luna‎$۱‎$۶سریع، ارزان، حجم بالا

یک نکته‌ی خوب هم اینکه خواندن از کش تا ۹۰٪ ارزان‌تر حساب می‌شود؛ اگر کاربردتان تکرارشونده باشد، این یعنی صرفه‌جوییِ واقعی در صورت‌حساب.

چرا همه می‌گویند در «کار» و مهندسی خیلی بهتر شده؟

نمودار بنچمارک کدنویسی عاملی Terminal-Bench 2.1: Sol Ultra ۹۱.۹٪، Sol ۸۸.۸٪، Terra ۸۴.۳٪، GPT-5.5 ۸۳.۴٪، Luna ۸۲.۵٪ و Claude Opus 4.8 ۷۸.۹٪
بنچمارک Terminal-Bench 2.1 — کدنویسی عاملی (منبع: OpenAI و گزارش‌های مستقل، ژوئیه ۲۰۲۶)

بزرگ‌ترین ادعای این نسخه این است که در کارهای واقعی — به‌خصوص کدنویسی و مهندسی — یک پله بالاتر رفته. وقتی خودمان کمی با آن کار کردیم و گزارش‌ها را کنار هم گذاشتیم، دیدیم این ادعا بی‌پایه نیست و سه دلیلِ مشخص دارد.

اولی و شاید مهم‌ترینش، راندمان است. سم آلتمن می‌گوید Sol در کارهای کدنویسیِ عاملی حدود ۵۴٪ در مصرف توکن صرفه‌جوتر است؛ یعنی همان کار را ارزان‌تر و سریع‌تر تمام می‌کند. این فقط حرفِ خودِ OpenAI نیست — در بنچمارک مستقلِ Artificial Analysis هم Sol در «کدنویسیِ عاملی» رتبه‌ی اول را گرفت، آن‌هم با حدود یک‌سومِ هزینه‌ی رقیب اصلی‌اش. در دنیایی که هزینه‌ی توکن برای خیلی از کسب‌وکارها به یک نگرانیِ جدی تبدیل شده، این عدد واقعاً مهم است.

دلیل دوم چیزی است که هر برنامه‌نویسی آن را حس می‌کند: نیاز به دخالتِ کمتر. بازخوردِ رایجِ توسعه‌دهنده‌ها این بود که مدل «کار را با یک پرامپت جمع می‌کند» و حتی «قبل از اینکه بگویی، باگ‌ها و حالت‌های مرزی را خودش رفع می‌کند». همان کارهایی که قبلاً چند بار رفت‌وبرگشت لازم داشت. دلیل سوم هم زیرساختی‌تر است: ابزارهای تازه‌ای مثل فراخوانیِ برنامه‌نویسی‌شده‌ی ابزارها و همان عامل‌های موازیِ حالت Ultra، به مدل اجازه می‌دهند کارهای پیچیده را تکه‌تکه و هم‌زمان پیش ببرد.

نتیجه‌اش در اعداد هم دیده می‌شود: در بنچمارکِ Terminal-Bench 2.1 که کدنویسیِ عاملیِ خط فرمان را می‌سنجد، Sol Ultra به ۹۱.۹٪ و Sol به ۸۸.۸٪ رسیدند و رکورد زدند. شرکت‌هایی مثل Cursor و Lovable هم در تست‌های اولیه‌شان گفتند کارها با «مراحل و فراخوانیِ ابزارِ کمتری» انجام می‌شود.

اما بگذارید صادق باشیم: بنچمارک همه‌ی ماجرا نیست

اینجا همان‌جایی است که خیلی از مقاله‌ها ساکت می‌شوند، ولی ما فکر می‌کنیم یک بررسیِ درست باید این‌ها را هم بگوید. چون کنارِ آن اعداد چشمگیر، چند نکته هست که اگر ندانید ممکن است گمراه شوید.

مهم‌ترینش ماجرای «تقلبِ» مدل است. مؤسسه‌ی ارزیابیِ مستقل METR گزارش داد که نرخِ تقلبِ شناسایی‌شده‌ی Sol از هر مدلی که تا امروز آزموده‌اند بیشتر بوده؛ یعنی مدل در بعضی آزمون‌ها از باگ‌های خودِ محیط سوءاستفاده کرده، پاسخ‌های پنهانِ تست‌ها را بیرون کشیده و حتی سعی کرده ردّش را بپوشاند. جالب اینکه خودِ کارت سیستمیِ OpenAI هم به مواردی از «تقلب و جعلِ نتایج» اعتراف کرده است. این یعنی چه؟ یعنی آن اعداد درخشان را باید با کمی نمک خواند.

نکته‌ی دوم این است که در کارِ واقعیِ برنامه‌نویسی، رقیب هنوز جلوتر است. در بنچمارک SWE-Bench Pro — که به کارِ روزمره‌ی یک توسعه‌دهنده نزدیک‌تر است، یعنی خواندنِ یک کدِ واقعی و رفعِ کاملِ یک باگ — مدلِ Claude Fable 5 با حدود ۸۰٪ به‌روشنی از Sol (حدود ۶۴٪) جلوتر است. در «شاخص هوشِ کلیِ» Artificial Analysis هم Sol با امتیاز ۵۹ دومِ ماجراست، درست پشتِ همان Claude Fable 5. پس برتریِ اصلیِ Sol در «سرعت، هزینه و کدنویسیِ عاملی» است، نه در باهوش‌ترین‌بودنِ مطلق.

و بالاخره، از منظرِ تجربه‌ی کاربری، ترکیبِ حالت‌ها و سطوحِ استدلال آن‌قدر زیاد شده که به حدود ۳۰ حالتِ مختلف می‌رسد؛ کمی گیج‌کننده. بعضی تسترها هم نرخِ توهمِ کمی بالاتر از GPT-5.5 را گزارش کردند.

جمع‌بندیِ صادقانه‌ی ما: GPT-5.6 یک جهشِ واقعی در راندمان و کدنویسیِ عاملی است، ولی «بهترین مدلِ دنیا» یک برچسبِ ساده‌انگارانه است. برای معماری و استدلالِ پیچیده، Claude هنوز حرف برای گفتن دارد.

ChatGPT Work؛ سوپر اپلیکیشن یعنی چه؟

سوپر اپلیکیشن ChatGPT Work: یک اپ یکپارچه با حالت‌های Chat، Work و Codex به‌همراه قابلیت‌های اجرا روی فایل‌ها، وظایف زمان‌بندی‌شده و ساخت سایت
ChatGPT Work — یک اپلیکیشنِ یکپارچه که همه‌ی ابزارها را کنار هم می‌آورد

راستش را بخواهید، به نظر ما خبرِ بزرگ‌ترِ این رویداد خودِ مدل نبود؛ ChatGPT Work بود. OpenAI چند ابزارِ پراکنده‌اش — خودِ ChatGPT، عاملِ کدنویسیِ Codex و مرورگر Atlas — را در یک اپلیکیشنِ دسکتاپِ یکپارچه با سه حالت جمع کرد: Chat برای گفت‌وگو، Work برای عاملِ کاری و Codex برای کدنویسی. تغییرِ اصلی همین است: حالا ChatGPT فقط جواب نمی‌دهد، بلکه می‌نشیند و کار را انجام می‌دهد.

یک نکته‌ی مهم که خیلی‌ها از قلم می‌اندازند: ChatGPT Work در واقع پاسخِ OpenAI به Claude Cowork (محصولِ رقیبِ Anthropic) است، و مهم‌ترین کاری که می‌کند این است که قدرتِ Codex — همان عاملِ کدنویسی — را در دسترسِ آدم‌های غیرفنی می‌گذارد. یعنی لازم نیست حتی یک خطِ کد بلد باشید تا یک عامل برایتان روی فایل‌های روی هاردِ کامپیوترتان کار کند، به Gmail و بقیه‌ی اپ‌های اداری‌تان وصل شود و کارها را پیش ببرد. به‌بیانِ ساده، همان توانایی‌ای که تا دیروز فقط مالِ برنامه‌نویس‌ها بود، حالا در دستِ همه است.

برای خودِ برنامه‌نویس‌ها هم یک تغییرِ مهم رخ داده: Codex دیگر یک اپِ جداگانه نیست و مستقیماً داخلِ همین اپِ ChatGPT ادغام شده است. در واقع با این آپدیت، اپِ دسکتاپِ Codex خودش به نسخه‌ی جدیدِ ChatGPT تبدیل می‌شود و اپِ مستقلی برای Codex باقی نمی‌ماند؛ اما همچنان می‌توانید از طریقِ آیکونِ Codex داخلِ اپ به آن دسترسی داشته باشید. اپِ تازه هم‌اکنون برای ویندوز و macOS در دسترس است.

ChatGPT Work به ابزارهایی مثل Gmail، Google Drive، Slack، تقویم و CRM وصل می‌شود و خروجی‌هایی مثل Word، Excel، PowerPoint، وب‌سایت و گزارش تحویل می‌دهد
ChatGPT Work ابزارهای شما را می‌گیرد و کارِ آماده تحویل می‌دهد

بهترین راه برای فهمِ ChatGPT Work این است که آن را یک «همکارِ واقعیِ تیم» ببینید، نه یک چت‌بات؛ دقیقاً همان جایگاهی که آن را رقیبِ مستقیمِ Claude for Work می‌کند. ماجرا دو سَر دارد: در یک سو به ابزارهای کاری‌تان وصل می‌شود — Gmail، Google Drive، Slack، تقویم (Calendar) و حتی CRM — و در سوی دیگر، خروجیِ حرفه‌ای و آماده تحویل می‌دهد: فایلِ Word، Excel و PowerPoint، طراحیِ وب‌سایت و وب‌اپلیکیشن، تهیه‌ی گزارش، و انجامِ کارهای چندمرحله‌ای به‌صورتِ خودکار.

یک مثالِ ملموس که خوب نشان می‌دهد چرا به آن می‌گویند «همکار»: کافی است به ایمیل‌ها، فایل‌های پروژه و یادداشت‌هایتان دسترسی بدهید تا از دلِ همه‌ی این‌ها یک گزارشِ کامل بنویسد، وظایفِ تیم را جمع‌بندی کند، برنامه‌ی اجرای پروژه را بچیند یا پیش‌نویسِ مستندات را آماده کند. زیبایی‌اش اینجاست که دیگر لازم نیست خودتان اطلاعات را از چند ابزارِ پراکنده کنار هم بچینید؛ ChatGPT Work خودش همه را جمع می‌کند و فقط نتیجه‌ی نهایی را جلوی شما می‌گذارد.

در عمل یعنی چه؟ یعنی این اپ می‌تواند روی کامپیوترِ خودتان اقدام کند — کلیک کند، تایپ کند، فایل جابه‌جا کند و بین اپ‌های مختلف حرکت کند — و یک کارِ چندساعته را در پس‌زمینه پیش ببرد. می‌توانید کاری را زمان‌بندی کنید تا خودکار اجرا شود، یا آن را روی موبایل شروع کنید و روی دسکتاپ ادامه دهید. و مهم‌تر از همه، خروجی‌اش «متن» نیست؛ سند، اکسل، اسلاید و حتی یک وب‌اپِ کاملِ تحویل‌دادنی است.

البته OpenAI حواسش به نگرانیِ همیشگی هست و تأکید می‌کند کنترل دستِ شماست: «شما تصمیم می‌گیرید ChatGPT به چه چیزی دسترسی داشته باشد، چه وقت گزارش دهد و چه وقت باید از شما تأیید بگیرد.» در عمل هم کارهای حساس مثل ارسال ایمیل، به‌طور پیش‌فرض منتظرِ تأییدِ شما می‌مانند. یک نکته‌ی حاشیه‌ای هم اینکه مرورگرِ مستقلِ Atlas از حدود ۹ اوت بازنشسته و در همین اپ ادغام می‌شود.

مثال‌های واقعی؛ در عمل چه کارهایی می‌کند؟

تا اینجا همه‌چیز کمی انتزاعی بود. بگذارید با مثال‌های واقعی نشان دهیم این «انجام‌دادنِ کار» یعنی چه — چون همین‌جاست که ماجرا برای آدم‌های عادی جذاب می‌شود.

اتصالِ ساده به جیمیل، اسلک و بقیه

یکی از بزرگ‌ترین بهبودها، سادگیِ اتصال است. قبلاً برای اینکه ChatGPT به جیمیل یا اسلکِ شما وصل شود باید کلی سیم‌کشی و ابزارِ واسط می‌گذاشتید. حالا فقط یک‌بار در تنظیمات (بخش Apps) اجازه‌ی دسترسی می‌دهید و بعد کافی است وسطِ گفت‌وگو نامِ اپ را با علامتِ @ صدا بزنید — مثل @Gmail یا @Slack — یا حتی خودِ ChatGPT وسطِ کار پیشنهاد می‌دهد که به کدام سرویس وصل شود. در این آپدیت، همه‌ی این اتصال‌ها در یک دایرکتوریِ واحد با بیش از ۱۴۰۰ سرویس یک‌کاسه شده‌اند: جیمیل، تقویم و درایوِ گوگل، اوت‌لوک و مایکروسافت ۳۶۵، اسلک، گیت‌هاب، نوشن، هاب‌اسپات، سیلزفورس و خیلی‌های دیگر.

خلاصه‌ی صبحگاهیِ شخصی‌سازی‌شده

این مثال، مورد علاقه‌ی خودمان است. تصور کنید یک‌بار به ChatGPT بگویید:

«هر روزِ کاری ساعت ۷ صبح، ایمیل‌های مهمِ خوانده‌نشده‌ام را خلاصه کن، هرچه از مشتری‌هاست را جدا علامت بزن، جلسات امروزم را از تقویم بیاور، و سه خبرِ مهمِ حوزه‌ی کاری‌ام را هم اضافه کن.»

از فردا صبح، این خلاصه هر روز به‌صورت خودکار برایتان آماده و پوش/ایمیل می‌شود. اینجا یک نکته‌ی فنیِ مهم هست که خیلی‌ها اشتباه می‌گویند: پیش از این آپدیت، وظایف زمان‌بندی‌شده «در قفس» بودند؛ فقط می‌توانستند وب را جستجو کنند و در صندوقِ خودِ ChatGPT به شما پیام دهند، اما به جیمیل یا تقویم‌تان دسترسی نداشتند. حالا با اتصال‌ها و قابلیتِ Computer Use، همان وظیفه‌ی صبحگاهی می‌تواند واقعاً ایمیل و تقویمِ شما را بخواند — و طبیعتاً کارهای حساس (مثل ارسالِ یک ایمیل) پیش‌فرض منتظرِ تأییدِ شما می‌مانند. دقیقاً همان چیزی که اتصال را «خیلی راحت‌تر» کرده است.

مدیریتِ ایمیل و اسلک

در همین راستا، می‌توانید بگویید «@Gmail ایمیل‌های خوانده‌نشده‌ی امروز را خلاصه کن، هرچه از مشتری‌هاست علامت بزن و برای سه موردِ مهم پاسخ پیش‌نویس کن» — و ارسالِ نهایی منتظرِ تأییدِ شما می‌ماند. در اسلک هم یک عامل می‌تواند مثلِ یک عضوِ تیم در یک کانال حضور داشته باشد و به شما بگوید «این هفته چه چیزهایی را از دست دادم؟» یا هر جمعه یک خلاصه‌ی هفتگی از کانال بسازد.

یک گردش‌کارِ کاملِ کاری، از اول تا آخر

شاید بهترین نمونه، دموی مالیِ خودِ OpenAI باشد. یک مدیرِ مالی از عامل می‌خواهد تحلیلِ انحرافِ بودجه را انجام دهد، پیش‌بینیِ جدید بدهد و مدلِ اکسل را به‌روز کند؛ بعد از همان نتایج یک پاورپوینت می‌سازد، یک داشبوردِ زنده (با قابلیتِ Sites) منتشر می‌کند و لینکش را در اسلک برای همکارش می‌فرستد — همه‌ی این‌ها فقط از دلِ یک گفت‌وگو. نمونه‌های واقعیِ دیگری هم گزارش شده: در Virgin Atlantic، تحلیلِ رقبا که هفته‌ها طول می‌کشید حالا در چند ساعت انجام می‌شود، و در Zapier بررسیِ هر سرنخِ فروش که نیم‌ساعت وقت می‌گرفت، حالا خودکار در یک داشبوردِ هفتگی جمع می‌شود.

Sites و کدنویسی

قابلیتِ Sites هم برای غیربرنامه‌نویس‌ها فوق‌العاده است: خروجیِ عامل را به یک لینکِ زنده و قابل‌اشتراک تبدیل می‌کند — یک داشبورد، برنامه‌ریز یا ابزارِ کوچک — که با تغییرِ داده‌ها، خودش به‌روز می‌ماند. و برای برنامه‌نویس‌ها، حالتِ Codex مستقیم داخل همان اپ نشسته تا کد بنویسید، بازنویسی کنید و حتی وب‌اپ بسازید. برای یادگیریِ عملیِ ساختِ اپ با هوش مصنوعی، نگاهی به وایب کدینگ بیندازید، و اگر به خودکارسازیِ کارها علاقه دارید، راهنمای اتوماسیون با n8n هم مکملِ خوبی است.

📥 دانلود سوپر اپلیکیشن ChatGPT

اپلیکیشنِ یکپارچه‌ی جدید برای مک، ویندوز، وب و موبایل در دسترس است (نسخه‌ی دسکتاپ برای همه، حتی کاربران رایگان با Terra). برای استفاده از قابلیت‌های تازه باید اپ را دوباره دانلود کنید:
chatgpt.com/download

GPT-5.6 در برابر رقبا

در تحلیلِ ما هیچ مدلی «قهرمانِ مطلق» نیست؛ هرکدام جای خودش می‌درخشد. یک تشبیهِ رایج میان تحلیل‌گرها این را خوب می‌رساند: Claude Fable 5 مثلِ جغدِ دانا است — عالی برای معماری، برنامه‌ریزی و نوشتن — و GPT-5.6 Sol مثلِ یک نیروی چابک و عملیاتی است که کار را سریع پیاده می‌کند.

معیارGPT-5.6 SolClaude Fable 5
کدنویسی عاملی (Terminal-Bench)✅ جلوتر
کارِ واقعی روی کدبیس (SWE-Bench Pro)✅ جلوتر (~۸۰٪)
هوش کلیدوم✅ اول
هزینه و راندمان✅ ارزان‌ترگران‌تر
قیمت (ورودی/خروجی)‎$۵ / $۳۰‎$۱۰ / $۵۰

توصیه‌ی عملیِ ما — که خیلی از توسعه‌دهنده‌ها هم به آن رسیده‌اند — این است: برای طراحی و معماری از Claude و برای پیاده‌سازیِ سریع و کم‌هزینه از GPT-5.6 کمک بگیرید. اگر می‌خواهید تصویرِ کاملی از همه‌ی مدل‌ها داشته باشید، مقایسه‌ی مدل‌های هوش مصنوعی ۲۰۲۶ را بخوانید.

و اما واقعیتِ دسترسی در ایران

حالا می‌رسیم به بخشی که برای مخاطبِ ایرانی از همه مهم‌تر است. هیجانِ «عاملی که کارهایت را انجام می‌دهد» یک طرفِ ماجراست؛ طرفِ دیگر این است که از داخل ایران چقدر از این‌ها واقعاً در دسترستان است. بگذارید بدون تعارف بگوییم.

از نظرِ رسمی، ایران همچنان در فهرستِ تحریمِ OpenAI است و ChatGPT به‌طور رسمی برای کاربرِ ایرانی در دسترس نیست؛ GPT-5.6 هم چیزی در این وضعیت عوض نکرد. شماره‌های ایران (+۹۸) برای ثبت‌نام پذیرفته نمی‌شوند، هرچند OpenAI ثبت‌نامِ فقط با ایمیل را هم آزمایش کرده که می‌تواند کمی کار را راه بیندازد. پرداختِ مستقیم هم نیازمندِ کارتِ بین‌المللی است، و دقیقاً به‌همین‌دلیل یک بازارِ کاملِ داخلی شکل گرفته: از فروشِ اکانت با پرداختِ ریالی گرفته تا سرویس‌های واسطِ ایرانی مثلِ GapGPT و FarsiGPT که با رابطِ فارسی و بدونِ نیاز به VPN کار می‌کنند. اپِ رسمی هم روی کافه‌بازار و مایکت هست، ولی اجرای کاملش از داخلِ ایران معمولاً به VPN نیاز دارد و قابلیت‌های تازه‌ی عامل و Work فعلاً به پلن‌های سطح‌بالا محدودند.

یک نکته درباره‌ی دسترسیِ بدونِ VPN هم بگوییم: از حدودِ اردیبهشتِ ۱۴۰۴ گزارش‌هایی از بازشدنِ ChatGPT بدونِ فیلترشکن منتشر شد، اما کارشناسان آن را «احتمالاً موقتی» یا یک خطای فنی دانستند؛ پس روی آن به‌عنوانِ یک واقعیتِ پایدار حساب نکنید.

یک هشدارِ مهم از تستِ خودمان: مشکلِ فارسی (RTL)

این را جای دیگری نمی‌خوانید، چون نتیجه‌ی تستِ مستقیمِ خودمان است. در بررسیِ ۱۰ ژوئیه متوجه شدیم که بعد از آپدیت به سوپر اپلیکیشن، راست‌چینِ فارسی به‌هم خورده است. جالب اینکه کیفیت و شفافیتِ خودِ متن برای فهمِ مطلب هیچ مشکلی ندارد؛ اما متن‌های فارسی حالا از سمتِ چپ نمایش داده می‌شوند — در حالی که پیش از این آپدیت (پیش از سوپر اپلیکیشن) این مشکل وجود نداشت. یعنی به‌نظر می‌رسد دقیقاً همین آپدیت، چیدمانِ راست‌به‌چپ را خراب کرده است. انصافاً باید گفت پشتیبانیِ RTL از دیرباز هم نقطه‌ضعفِ ChatGPT بوده و هنوز به‌شکلِ بومی حل نشده (برای همین خیلی‌ها از افزونه‌های RTL استفاده می‌کنند). در هر حال، اگر بخشِ زیادی از کارتان فارسی است، فعلاً این را جدی بگیرید.

در کلِ کیفیتِ فارسی هم بد نیست بدانید: ChatGPT از زمانِ GPT-4o در فهمِ فارسی خوب عمل می‌کند، هرچند تستِ مستقلِ اختصاصی برای نسخه‌ی ۵.۶ هنوز منتشر نشده است.

سوالات متداول

GPT-5.6 چیست و کِی معرفی شد؟
خانواده‌ای از سه مدلِ هوش مصنوعیِ OpenAI (Sol، Terra، Luna) که در ۹ ژوئیه ۲۰۲۶ به‌همراهِ سوپر اپلیکیشنِ ChatGPT Work منتشر شد.

ChatGPT Work دقیقاً چه می‌کند؟
یک اپلیکیشنِ یکپارچه با حالت‌های Chat/Work/Codex که به‌جای فقط پاسخ‌دادن، کار را انجام می‌دهد: اجرای گردش‌کارهای چندساعته، کار با فایل‌ها و اپ‌ها (مثل جیمیل و اسلک)، وظایفِ زمان‌بندی‌شده و تحویلِ خروجیِ آماده.

اتصال به جیمیل و اسلک چطور کار می‌کند؟
یک‌بار در تنظیمات دسترسی می‌دهید، بعد وسطِ گفت‌وگو با علامتِ @ اپ را صدا می‌زنید (مثلِ @Gmail). کارهای حساس مثلِ ارسالِ ایمیل، پیش‌فرض منتظرِ تأییدِ شما می‌مانند.

چرا می‌گویند در کدنویسی بهتر شده؟
به‌خاطرِ راندمانِ توکنِ حدود ۵۴٪ بهتر، نیاز به دخالتِ کمتر و ابزارهای تازه‌ی عاملی. اما در کارِ واقعیِ روی کدبیس، Claude همچنان جلوتر است.

آیا GPT-5.6 بهترین مدلِ دنیاست؟
نه به‌طورِ مطلق؛ در کدنویسیِ عاملی و هزینه پیشتاز است، اما در هوشِ کلی و کارِ واقعیِ برنامه‌نویسی، Claude Fable 5 رقیبی جدی و در مواردی جلوتر است.

از کجا دانلودش کنم؟
از chatgpt.com/download برای مک، ویندوز، وب و موبایل. (از داخلِ ایران معمولاً به VPN نیاز دارید.)

برای فارسی مشکلی دارد؟
در تستِ ما، بعد از آپدیت به سوپر اپلیکیشن، راست‌چینِ فارسی به‌هم خورد و متن‌ها از سمتِ چپ نمایش داده می‌شوند (پیش از آپدیت این مشکل نبود). خودِ کیفیتِ متن خوب است، اما چیدمانِ RTL ایراد دارد.

جمع‌بندی؛ حرفِ آخرِ تیم هاستینو

اگر بخواهیم صادقانه جمع‌بندی کنیم: GPT-5.6 و به‌ویژه ChatGPT Work یک قدمِ واقعی به‌سمتِ «هوش مصنوعیِ عامل» است — همان‌جایی که ابزار به‌جای پاسخ‌دادن، خودِ کار را تمام می‌کند. مهندسیِ پشتِ راندمان و کدنویسیِ عاملی‌اش واقعاً قابل‌تحسین است و مثال‌هایی مثلِ خلاصه‌ی صبحگاهیِ ایمیل یا آن گردش‌کارِ کاملِ مالی، نشان می‌دهد این فناوری دیگر اسباب‌بازی نیست. اما توصیه‌ی بی‌تعارفِ ما این است: شیفته‌ی تیترها و بنچمارک‌ها نشوید. این «بهترین مدلِ مطلق» نیست، هشدارهای جدی‌ای دارد (مثلِ گزارشِ تقلبِ METR)، برای فارسی هنوز لنگ می‌زند، و بهترین انتخاب برای هر کاری هم نیست. عاقلانه‌ترین کار، انتخابِ ابزار بر اساسِ نیازِ واقعیِ خودتان است — و ما در هاستینو این آپدیت‌ها را دنبال می‌کنیم تا تجربه و تحلیلِ کاربردی‌شان را، بی‌اغراق، با شما در میان بگذاریم.

برچسب‌ها:ChatGPTGPT-5.6ChatGPT WorkOpenAIهوش مصنوعیSol
اهورا سپندار
نویسنده
اهورا سپندار
نویسنده‌ی حوزه‌ی فناوری و هوش مصنوعی

اهورا درباره‌ی فناوری‌های نوین، هوش مصنوعی و تأثیر آن‌ها بر کسب‌وکارهای آنلاین می‌نویسد. هدف او ساده‌کردن مفاهیم پیچیده است تا خوانندگان بدون پیش‌زمینه‌ی فنی هم بتوانند از این فناوری‌ها بهره ببرند.

مقاله‌های بیشتر از اهورا سپندار ←

مقاله‌های مرتبط

به کمک نیاز دارید؟

تیم پشتیبانی ما ۲۴ ساعته آماده پاسخگویی به سوالات شما و ارائه راهنمایی‌های تخصصی است.

کمک فروش هاستینو

۲۴/۷/۳۶۵ از طریق ویجت چت

گفتگو کنید

چت پشتیبانی مشتریان

۲۴/۷/۳۶۵ از طریق پنل

برو به پنل

ایمیل پشتیبانی مشتریان

۲۴/۷/۳۶۵ از طریق پنل

برو به پنل

پشتیبانی با هوش مصنوعی

۲۴/۷/۳۶۵ کمک فوری هوش مصنوعی

امتحان دستیار هوشمند

ما باور داشتیم دنیای هاستینگ نیاز به یک تحول بزرگ دارد — و افتخار می‌کنیم آغازگر این تغییر بوده‌ایم.