شرکت OpenAI با معرفی حالت تازهای به نام Ultrafast، مدل پرچمدار خود GPT-5.6 Sol را با کمک زیرساخت تراشهای Cerebras تا ۱۴ برابر سریعتر کرده است؛ جهشی که میتواند معادلات رقابت هوش مصنوعی را در حوزهی سرعت پاسخگویی دگرگون کند.

لیست مطالب
۱. یک اعلامیهی کوتاه که همهچیز را تغییر داد
شرکت OpenAI پنجشنبه ۱۳ اوت با انتشار پستی کوتاه در وبسایت رسمی خود، حالت جدیدی به نام Ultrafast را معرفی کرد. هدف این حالت ساده اما بلندپروازانه است: رساندن مدل قدرتمند GPT-5.6 Sol به سرعتی که تا امروز فقط مدلهای کوچک و سبکوزن میتوانستند به آن برسند. طبق اعلام رسمی، این مدل در حالت Ultrafast تا ۱۴ برابر سریعتر از نسخهی استاندارد کار میکند و میتواند تا ۷۵۰ توکن در هر ثانیه تولید کند.
این رقم برای بسیاری از توسعهدهندگانی که سالها با تأخیر پاسخگویی مدلهای زبانی بزرگ دستوپنجه نرم کردهاند، عددی چشمگیر است. برای آشنایی بیشتر با ماهیت اینگونه فناوریها میتوانید سری آموزشهای آموزشهای ChatGPT در سایت را دنبال کنید.
واکنش نخستین کاربران و توسعهدهندگانی که به نسخهی پیشنمایش این سرویس دسترسی داشتهاند نیز عمدتاً مثبت بوده است. در انجمن رسمی توسعهدهندگان OpenAI، بسیاری از کاربران به کاهش محسوس زمان انتظار در پاسخهای چندمرحلهای اشاره کردهاند؛ ویژگیای که تا پیش از این تنها با کاهش کیفیت مدل قابل دستیابی بود. همین بازخوردهای اولیه نشان میدهد که OpenAI به دنبال جایگاهی تازه در بازار است: نه صرفاً «باهوشترین مدل»، بلکه «باهوشترین مدلی که کندتر از رقبا نیست».
۲. حالت Ultrafast دقیقاً چیست؟
Ultrafast یک لایهی سرویس تازه در API اوپنایآی است، نه یک مدل کاملاً جدید. به بیان ساده، همان مدل GPT-5.6 Sol با همان سطح هوش و توان استدلال، اینبار روی زیرساخت پردازشی متفاوتی اجرا میشود که تأخیر پاسخگویی را به شکل چشمگیری کاهش میدهد. تا پیش از این، توسعهدهندگانی که به سرعت بالا نیاز داشتند معمولاً مجبور بودند از مدلهای کوچکتر و کمتوانتر استفاده کنند و بخشی از کیفیت پاسخ را فدای سرعت کنند. Ultrafast قرار است دقیقاً همین مصالحهی قدیمی را کنار بزند.
به گفتهی OpenAI، «تا امروز رسیدن به سرعت واقعی معمولاً به معنای انتخاب یک مدل کوچکتر یا تخصصیتر بود.» این جمله بهخوبی نشان میدهد که استراتژی این شرکت، حفظ هوش سطح فرانتیر در کنار سرعتی نزدیک به مدلهای سبک است.
نکتهی مهم دیگر این است که Ultrafast یک محصول جداگانه یا مدل موازی نیست؛ بلکه یک «حالت اجرا» برای همان GPT-5.6 Sol محسوب میشود. این رویکرد به توسعهدهندگان اجازه میدهد بدون تغییر در منطق برنامه یا بازنویسی پرامپتها، تنها با تغییر پارامتر سرویس، از حالت استاندارد به حالت پرسرعت سوییچ کنند؛ چیزی که پیادهسازی آن را برای تیمهای فنی بهشدت ساده میکند.
۳. GPT-5.6 Sol؛ مدلی که موتور این جهش شد
GPT-5.6 Sol یکی از تازهترین اعضای خانوادهی مدلهای GPT-5.6 است که پیشتر با تمرکز بر توان استدلال و کدنویسی معرفی شده بود. حالا همین مدل با فعالسازی حالت Ultrafast، همزمان توان بالا و سرعت پاسخگویی را به نمایش میگذارد. کاربرانی که پیشتر با نسخههای استاندارد این خانواده کار کردهاند و میخواهند تفاوت عملکرد مدلهای مختلف را بهتر بشناسند، میتوانند مقالهی OpenAI چیست و چه میکند؟ را در سایت مطالعه کنند.
۴. راز فنی پشت پرده: مشارکت دهمیلیارد دلاری با Cerebras
موتور اصلی این جهش سرعت، همکاری چندساله و دهمیلیارد دلاری OpenAI با شرکت تراشهسازی آمریکایی Cerebras است. برخلاف پردازندههای گرافیکی رایج که پردازش یک مدل بزرگ را میان دهها یا صدها تراشهی جداگانه تقسیم میکنند و بخش زیادی از زمان صرف انتقال داده میان این تراشهها میشود، معماری «ویفر-مقیاس» Cerebras امکان اجرای مدل روی یک تراشهی یکپارچه و بسیار بزرگ را فراهم میکند.
همین ویژگی باعث میشود تأخیر ارتباطی میان اجزای پردازشی تقریباً حذف شود و مدل بتواند با سرعتی بسیار بالاتر از حالت معمول، توکن تولید کند. به بیان سادهتر، بخش بزرگی از دلیل کندی مدلهای زبانی بزرگ، نه ضعف خود مدل، بلکه محدودیتهای سختافزاری در انتقال داده است؛ محدودیتی که Cerebras با طراحی متفاوت خود سعی کرده دور بزند.
این همکاری برای Cerebras نیز اهمیت راهبردی بالایی دارد. این شرکت که سالها در سایهی غولهای تولیدکنندهی پردازندهی گرافیکی فعالیت میکرد، حالا با بستن قراردادی به این بزرگی با OpenAI، جایگاه خود را بهعنوان یک بازیگر جدی در زیرساخت استنتاج هوش مصنوعی تثبیت کرده است. کارشناسان معتقدند اگر Ultrafast در عمل هم عملکردی پایدار داشته باشد، میتواند الگویی برای همکاری سایر شرکتهای هوش مصنوعی با تولیدکنندگان تراشههای تخصصی باشد.

۵. عدد ۷۵۰ توکن در ثانیه از کجا آمد؟
برای درک بهتر این عدد باید آن را با حالت استاندارد مقایسه کرد. اغلب مدلهای فرانتیر امروزی در حالت معمول چیزی میان چند ده تا حدود صد توکن در ثانیه تولید میکنند. رسیدن به ۷۵۰ توکن در ثانیه، یعنی جهشی نزدیک به یک مرتبهی بزرگی در سرعت خام تولید متن، بدون آنکه سطح استدلال مدل کاهش یابد. این موضوع بهویژه برای کاربردهایی که در آنها هر ثانیهی تأخیر هزینه دارد، اهمیت زیادی پیدا میکند.
اگر میخواهید با محدودیتها و توانمندیهای واقعی اینگونه فناوریها بیشتر آشنا شوید، مقالهی پتانسیل واقعی و محدودیتهای هوش مصنوعی میتواند دیدی واقعبینانه به شما بدهد.
۶. کاربردهای واقعی: از حوادث امنیتی تا تحلیل بازار مالی
OpenAI اعلام کرده مشتریان اولیهی این سرویس عمدتاً در حوزههای کدنویسی، تجارت و خدمات مالی فعالیت دارند. برخی از کاربردهایی که این شرکت به آنها اشاره کرده عبارتاند از:
پاسخ سریع به حوادث امنیتی سایبری و تحلیل لحظهای لاگهای سیستم، رصد آنی تراکنشهای مالی و تحقیقات بازار سرمایه، پشتیبانی مشتریان با یکپارچگی صوتی و پاسخگویی همزمان با تماس، بررسی آنی موجودی انبار و ارائهی پیشنهادهای شخصیسازیشده در تجارت الکترونیک، و جایگزینی فرآیندهای پژوهشی دستهای شبانه با تحلیل تعاملی و بلادرنگ.
کسبوکارهایی که به دنبال بهرهگیری عملی از اینگونه ابزارها هستند، میتوانند نگاهی هم به مقالهی چرا هوش مصنوعی برای کسبوکارها مهم است؟ بیندازند تا تصویر روشنتری از کاربردهای سازمانی این فناوری به دست آورند.
۷. دسترسی، قیمت و نقشهی راه عرضه
در گام نخست، Ultrafast تنها از طریق API اوپنایآی و برای گروهی محدود از مشتریان منتخب فعال شده است؛ کاربران عادی ChatGPT فعلاً به این حالت دسترسی ندارند. این شرکت وعده داده با افزایش ظرفیت زیرساخت پردازشی خود، دامنهی دسترسی را بهتدریج به کسبوکارهای بیشتری گسترش دهد. جزئیات قیمتگذاری این سرویس تا لحظهی انتشار این خبر رسماً اعلام نشده است، هرچند با توجه به هزینهی بالای زیرساخت اختصاصی Cerebras، انتظار میرود این سرویس در ابتدا با نرخی بالاتر از حالت استاندارد عرضه شود.
مسیر عرضهی تدریجی، رویکردی است که OpenAI پیشتر برای بسیاری از قابلیتهای تازهی خود در پیش گرفته است: نخست آزمایش با گروهی کوچک از مشتریان سازمانی، سپس گسترش تدریجی بر اساس بازخورد و ظرفیت زیرساختی، و در نهایت احتمال ورود به محصولات مصرفی مانند ChatGPT. با این حال، این شرکت هنوز هیچ بازهی زمانی مشخصی برای رسیدن Ultrafast به کاربران عادی اعلام نکرده است.
۸. رقابت سرعت میان غولهای هوش مصنوعی
عرضهی Ultrafast اوپنایآی را در میانهی رقابتی داغتر از همیشه قرار میدهد. شرکت Anthropic پیشتر با معرفی حالت سریع برای خانوادهی مدلهای Claude وارد همین میدان شده بود، اما OpenAI مدعی است ترکیب هوش سطح بالا و سرعت خام GPT-5.6 Sol در Ultrafast، فاصلهی محسوسی با رقبا ایجاد کرده است. در همین حال، گوگل و xAI هم روی بهینهسازی زیرساخت استنتاج مدلهای Gemini و Grok سرمایهگذاری سنگینی انجام دادهاند تا عقب نمانند.

۸.۱ چرا سرعت اینقدر مهم شده است؟
در سالهای ابتدایی مسابقهی هوش مصنوعی، معیار اصلی رقابت میان شرکتها «باهوشتر بودن» مدلها بود. اما بهمرور که کیفیت پاسخ مدلهای پیشرو به هم نزدیکتر شده، سرعت پاسخگویی به یکی از مهمترین مزیتهای رقابتی تبدیل شده است؛ چراکه در بسیاری از کاربردهای واقعی مثل معاملات مالی یا پشتیبانی زنده، چند ثانیه تأخیر میتواند تفاوت میان یک تجربهی موفق و یک فرصت ازدسترفته باشد.
برای کسانی که میخواهند از همین حالا با نوشتن دستورهای بهینه بیشترین بهره را از مدلهای سریع و باهوش ببرند، مطالعهی راهنمای آموزش نوشتن پرامپت برای مبتدیان پیشنهاد میشود.
۹. سوالات متداول دربارهی حالت Ultrafast اوپنایآی
حالت Ultrafast چیست؟ یک سرویس تازه در API اوپنایآی است که مدل GPT-5.6 Sol را با همان سطح هوش، اما تا ۱۴ برابر سریعتر اجرا میکند.
آیا Ultrafast برای کاربران عادی ChatGPT هم در دسترس است؟ فعلاً خیر؛ این حالت فقط از طریق API و برای گروهی محدود از مشتریان منتخب فعال شده است.
چه چیزی باعث این جهش سرعت شده؟ استفاده از زیرساخت تراشهای ویفر-مقیاس شرکت Cerebras در قالب مشارکتی دهمیلیارد دلاری با OpenAI.
قیمت این سرویس چقدر است؟ جزئیات قیمتگذاری هنوز بهطور رسمی اعلام نشده است.
آیا رقبایی مثل Claude یا Gemini هم سرویس مشابهی دارند؟ بله، Anthropic پیشتر حالت سریع برای Claude معرفی کرده و گوگل و xAI نیز روی سرعت مدلهای Gemini و Grok سرمایهگذاری کردهاند.
نسخهٔ فوری این مطلب در تلگرام: اینجا بخوانید
