رونمایی از GPT-6 Astra؛ آیا OpenAI به هوش مصنوعی عمومی رسید؟

اخبار · هوش مصنوعی

شرکت OpenAI مدل تازه‌اش GPT-6 Astra را رونمایی کرد؛ مدلی که به‌جای صرفاً پاسخ‌دادن، مستقیم داخل نرم‌افزارها کار می‌کند و به گفتهٔ بنیان‌گذارش شاید همان هوش مصنوعی عمومی (AGI) باشد که سال‌ها منتظرش بودیم.

چکیده. روز پنجشنبه سوم سپتامبر ۲۰۲۶، شرکت OpenAI در یک نشست خبری از مدل GPT-6 Astra رونمایی کرد؛ مدلی که برخلاف نسل‌های قبلی، به‌جای نوشتن کد یا متن برای کاربر، خودش مستقیماً داخل مرورگر، اکسل، دسکتاپ و نرم‌افزارهای تخصصی کار می‌کند. گرگ بروکمن، یکی از بنیان‌گذاران OpenAI، این مدل را نشانهٔ ورود به «عصر هوش مصنوعی عمومی» نامید. Astra در آزمون‌های سخت رکورد زده، اما همزمان اولین مدلی است که OpenAI آن را در «آستانهٔ بحرانی امنیت سایبری» طبقه‌بندی کرده؛ یعنی می‌تواند بدون کمک انسان حفره‌های امنیتی ناشناخته پیدا کند. در ادامه همهٔ جزئیات این خبر، از قابلیت‌ها و آزمون‌ها تا قیمت و مقایسه با کلود و جمینای را می‌خوانید.

بنر خبری رونمایی OpenAI از مدل هوش مصنوعی GPT-6 Astra

۱. OpenAI دقیقاً چه چیزی را رونمایی کرد؟

شرکت OpenAI که سازندهٔ ChatGPT است، در یک نشست خبری در ساعت ۱۱ صبح به وقت غرب آمریکا (سوم سپتامبر ۲۰۲۶)، از تازه‌ترین و بزرگ‌ترین مدل خود به نام GPT-6 Astra رونمایی کرد. حضور مدیران ارشد این شرکت از جمله گرگ بروکمن (یکی از بنیان‌گذاران) و پژوهشگرانی مثل ایدان کلارک در این نشست، نشان می‌داد OpenAI این عرضه را نه یک به‌روزرسانی معمولی، بلکه یک نقطهٔ عطف می‌داند. طبق گفتهٔ خود شرکت، Astra حاصل بزرگ‌ترین دورهٔ آموزشی تاریخ OpenAI است؛ آموزشی که روی زیرساخت غول‌پیکر Stargate در تگزاس و با بیش از صد هزار پردازندهٔ گرافیکی انجام شده است.

۲. مدل Astra دقیقاً چه کاری بلد است؟

تفاوت اصلی Astra با نسل‌های قبلی GPT در همین‌جاست: این مدل به‌جای اینکه فقط دستورالعمل یا کد بنویسد و کار را به کاربر بسپارد، خودش مثل یک انسان واقعی با کیبورد و ماوس داخل نرم‌افزارها کار می‌کند. بر اساس گزارش‌های منتشرشده، Astra توانسته فرم‌های آنلاین را پر کند، رکوردهای CRM را به‌روزرسانی کند، تقویم کاری بسازد، جدول‌های اکسل پیچیده را تحلیل کند، وب‌سایت طراحی و تست کند، قرارداد حقوقی فرمت‌بندی کند و حتی پیش‌نویس اظهارنامهٔ مالیاتی از روی فرم‌های دریافتی آماده کند. در حوزهٔ مهندسی هم این مدل با نرم‌افزارهایی مثل KiCad برای طراحی مدار، FreeCAD برای مدل‌سازی سه‌بعدی و حتی Blender برای انیمیشن کار کرده است؛ نمونه‌ای که OpenAI نشان داد، ساخت انیمیشن سه‌بعدی از عملکرد گیربکس خودرو بود. اگر دوست دارید بدانید خط باریک میان «دستیار هوشمند» و «مهندس واقعی» کجاست، مطلب توهم هوش مصنوعی؛ برنامه‌نویس تنها در برابر مهندس واقعی را هم بخوانید.

کارهای علمی و تحلیلی

در کنار کارهای اداری و مهندسی، Astra در حوزهٔ علمی هم عملکرد چشمگیری نشان داده؛ از جمله بهبود برخی نتایج ریاضی دربارهٔ فاصلهٔ اعداد اول و ثبت رکوردهای تازه در آزمون‌های زیست‌شناسی، شیمی، پزشکی و فیزیک. البته باید توجه داشت که خیلی از این نمونه‌ها را خود OpenAI انتخاب و منتشر کرده، پس طبیعی است که نتایج در بهترین حالت ممکن نشان داده شوند.

۳. آیا این همان هوش مصنوعی عمومی (AGI) است؟

جمله‌ای که بیشتر از همه سر‌وصدا کرد، حرف گرگ بروکمن در پایان نشست بود: «به عصر AGI خوش آمدید». وقتی مستقیم از او پرسیدند آیا Astra واقعاً AGI است، پاسخ داد: «برای من شخصاً، فکر می‌کنم رسیده‌ایم. یک استدلال نسبتاً خوب برای این ادعا وجود دارد.» با این حال او بلافاصله احتیاط کرد و گفت تعریف دقیق AGI هنوز مبهم است و شاید این اتفاق نه یک لحظهٔ مشخص و اعلام‌شده، بلکه یک روند خاکستری و تدریجی باشد که فقط بعداً و از روی تغییرات اقتصادی قابل تشخیص است، نه از روی یک عدد در یک آزمون. اگر می‌خواهید دقیق‌تر بدانید هوش مصنوعی امروز واقعاً چه کارهایی از پس آن برمی‌آید و کجا هنوز محدود است، پیشنهاد می‌کنیم نگاهی به توان واقعی و محدودیت‌های هوش مصنوعی در دنیای واقعی بیندازید؛ نگاهی واقع‌بینانه‌تر به این‌که «AGI» فقط یک شعار تبلیغاتی نیست، اما هر ادعایی هم به همین سادگی درست نیست.

۴. رکوردهای Astra در آزمون‌های سخت هوش مصنوعی

فراتر از شعارها، OpenAI مجموعه‌ای از عدد و رقم هم منتشر کرده که نشان می‌دهد Astra واقعاً از نظر فنی جهش بزرگی داشته:

در آزمون کاربردی OSWorld 2.0 که توانایی مدل در کار با نرم‌افزارهای واقعی را می‌سنجد، Astra دقت ۷۲.۶ درصدی ثبت کرده و هر وظیفه را در حدود ۴۰ دقیقه انجام می‌دهد؛ یعنی ۴۷ درصد سریع‌تر از نسل قبلی، GPT-5.6 Sol، که برای هر وظیفه نزدیک به ۷۵ دقیقه زمان می‌برد. در آزمون استدلال انتزاعی ARC-AGI-3 نمرهٔ ۹۸.۶ درصد گرفته (البته با ابزار ارزیابی اختصاصی خود OpenAI، پس مقایسهٔ مستقیم با مدل‌های دیگر ساده نیست)، در FrontierMath Tier 4 v2 نمرهٔ ۹۷.۶ درصد، در GPQA Diamond نمرهٔ ۹۶ درصد و در BenchCAD نمرهٔ ۹۵.۹ درصد به دست آورده است. در آزمون برنامه‌نویسی DeepSWE v1.1 هم نمرهٔ ۷۴.۱ درصد ثبت کرده و در آزمون امنیت سایبری ExploitBench نمرهٔ کامل صد از صد را گرفته؛ نمره‌ای که همان‌طور که در ادامه می‌خوانید، هم نشانهٔ قدرت است و هم منبع نگرانی.

مقایسه قیمت مدل GPT-6 Astra با Claude Opus 5 در جدول هزینهٔ هوش مصنوعی

۵. آموزش غول‌پیکر روی زیرساخت Stargate

ایدان کلارک، از پژوهشگران OpenAI، دربارهٔ مقیاس آموزش Astra گفت جهشی که از GPT-5.6 Sol به Astra دیده می‌شود، بزرگ‌تر از جهشی است که خود Sol نسبت به مدل‌های قبلی‌اش داشت. این مدل روی بیش از صد هزار پردازندهٔ گرافیکی در سایت Stargate در تگزاس آموزش دیده؛ بزرگ‌ترین دورهٔ آموزشی تاریخ این شرکت تا امروز. نکتهٔ جالب این‌که در فرایند آموزش، مدل‌های دیگر هوش مصنوعی نیز نقش پررنگی در نظارت و راهنمایی Astra داشته‌اند؛ روندی که هرچه جلوتر می‌رویم در صنعت هوش مصنوعی بیشتر دیده می‌شود.

۶. اولین مدلی که وارد «آستانهٔ بحرانی امنیت سایبری» شد

شاید مهم‌ترین بخش این خبر، بخش امنیتی آن باشد. OpenAI اعلام کرد Astra اولین مدلی است که به «آستانهٔ بحرانی امنیت سایبری» رسیده؛ یعنی می‌تواند بدون هدایت انسان، حفره‌های امنیتی ناشناخته (zero-day) را کشف و حتی زنجیرهٔ سوءاستفاده از آن‌ها را بسازد. در آزمایش‌های داخلی، این مدل دو حفرهٔ امنیتی کاملاً ناشناخته کشف کرد که تا پیش از آن هیچ‌کس از وجودشان خبر نداشت. به همین دلیل، دسترسی کامل به قابلیت‌های امنیتی Astra فعلاً فقط از طریق برنامهٔ محدود Daybreak و برای سازمان‌های معتمد باز است. جاکوب پاچوکی، دانشمند ارشد OpenAI، دربارهٔ همین موضوع هشدار داد: «پیشرفت در هوشمندی، لزوماً به معنای پیشرفت در ایمنی نیست.» در آزمایش‌های داخلی، نسل قبلی یعنی GPT-5.6 Sol وقتی محدودیت‌هایش برداشته می‌شد، در ۴۸.۲ درصد موارد از چارچوب مجاز خودش فراتر می‌رفت؛ این عدد برای Astra، در همان شرایط، به صفر درصد رسیده است؛ عددی که OpenAI آن را نشانهٔ بهبود ایمنی می‌داند، هرچند منتقدان می‌گویند یک آزمایش داخلی به‌تنهایی کافی نیست. این طبقه‌بندی بحرانی برای اولین بار در گزارش‌های اولیهٔ دوم سپتامبر هم مطرح شده بود؛ برای مرور کامل آن گزارش، مطلب آستانهٔ بحرانی امنیت سایبری مدل Astra را هم بخوانید.

۷. قیمت، دسترسی و زمان عرضه

استفاده از Astra ارزان نیست. در حالت استاندارد، قیمت هر یک میلیون توکن ورودی ۱۰ دلار و هر یک میلیون توکن خروجی ۵۰ دلار است (رویهم حدود ۶۰ دلار). در حالت سریع، که ۲.۵ برابر تندتر پاسخ می‌دهد، قیمت به ۲۰ دلار ورودی و ۱۰۰ دلار خروجی می‌رسد. با این حال، بروکمن در نشست خبری تاکید کرد که قیمت‌گذاری بر مبنای توکن دیگر تصویر درستی از هزینهٔ واقعی نمی‌دهد و باید هزینه را بر اساس «هزینهٔ هر وظیفهٔ کامل‌شده» سنجید؛ چون مدلی که کار را از همان بار اول درست انجام می‌دهد، حتی با قیمت بالاتر هر توکن، در نهایت ارزان‌تر تمام می‌شود. طبق برآورد خود OpenAI، Astra در آزمون DeepSWE v1.1 نسبت به بهترین پیکربندی GPT-5.6 Sol، حدود ۵۷ درصد هزینهٔ کمتری برای هر وظیفهٔ کامل‌شده دارد. از نظر زمان‌بندی، دسترسی سازمانی از پنجشنبهٔ بعد از رونمایی (پنجم سپتامبر) از طریق برنامهٔ Daybreak آغاز می‌شود؛ کاربران عادی ChatGPT Plus، Pro، Business و Enterprise هم طی روزهای آینده به آن دسترسی پیدا می‌کنند و این مدل از طریق API خود OpenAI، AWS Bedrock و Microsoft Azure هم در دسترس خواهد بود.

۸. مقایسه Astra با کلود اوپوس ۵ و جمینای فلش

از نظر قیمت، Astra در بالاترین ردهٔ بازار قرار دارد. برای مقایسه: مدل Claude Opus 5 شرکت Anthropic هر یک میلیون توکن ورودی و خروجی را رویهم حدود ۳۰ دلار قیمت‌گذاری کرده (نصف قیمت Astra)، در حالی که مدل‌های سنگین‌تر Fable و Mythos نسخهٔ ۵ همین شرکت، دقیقاً هم‌سطح Astra یعنی حدود ۶۰ دلار قیمت دارند. در طرف دیگر، Gemini 3.7 و 3.8 Flash گوگل با قیمت موقت حدود ۴.۵ دلار برای هر یک میلیون توکن، به‌مراتب ارزان‌تر از Astra عمل می‌کنند، هرچند طبیعتاً در همان سطح از قابلیت‌های خودمختار عمل نمی‌کنند. نکتهٔ مهم این است که برتری اصلی Astra نه در قیمت هر توکن، بلکه در توانایی انجام خودکار کارها داخل نرم‌افزارهاست؛ قابلیتی که در این سطح، نه کلود و نه جمینای فعلاً ارائه نمی‌دهند. اگر به مقایسهٔ مدل‌های مختلف هوش مصنوعی علاقه دارید، مطلب مقایسهٔ ChatGPT و DeepSeek در نبرد شطرنج هوش مصنوعی را هم از دست ندهید.

مقایسه هزینهٔ مدل جمینای فلش گوگل با مدل جدید GPT-6 Astra شرکت OpenAI

۹. این خبر برای کاربران فارسی‌زبان چه معنایی دارد؟

فارغ از بحث‌های داغ دربارهٔ AGI، نکتهٔ عملی‌تر این خبر برای کسب‌وکارها و کاربران فارسی‌زبان این است که مدل‌هایی مثل Astra، به‌جای جایگزینی کامل کارمندان، بیشتر نقش «اجراکنندهٔ خودکار کارهای تکراری» را بازی می‌کنند: پرکردن فرم، تحلیل اکسل، تهیهٔ گزارش اولیه یا تست وب‌سایت. اگر می‌خواهید بدانید چرا این نوع ابزارها این‌روزها این‌قدر برای کسب‌وکارها مهم شده‌اند، مطلب چرا هوش مصنوعی برای کسب‌وکارها در سال ۲۰۲۵ اهمیت دارد را بخوانید. برای استفادهٔ بهتر از همین نسل مدل‌ها هم لازم نیست منتظر Astra بمانید؛ با یادگیری اصول درست پرامپت‌نویسی می‌توانید همین امروز از ابزارهای در دسترس نتیجهٔ بهتری بگیرید؛ راهنمای نوشتن پرامپت برای مبتدیان نقطهٔ شروع خوبی است، و در بخش آموزش‌های ChatGPT سایت هم می‌توانید مسیر یادگیری کامل‌تری را دنبال کنید.

سوالات متداول دربارهٔ GPT-6 Astra

آیا GPT-6 Astra همین حالا در دسترس همه است؟

خیر. دسترسی سازمانی کامل از پنجم سپتامبر و از طریق برنامهٔ محدود Daybreak آغاز می‌شود؛ کاربران عادی ChatGPT Plus، Pro، Business و Enterprise هم طی روزهای آینده به آن دسترسی پیدا می‌کنند.

آیا Astra واقعاً هوش مصنوعی عمومی (AGI) است؟

این فقط ادعای شخصی گرگ بروکمن، یکی از بنیان‌گذاران OpenAI، است؛ نه یک استاندارد رسمی یا اجماع علمی. خود او هم تاکید کرد تعریف AGI هنوز مبهم است.

استفاده از Astra چقدر هزینه دارد؟

در حالت استاندارد، هر یک میلیون توکن ورودی و خروجی رویهم حدود ۶۰ دلار هزینه دارد؛ در حالت سریع‌تر این عدد به ۱۲۰ دلار می‌رسد.

آیا Astra خطر امنیتی هم دارد؟

بله. همین قدرت باعث شده OpenAI آن را اولین مدل رسیده به «آستانهٔ بحرانی امنیت سایبری» اعلام کند؛ به همین دلیل دسترسی کامل به قابلیت‌های امنیتی آن فعلاً محدود است.

جمع‌بندی. رونمایی از GPT-6 Astra، فارغ از این‌که واقعاً همان AGI باشد یا نه، نشان می‌دهد رقابت میان OpenAI، Anthropic و Google روزبه‌روز داغ‌تر می‌شود و مرز میان «دستیار هوشمند» و «کارمند خودکار دیجیتال» کم‌رنگ‌تر می‌شود. ما در کانال @MrChatGPT_IR این خبرها را لحظه‌به‌لحظه دنبال می‌کنیم؛ برای دیدن آخرین اخبار هوش مصنوعی سری به بخش اخبار سایت هم بزنید.

نسخهٔ فوری این مطلب در تلگرام: اینجا بخوانید

(0 رأی)

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *