آسترا؛ مدل تازه OpenAI که حالا روی آمازون هم اجرا می‌شود

اخبار · هوش مصنوعی

شرکت OpenAI مدل تازه‌ی خود، GPT-6 Astra، را رسماً روی زیرساخت Amazon Bedrock در دسترس کسب‌وکارها قرار داده؛ مدلی با حافظه‌ی یک‌میلیون‌توکنی، رکورد صددرصدی در آزمون‌های امنیت سایبری و بهبود چشمگیر در کدنویسی و استدلال.

چکیده. مدل GPT-6 Astra، جدیدترین محصول OpenAI، از این هفته به‌طور رسمی روی سرویس ابری Amazon Bedrock عرضه شده تا شرکت‌ها بدون نیاز به قرارداد مستقیم با OpenAI به آن دسترسی داشته باشند. این مدل حافظه‌ای در حدود یک میلیون توکن دارد، در آزمون‌های کدنویسی و امنیت سایبری رکورد زده و قابلیت «Computer Use» آن هم به‌طور محسوسی سریع‌تر شده است. در ادامه‌ی این مطلب از بخش اخبار مرچت‌جی‌پی‌تی همه‌چیز را درباره‌ی این مدل، تفاوت‌هایش با نسل قبلی و کاربردهای عملی آن بررسی می‌کنیم.
تصویر خبری مدل هوش مصنوعی GPT-6 Astra ساخته شرکت OpenAI روی زیرساخت Amazon Bedrock

۱. آسترا چیست و چرا اهمیت دارد؟

شرکت OpenAI مدل GPT-6 Astra را به‌عنوان هوشمندترین و همسوترین مدل تاریخ خودش معرفی کرده است. این مدل حاصل پیشرفت‌هایی در سه حوزه‌ی پیش‌آموزش، یادگیری تقویتی و پژوهش‌های همسوسازی است و قرار است جایگزین نسل قبلی مدل‌های استدلالی OpenAI شود. برای کسانی که تازه با اکوسیستم OpenAI آشنا می‌شوند، مطالعه‌ی این راهنما درباره‌ی OpenAI کمک می‌کند تا جایگاه این شرکت در بازار هوش مصنوعی بهتر درک شود.

معرفی این مدل تنها به‌روزرسانی معمولی نیست؛ OpenAI آن را نقطه‌ی عطفی در مسیر رسیدن به مدل‌هایی می‌داند که هم قدرتمندتر هستند و هم قابل‌اعتمادتر. طبق اعلام رسمی شرکت، آسترا در آزمون استدلال انتزاعی ARC-AGI-3 به عدد ۹۹.۹ درصد رسیده که تا پیش از این بی‌سابقه بوده است.

۲. چرا اجرای مدل روی آمازون این‌قدر مهم است؟

تا پیش از این، دسترسی به قدرتمندترین مدل‌های OpenAI معمولاً محدود به پلتفرم‌های خود این شرکت یا مایکروسافت آژور بود. اما حالا با عرضه‌ی رسمی روی Amazon Bedrock، شرکت‌هایی که زیرساخت ابری خود را روی آمازون ساخته‌اند، می‌توانند بدون تغییر معماری، از قدرت آسترا استفاده کنند.

سرویس Bedrock امکاناتی مثل رمزنگاری در سطح تراشه، مدیریت دسترسی از طریق IAM و ثبت کامل رخدادها با CloudTrail را در اختیار مشتریان قرار می‌دهد؛ یعنی داده‌های حساس سازمانی زیر نظارت مستقیم تیم امنیتی خود شرکت باقی می‌ماند. چنین رویکردی برای صنایعی مثل بانکداری، حقوقی و سلامت که به حریم خصوصی داده حساس هستند، جذابیت زیادی دارد.

۳. حافظه‌ی یک‌میلیون‌توکنی؛ یعنی چه؟

یکی از ویژگی‌های کلیدی آسترا، پنجره‌ی زمینه‌ی (context window) تا سقف یک میلیون توکن است. به زبان ساده، این مدل می‌تواند در یک درخواست، معادل چند صد صفحه متن، یک پایگاه کد نرم‌افزاری کامل یا مجموعه‌ای از گزارش‌های مالی چندساله را همزمان بخواند و تحلیل کند بدون آنکه بخش ابتدایی متن را «فراموش» کند.

این قابلیت برای کاربردهایی مثل بررسی قراردادهای حقوقی طولانی، تحلیل صورت‌های مالی سالانه یا پیمایش یک ریپازیتوری بزرگ نرم‌افزاری فوق‌العاده کاربردی است. در Codex هم قابلیت جدیدی اضافه شده که به مدل اجازه می‌دهد به‌جای فشرده‌سازی اطلاعات قدیمی، از طریق یادداشت‌های قابل‌جست‌وجو زمینه‌ی کار را در نشست‌های طولانی حفظ کند.

۴. عملکرد در کدنویسی و مهندسی نرم‌افزار

در آزمون Terminal-Bench 4.0، آسترا به نمره‌ی ۵۷.۹ درصد رسیده، در برابر ۳۷.۳ درصد نسل قبلی؛ جهشی بزرگ در توانایی تکمیل وظایف نرم‌افزاری واقعی. مهندسانی از شرکت‌های Jane Street و Cognition هم گفته‌اند کدهای تولیدشده توسط این مدل نیاز به بازنویسی کمتری دارد و روند اشکال‌زدایی آن هم برای برنامه‌نویس‌ها قابل‌فهم‌تر است.

با این حال، ورود چنین ابزارهای قدرتمندی به فرایند توسعه‌ی نرم‌افزار این پرسش را دوباره زنده می‌کند که مرز میان دستیار هوشمند و مهندس واقعی کجاست؛ موضوعی که در این مطلب درباره‌ی توهم برنامه‌نویسی با هوش مصنوعی به‌طور مفصل بررسی شده است.

۵. رکورد در امنیت سایبری

نتایج آزمون‌های امنیتی آسترا واقعاً چشمگیر است. این مدل در آزمون ExploitBench به نمره‌ی کامل صد از صد رسیده، در برابر ۷۸.۵ درصد نسل قبلی، و در آزمون پیچیده‌ی ExploitGym هم به ۴۲.۴ درصد رسیده است. جالب‌تر آنکه در جریان ارزیابی‌های داخلی OpenAI، این مدل دو آسیب‌پذیری امنیتی کاملاً ناشناخته (zero-day) را خودش کشف کرده است.

به همین دلیل، OpenAI سطح ریسک این مدل را در چارچوب آمادگی خود (Preparedness Framework) در رده‌ی «بحرانی» برای توانمندی‌های سایبری قرار داده و سازوکارهای نظارتی خودکاری برای جلوگیری از سوءاستفاده در نظر گرفته است.

۶. کاربرد در پژوهش‌های علمی

آسترا در حوزه‌ی ریاضیات هم دستاورد جالبی داشته؛ این مدل به کشف کران تازه‌ای برابر با ۱۸۶ برای فاصله‌ی اعداد اول کمک کرده و رکوردی بیش از یک دهه را بهبود داده است. در آزمون FrontierMath سطح چهار هم به ۹۷.۶ درصد رسیده، در برابر ۸۳ درصد مدل قبلی، که نشان می‌دهد توانایی استدلال ریاضی این نسل از مدل‌ها به‌طور جدی ارتقا یافته است.

۷. مقایسه با رقبا؛ کلود، جمینای و بقیه

OpenAI در معرفی رسمی خود مستقیماً آسترا را با مدل‌های Claude انتروپیک مقایسه کرده است؛ برای نمونه در آزمون Terminal-Bench Science نمره‌ی ۶۴.۶ درصد در برابر ۵۲.۶ درصد مدل رقیب ثبت شده. با این حال، رقابت میان غول‌های فناوری فقط به OpenAI و Anthropic محدود نمی‌شود و گوگل هم با نسل تازه‌ی جمینای در تلاش است سهم بیشتری از بازار سازمانی را به دست بیاورد.

برای درک بهتر این رقابت چندجانبه، خواندن مقایسه‌ی چت‌جی‌پی‌تی و دیپ‌سیک هم خالی از لطف نیست؛ چراکه نشان می‌دهد این رقابت تنها میان چند شرکت آمریکایی نیست و بازیگران آسیایی هم به‌سرعت در حال پیشرفت‌اند.

۸. ابزار Computer Use و اتوماسیون کسب‌وکار

قابلیت «Computer Use» آسترا هم به‌طور محسوسی بهبود یافته؛ این مدل در آزمون OSWorld 2.0 به نمره‌ی ۷۲.۶ درصد رسیده و کارها را حدود ۴۷ درصد سریع‌تر از نسل قبلی انجام می‌دهد. در عمل، این یعنی مدل می‌تواند فرم پر کند، تقویم کاری را مدیریت کند، در سیستم CRM جست‌وجو کند یا حتی کدی را اجرا و اشکال‌زدایی کند.

چنین قابلیت‌هایی نشان می‌دهد چرا هوش مصنوعی دیگر صرفاً ابزار تولید متن نیست، بلکه به بخشی جدی از زیرساخت تصمیم‌گیری و اجرای کارهای روزمره‌ی کسب‌وکارها تبدیل شده؛ موضوعی که در این تحلیل درباره‌ی اهمیت هوش مصنوعی در کسب‌وکار با جزئیات بیشتری توضیح داده شده است.

۹. دسترسی، قیمت‌گذاری و نحوه‌ی استفاده

در حال حاضر آسترا برای گروه محدودی از سازمان‌ها فعال شده و طی روزهای آینده به‌طور گسترده‌تر در اختیار کاربران ChatGPT Plus، Pro، Business و Enterprise قرار می‌گیرد. نرخ استفاده از طریق API استاندارد OpenAI حدود ده دلار برای هر یک میلیون توکن ورودی و پنجاه دلار برای هر یک میلیون توکن خروجی اعلام شده، و یک حالت «سریع» هم با هزینه‌ی دو برابر و سرعت تا دو برابر در دسترس است.

کاربرانی که می‌خواهند از همین حالا با پرامپت‌نویسی حرفه‌ای برای این مدل‌های جدید آشنا شوند، می‌توانند نگاهی به این آموزش ساده‌ی پرامپت‌نویسی بیندازند تا بیشترین بهره را از قدرت مدل‌های تازه ببرند. برای یادگیری کاربردهای روزمره‌تر هم می‌توان سری به بخش آموزش‌های چت‌جی‌پی‌تی زد.

مقایسه عملکرد مدل GPT-6 Astra با مدل‌های Claude انتروپیک در کدنویسی و استدلال

۱۰. محدودیت‌ها و نکاتی که نباید نادیده گرفت

با وجود همه‌ی این پیشرفت‌ها، خود OpenAI هم اذعان کرده که فرایند استدلال درونی آسترا در برخی وظایف ساده، نظارت‌پذیری کمتری دارد و این یکی از حوزه‌های باز پژوهشی باقی مانده است. به همین دلیل هنوز نمی‌توان چنین مدل‌هایی را جایگزین کامل نظارت انسانی دانست، به‌خصوص در تصمیم‌های حساس.

واقعیت این است که پیشرفت سریع مدل‌هایی مثل آسترا نباید باعث فراموش‌شدن محدودیت‌های واقعی هوش مصنوعی امروز شود؛ موضوعی که در این مقاله درباره‌ی پتانسیل و محدودیت‌های واقعی هوش مصنوعی به‌خوبی باز شده است.

سوالات متداول درباره‌ی GPT-6 Astra

آیا GPT-6 Astra جایگزین ChatGPT معمولی می‌شود؟
بله، بر اساس اعلام OpenAI، این مدل طی روزهای آینده در اختیار کاربران پلن‌های Plus، Pro، Business و Enterprise قرار می‌گیرد و به‌مرور جایگزین مدل‌های استدلالی قبلی خواهد شد.

چطور می‌توان از طریق آمازون به آسترا دسترسی داشت؟
کافی است سازمان از سرویس Amazon Bedrock استفاده کند؛ مدل از طریق کنسول و APIهای Bedrock در مناطق پشتیبانی‌شده‌ی آمازون در دسترس است.

آیا استفاده از آسترا روی Bedrock امن‌تر از دسترسی مستقیم به OpenAI است؟
سرویس Bedrock لایه‌های امنیتی اضافه‌ای مثل رمزنگاری سطح تراشه و ثبت رخداد با CloudTrail ارائه می‌دهد که برای سازمان‌های حساس به حریم داده جذاب است، هرچند انتخاب نهایی به سیاست امنیتی هر سازمان بستگی دارد.

هزینه‌ی استفاده از این مدل چقدر است؟
نرخ پایه از طریق API حدود ده دلار به ازای هر یک میلیون توکن ورودی و پنجاه دلار برای هر یک میلیون توکن خروجی است؛ حالت سریع‌تر هم با هزینه‌ی دو برابر عرضه شده است.

رقابت شرکت‌های OpenAI و گوگل جمینای و سایر شرکت‌های هوش مصنوعی در بازار مدل‌های زبانی بزرگ
جمع‌بندی. عرضه‌ی GPT-6 Astra روی Amazon Bedrock نشان می‌دهد رقابت میان غول‌های هوش مصنوعی وارد مرحله‌ی تازه‌ای شده؛ مرحله‌ای که در آن دسترسی آسان‌تر و امنیت زیرساخت به‌اندازه‌ی قدرت خام مدل اهمیت دارد. برای دنبال‌کردن آخرین اخبار مدل‌های هوش مصنوعی، به‌محض انتشار، عضو کانال @MrChatGPT_IR شوید.

نسخهٔ فوری این مطلب در تلگرام: اینجا بخوانید

(0 رأی)

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *