آنتروپیک برنامه‌ی تأیید سایبری را به سه سطح گسترش داد؛ کلود برای هکرهای کلاه‌سفید

اخبار · هوش مصنوعی

شرکت Anthropic برنامه‌ی تأیید سایبری (CVP) را در سه سطح دفاعی، ردتیم و تخصصی گسترش داد تا متخصصان امنیتِ تأییدشده بتوانند بدون مسدودسازی‌های همیشگی از کلود در کارهای واقعی امنیتی استفاده کنند.

چکیده. آنتروپیک در ششم اکتبر ۲۰۲۶ برنامه‌ی تأیید سایبری را از یک برنامه‌ی محدود به یک ساختار سه‌سطحی تبدیل کرد. سطح دفاعی برای تیم‌های امنیتی، سطح ردتیم برای تست نفوذ مجاز و سطح تخصصی برای زیرساخت‌های حیاتی است. در آزمون CyScenarioBench مدل عمومی هر ۵۰ تسک را مسدود کرد، اما در سطح ردتیم هیچ مسدودسازی‌ای رخ نداد و ۳۴ تسک از ۵۰ تسک کامل شد. پشتوانه‌ی این تصمیم، بیش از ۱۲۹ هزار آسیب‌پذیری تأییدشده در پروژه‌ی Glasswing است.

۱. ماجرا چیست و چرا مهم است؟

شرکت Anthropic روز ششم اکتبر ۲۰۲۶ با انتشار مطلبی در وب‌سایت خود اعلام کرد که برنامه‌ی تأیید سایبری یا Cyber Verification Program را گسترش می‌دهد. هدف این برنامه ساده است: کسانی که شغلشان دفاع از سامانه‌هاست، نباید هر بار که از کلود برای تحلیل یک بدافزار یا بررسی یک آسیب‌پذیری کمک می‌خواهند، با پیام رد شدن روبه‌رو شوند. از طرف دیگر، همان قابلیت‌ها اگر بدون کنترل در اختیار همه قرار بگیرد، می‌تواند به کار مهاجمان بیاید.

آنتروپیک خودش این تناقض را این‌طور توضیح می‌دهد: امنیت سایبری ذاتاً دوکاربردی است و همان توانی که به یک تیم امنیتی کمک می‌کند آسیب‌پذیری را پیدا و رفع کند، می‌تواند به مهاجم هم کمک کند از آن سوءاستفاده کند. راه‌حل شرکت این است که به‌جای یک قفل واحد برای همه، چند سطح اعتماد تعریف کند و هر سازمان را بعد از راستی‌آزمایی در سطح مناسب قرار دهد.

اگر تازه با دنیای شرکت‌های بزرگ هوش مصنوعی آشنا شده‌اید، پیشنهاد می‌کنیم مقاله‌ی OpenAI چیست؟ را هم بخوانید تا تصویر کلی‌تری از رقابت این شرکت‌ها داشته باشید.

برنامه تأیید سایبری آنتروپیک با سه سطح دسترسی دفاعی، ردتیم و تخصصی برای کلود

۲. پیش‌زمینه: از Glasswing تا CVP

برنامه‌ی تأیید سایبری از هیچ شروع نشده است. آنتروپیک پیش‌تر پروژه‌ای به نام Glasswing را با شریک‌های منتخب اجرا کرده بود. در این پروژه، سازمان‌هایی مثل Booz Allen و Comcast به مدل‌های خانواده‌ی Mythos دسترسی ویژه داشتند و با آن‌ها نرم‌افزارهای واقعی را برای یافتن نقص بررسی می‌کردند. حالا Glasswing در برنامه‌ی گسترده‌تر CVP ادغام شده و اعضای آن بدون نیاز به تأیید دوباره به بالاترین سطح منتقل می‌شوند.

اگر تا امروز خبرهای امنیتی آنتروپیک را دنبال کرده باشید، می‌دانید که این شرکت چند ماه است روی توان سایبری مدل‌هایش حساس شده است. نمونه‌اش گزارشی است که درباره‌ی کشف آسیب‌پذیری Rejetto HFS توسط Mythos منتشر کردیم، یا هشداری که درباره‌ی توان مدل چینی GLM-5.3 در ساخت اکسپلویت مطرح شد.

۳. سه سطح دسترسی؛ هر کدام برای چه کسی؟

سطح اول: دسترسی دفاعی (Defense Access)

این سطح برای کارهای دفاعی طراحی شده است: عملیات مرکز امنیت، پاسخ به حادثه، مهندسی معکوس بدافزار و تحلیل آسیب‌پذیری. واجدان شرایط شامل تیم‌های امنیتی شرکت‌ها، سازمان‌های غیرانتفاعی، دانشگاه‌ها، نهادهای دولتی، اپراتورهای زیرساخت حیاتی در هر اندازه، شرکت‌های امنیتی کوچک، نگهدارندگان پروژه‌های متن‌باز و حتی پژوهشگران مستقلی هستند که سابقه‌ی افشای مسئولانه‌ی آسیب‌پذیری دارند. پاسخ به درخواست‌ها معمولاً ظرف چند روز می‌رسد.

سطح دوم: دسترسی ردتیم (Red Team Access)

این سطح همه‌ی امکانات سطح دفاعی را دارد و تست نفوذ و ردتیمینگ مجاز را هم اضافه می‌کند. سازمان‌های واجد شرایط شامل ردتیم‌های داخلی، ردتیم‌های دولتی و شرکت‌های تست نفوذ هستند. آزمون‌ها فقط روی سامانه‌هایی مجاز است که سازمان حق آزمایش آن‌ها را دارد. این سطح فعلاً فقط برای سازمان‌هاست و پژوهشگر مستقل نمی‌تواند آن را بگیرد. بررسی درخواست چند هفته طول می‌کشد و در این مدت سازمان در سطح دفاعی ثبت می‌شود.

سطح سوم: دسترسی تخصصی (Specialized Access)

این سطح برای شمار محدودی از سازمان‌های تأییدشده است که سامانه‌های حیاتی را آزمایش می‌کنند: سیستم‌عامل پرواز، شبکه‌ی برق، شبکه‌های مخابراتی، زیرساخت انتقال بین‌بانکی و شبکه‌های اداری دولتی. دولت آمریکا در بررسی عمیق این سطح همکاری می‌کند.

نتایج آزمون CyScenarioBench درباره مسدودسازی کلود در سطوح مختلف برنامه تأیید سایبری

۴. اعداد آزمون CyScenarioBench چه می‌گویند؟

برای نشان‌دادن اثر هر سطح، آنتروپیک مدل Claude Opus 5.5 را روی آزمون CyScenarioBench سنجید. این آزمون توان برنامه‌ریزی عملیات سایبری چندمرحله‌ای در شرایط واقع‌گرایانه را می‌سنجد. برای هر سطح، ده چالش وجود داشت و هر چالش پنج بار تکرار شد؛ یعنی در مجموع ۵۰ تلاش برای هر سطح.

نتیجه چنین بود: در حالت عمومی و بدون CVP، همه‌ی ۵۰ تلاش از همان پرامپت اول مسدود شد. در سطح دفاعی، ۴۶ مورد از ۵۰ مورد مسدود شد و چهار مورد پیش رفت. در سطح ردتیم و تخصصی هیچ مسدودسازی‌ای ثبت نشد و Claude Opus 5.5 توانست ۳۴ تسک از ۵۰ تسک را کامل کند؛ یعنی حدود ۶۸ درصد، که با عملکرد همین مدل در حالت بدون محافظ برابر است.

نکته‌ی مهم این است که حتی در بالاترین سطح‌ها مسدودسازی لحظه‌ای برای کارهایی که می‌توانند آسیب فیزیکی یا اختلال گسترده بسازند باقی می‌ماند؛ مثل استقرار باج‌افزار یا آزمایش پرخطر سامانه‌های ایمنی.

۵. پشتوانه‌ی عددی: ۱۲۹ هزار آسیب‌پذیری

آنتروپیک برای توجیه این گسترش به نتایج Glasswing اشاره می‌کند. بین آوریل و ژوئیه‌ی ۲۰۲۶ شریک‌های پروژه دست‌کم ۱۲۹ هزار آسیب‌پذیری نرم‌افزاری را تأیید کردند. علاوه بر آن، تلاش‌های اسکن پروژه‌های متن‌باز از آوریل تا اکتبر حدود ۵۵۰۰ آسیب‌پذیری تأییدشده‌ی دیگر پیدا کرده است. بیش از ۳۳ هزار مورد در رده‌ی بحرانی یا بالا ارزیابی شد.

شرکت می‌گوید اثر واقعی احتمالاً دست‌کم پنج برابر این عدد است، چون داده‌ی نظرسنجی از شریک‌ها ناقص بوده است. شریک‌ها گزارش داده‌اند که مدل‌های Mythos سرعت یافتن آسیب‌پذیری‌هایشان را «ماه‌ها یا حتی سال‌ها» بالا برده است.

بیش از ۱۲۹ هزار آسیب‌پذیری نرم‌افزاری تأییدشده در پروژه Glasswing آنتروپیک

۶. چه مدل‌هایی و روی چه پلتفرم‌هایی؟

هر سه سطح به مدل‌های Claude Opus 5.5، Claude Sonnet 5.5، Claude Mythos 5.1 و مدل‌های آینده‌ی آنتروپیک دسترسی می‌دهند. اعضای فعلی CVP تنظیمات قبلی‌شان را حفظ می‌کنند و به‌طور خودکار برای سه مدل جدید ارزیابی می‌شوند. مدیر سازمان باید از طریق کنسول Claude دسترسی را به فضاهای کاری مشخص اختصاص دهد.

این برنامه روی پلتفرم Claude، سرویس Vertex AI گوگل کلاد و Microsoft Foundry در دسترس است. در Amazon Bedrock فقط برای مشتریان واجد شرایط Enterprise Frontier Safeguards عرضه می‌شود. اگر درباره‌ی ارزش اقتصادی استفاده از هوش مصنوعی در سازمان‌ها کنجکاوید، مقاله‌ی اهمیت هوش مصنوعی در کسب‌وکار نقطه‌ی شروع خوبی است.

۷. حریم خصوصی و نگهداری داده

یکی از نکته‌هایی که سازمان‌ها باید به آن دقت کنند، نگهداری داده است. در حال حاضر، نگهداری داده‌ها برای پایش برنامه اجباری است. آنتروپیک می‌گوید این وضعیت با عرضه‌ی Enterprise Frontier Safeguards در پاییز ۲۰۲۶ تغییر می‌کند و امکان ذخیره‌سازی بدون نگهداری داده در زیرساخت ابری تحت کنترل مشتری فراهم می‌شود. البته سازمان‌هایی که از Claude Fable 5.1 یا Claude Mythos 5.1 استفاده می‌کنند، همین حالا هم می‌توانند CVP را با صفر نگهداری داده به‌کار ببرند.

برای تیم‌هایی که دغدغه‌ی محرمانگی کد و گزارش‌های امنیتی دارند، همین جزئیات می‌تواند تعیین‌کننده باشد. پیش از ثبت‌نام، بخش حقوقی و امنیتی سازمان باید شرایط نگهداری داده را بررسی کند.

۸. نحوه‌ی ثبت‌نام و گزارش خطای مسدودسازی

سازمان‌ها از طریق پورتال برنامه در سایت Anthropic درخواست می‌دهند. درخواست باید راستی‌آزمایی هویت و مدارک کنترل‌های امنیتی لازم برای همان سطح را شامل شود. اگر کاربری با وجود عضویت با مسدودسازی ناخواسته روبه‌رو شود، فرم گزارش مثبت کاذب برای ثبت شکایت و پیگیری وجود دارد.

برای کسانی که تازه با ابزارهای هوش مصنوعی کار می‌کنند و می‌خواهند بهتر پرامپت بنویسند، راهنمای نوشتن پرامپت برای مبتدیان و آموزش‌های بخش آموزش سایت می‌تواند کمک کند. برای خبرهای بیشتر هم می‌توانید بخش اخبار را دنبال کنید.

۹. پرسش‌های متداول (FAQ)

برنامه‌ی تأیید سایبری آنتروپیک دقیقاً چیست؟

برنامه‌ای است که به سازمان‌ها و متخصصان امنیتی تأییدشده اجازه می‌دهد از قابلیت‌های سایبری کلود با فیلترهای مسدودکننده‌ی کم‌شدت‌تر استفاده کنند. شدت کاهش فیلتر به سطح دسترسی بستگی دارد.

آیا هر کسی می‌تواند ثبت‌نام کند؟

خیر. درخواست باید راستی‌آزمایی شود. سطح دفاعی برای طیف وسیعی از سازمان‌ها و پژوهشگران دارای سابقه‌ی افشای آسیب‌پذیری باز است، اما سطح ردتیم فعلاً فقط برای سازمان‌هاست و سطح تخصصی بسیار محدود است.

آیا کلود در سطح ردتیم هر کاری را انجام می‌دهد؟

خیر. مسدودسازی لحظه‌ای برای اقداماتی که آسیب فیزیکی یا اختلال گسترده ایجاد می‌کنند، مثل استقرار باج‌افزار، همچنان فعال است.

سطح تخصصی برای چه سامانه‌هایی است؟

برای آزمایش سامانه‌های حیاتی و ایمنی‌محور مثل شبکه‌ی برق، مخابرات، سیستم‌عامل پرواز و زیرساخت بین‌بانکی. دولت آمریکا در بررسی آن مشارکت دارد.

آیا داده‌های من نگهداری می‌شود؟

فعلاً نگهداری داده برای پایش برنامه اجباری است. با عرضه‌ی Enterprise Frontier Safeguards در پاییز ۲۰۲۶ گزینه‌ی بدون نگهداری داده هم فراهم می‌شود.

این خبر برای کاربران ایرانی چه معنایی دارد؟

این برنامه برای سازمان‌های تأییدشده‌ی امنیتی است و به شرایط ثبت‌نام و راستی‌آزمایی بستگی دارد. برای ما بیشتر نشانه‌ای از جهت‌گیری صنعت است: شرکت‌های هوش مصنوعی از مسدودسازی کامل به سمت دسترسی لایه‌بندی‌شده بر پایه‌ی اعتماد می‌روند. برای درک بهتر محدودیت‌ها و توان واقعی این فناوری، پتانسیل و محدودیت‌های هوش مصنوعی را بخوانید.

۱۰. تحلیل: این تصمیم چه پیامی دارد؟

گسترش CVP نشان می‌دهد آنتروپیک مسئله را «مسدودسازی یا آزادسازی» نمی‌بیند، بلکه آن را مسئله‌ی «چه کسی، با چه تأییدی، چه سطحی از توان را بگیرد» می‌داند. عددهای آزمون هم همین را می‌گویند: بین بسته‌بودن کامل و باز بودن کامل، یک طیف وجود دارد و شرکت می‌خواهد هر سازمان را در نقطه‌ی درست آن قرار دهد.

البته این رویکرد پرسش‌هایی هم دارد. راستی‌آزمایی چقدر دقیق خواهد بود؟ اگر حساب یک سازمان تأییدشده در معرض نفوذ قرار بگیرد چه می‌شود؟ و آیا نگهداری اجباری داده برای شرکت‌های حساس قابل‌قبول است؟ پاسخ این پرسش‌ها در ماه‌های آینده و با عرضه‌ی ابزارهای جدید مشخص می‌شود. اگر به رقابت مدل‌ها علاقه دارید، گزارش نبرد هوش‌های مصنوعی شطرنج‌باز هم خواندنی است.

در نهایت، برای تیم‌های امنیتی ایرانی و فارسی‌زبانی که در شرکت‌های بین‌المللی کار می‌کنند، این برنامه می‌تواند ابزار تازه‌ای برای دفاع باشد. اما به یاد داشته باشید که هوش مصنوعی هر چقدر هم قدرتمند شود، جای مهندس باتجربه را نمی‌گیرد؛ موضوعی که در مقاله‌ی توهم توسعه‌دهنده‌ی تنها در برابر مهندس واقعی به آن پرداخته‌ایم.

جمع‌بندی. آنتروپیک با سه سطح دفاعی، ردتیم و تخصصی، دسترسی به توان سایبری کلود را بر پایه‌ی راستی‌آزمایی لایه‌بندی کرد. آزمون CyScenarioBench نشان می‌دهد تفاوت سطح‌ها بسیار جدی است و پروژه‌ی Glasswing با بیش از ۱۲۹ هزار آسیب‌پذیری تأییدشده پشتوانه‌ی این تصمیم است. برای دنبال‌کردن داغ‌ترین اخبار هوش مصنوعی، کانال تلگرام @MrChatGPT_IR را دنبال کنید.

نسخهٔ فوری این مطلب در تلگرام: اینجا بخوانید

— (0 رأی)

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *