رتبهٔ اول شاخص ایمنی هوش مصنوعی تابستان ۲۰۲۶ برای Anthropic کلاد با نمرهٔ C+

شاخص ایمنی هوش مصنوعی ۲۰۲۶؛ چرا هیچ شرکتی نمرهٔ قبولی نگرفت؟

دسته · هوش مصنوعی

تازه‌ترین «شاخص ایمنی هوش مصنوعی» منتشر شد و کارنامه‌ای پر از نمره‌های پایین را جلوی چشم غول‌های فناوری گذاشت؛ جایی که حتی نفر اول جدول هم فقط نمرهٔ «C+» گرفت.

چکیده. مؤسسهٔ مستقل Future of Life در گزارش تابستان ۲۰۲۶ خود، ۹ شرکت پیشروی هوش مصنوعی جهان را از نظر ایمنی، شفافیت و پاسخگویی ارزیابی کرد. شرکت Anthropic (سازندهٔ کلاد) با نمرهٔ «C+» در صدر ایستاد، OpenAI و Google DeepMind هر دو نمرهٔ «C» گرفتند و شرکت‌هایی مانند xAI، دیپ‌سیک و Mistral مردود شدند. پیام محوری گزارش روشن است: سرعت توسعهٔ مدل‌ها از سرعت ایمن‌سازی آن‌ها بسیار جلوتر افتاده است.
رتبهٔ اول شاخص ایمنی هوش مصنوعی تابستان ۲۰۲۶ برای Anthropic کلاد با نمرهٔ C+

۱) شاخص ایمنی هوش مصنوعی چیست و چه کسی آن را می‌سازد؟

«شاخص ایمنی هوش مصنوعی» (AI Safety Index) پروژه‌ای است که مؤسسهٔ غیرانتفاعی و مستقل Future of Life به‌صورت دوره‌ای منتشر می‌کند. هدف این شاخص ساده اما مهم است: به‌جای آن‌که فقط به وعده‌ها و شعارهای شرکت‌ها دربارهٔ «هوش مصنوعی امن» تکیه کنیم، عملکرد واقعی آن‌ها با معیارهای مشخص سنجیده و در قالب یک کارنامهٔ نمره‌ای از A تا F منتشر شود. نسخهٔ تابستان ۲۰۲۶ تازه‌ترین ویرایش این گزارش است.

نکتهٔ کلیدی این‌جاست که داوری بر عهدهٔ یک هیئت مستقل از کارشناسان سرشناس حوزهٔ ایمنی و حکمرانی هوش مصنوعی بوده است؛ چهره‌هایی مانند استوارت راسل از دانشگاه برکلی، دیوید کروگر از دانشگاه مونترال، شارون لی از دانشگاه ویسکانسین-مدیسون، تیگان ماهاراج، اسنها روانور (بنیان‌گذار Encode)، رابرت تریگر از دانشگاه آکسفورد و یی زنگ از دانشگاه رنمین چین. این ترکیب بین‌المللی باعث می‌شود ارزیابی صرفاً یک نگاه از درون صنعت یا یک کشور خاص نباشد.

روش کار ترکیبی از بررسی اسناد و اطلاعات عمومی شرکت‌ها و پاسخ‌های خود آن‌ها به پرسش‌نامه‌ای تخصصی است. اگر می‌خواهید دیگر تحول‌های مهم این حوزه را هم دنبال کنید، می‌توانید سری به بخش اخبار هوش مصنوعی بزنید که مرتب به‌روزرسانی می‌شود. برای درک بهتر تصویر کلی، مرور پتانسیل‌ها و محدودیت‌های واقعی هوش مصنوعی هم می‌تواند کمک‌کننده باشد.

۲) نتایج کامل؛ ۹ شرکت و نمره‌هایشان

مهم‌ترین بخش هر گزارش، جدول نتایج آن است. در ویرایش تابستان ۲۰۲۶، رتبه‌بندی کلی ۹ شرکت به این شکل بود: شرکت Anthropic با نمرهٔ «C+» (حدود ۲٫۶۶ در مقیاس ۴ نمره‌ای) نفر اول شد. پس از آن OpenAI با «C» (نزدیک ۲٫۲۸) و Google DeepMind نیز با «C» (حدود ۲٫۰۱) در جایگاه دوم و سوم قرار گرفتند.

در میانهٔ جدول، شرکت Meta با نمرهٔ «D+» (حدود ۱٫۳۲) ایستاد. دو شرکت چینی Z.ai (ژی‌پو) و Alibaba Cloud هر دو نمرهٔ «D-» گرفتند و عملاً در مرز مردودی قرار داشتند. کف جدول اما تکان‌دهنده بود: xAI (سازندهٔ گراک) با «F»، دیپ‌سیک با «F» و شرکت فرانسوی Mistral با پایین‌ترین نمره یعنی «F» (حدود ۰٫۳۳) مردود اعلام شدند.

این نتایج نشان می‌دهد فاصلهٔ ایمنی میان شرکت‌ها بسیار زیاد است؛ اما نکتهٔ مهم‌تر این است که حتی صدرنشین جدول هم به نمرهٔ خوب یا عالی نرسیده است. برای آشنایی بیشتر با بازیگران اصلی این رقابت، می‌توانید مقالهٔ OpenAI چیست و چه می‌کند و همچنین تحلیل رقابت ChatGPT و دیپ‌سیک را بخوانید.

۳) چرا حتی نفر اول فقط «C+» گرفت؟

وقتی می‌شنویم یک شرکت «رتبهٔ اول ایمنی» را گرفته، ذهن‌مان سراغ تصویری از یک سیستم کاملاً امن و قابل اعتماد می‌رود. اما نمرهٔ «C+» چنین چیزی نیست؛ این نمره در بهترین حالت یعنی «قبولی با اکراه». به بیان ساده، Anthropic صرفاً کمتر از بقیه در ایمنی ضعف داشته، نه این‌که به استانداردی مطمئن رسیده باشد.

داوران تأکید کرده‌اند که هیچ‌یک از شرکت‌ها هنوز تضمین‌های محکم و قابل‌راستی‌آزمایی برای کنترل مدل‌های قدرتمند خود ارائه نکرده‌اند. به همین دلیل، سقف نمره‌ها در همین حدود متوقف مانده است. این واقعیت یادآور شکافی است که بین «تبلیغات» و «مهندسی واقعی» در این صنعت وجود دارد؛ موضوعی که در مقالهٔ توهم هوش مصنوعی؛ توسعه‌دهندهٔ تنها در برابر مهندس واقعی به‌خوبی شکافته شده است.

برای درک بهتر بد نبودن این نمره کافی است آن را به یک کارنامهٔ آموزشی تشبیه کنیم: «C+» نه مردودی است و نه نمرهٔ خوب؛ صرفاً یعنی «قابل قبول اما پر از ضعف». وقتی پیشروترین شرکت جهان هم در چنین سطحی می‌ماند، معنایش این است که کل صنعت هنوز در آغاز راه ایمن‌سازی است. مقایسهٔ نمره‌ها با ویرایش‌های قبلی نیز نشان می‌دهد که با وجود جهش چشمگیر در توانایی مدل‌ها، پیشرفت در حوزهٔ ایمنی بسیار کندتر بوده و همین ناهماهنگی، دل‌نگرانی اصلی کارشناسان است.

۴) شش معیاری که ایمنی با آن‌ها سنجیده شد

اعتبار این شاخص به شفافیت روش آن است. ارزیابی روی شش حوزهٔ اصلی انجام شده که هرکدام چند شاخص جزئی‌تر دارند: «ارزیابی ریسک» (۶ شاخص)، «آسیب‌های کنونی» (۹ شاخص)، «چارچوب‌های ایمنی» (۴ شاخص)، «ایمنی وجودی یا بلندمدت» (۴ شاخص)، «حاکمیت و پاسخگویی» (۴ شاخص) و «به‌اشتراک‌گذاری اطلاعات» (۱۰ شاخص).

این تقسیم‌بندی نشان می‌دهد ایمنی فقط به معنای «فیلترکردن پاسخ‌های بد» نیست. یک شرکت باید هم‌زمان ریسک‌های امروزی مثل تولید محتوای مضر را مدیریت کند، هم برای خطرهای بلندمدت برنامه داشته باشد، هم ساختار پاسخگویی شفاف بسازد و هم اطلاعات لازم را با پژوهشگران و نهادهای ناظر به اشتراک بگذارد. ضعف در هر یک از این حوزه‌ها می‌تواند نمرهٔ کل را پایین بیاورد.

نمرهٔ ایمنی OpenAI و ChatGPT در شاخص Future of Life تابستان ۲۰۲۶

۵) بحران «ایمنی بلندمدت»؛ خطرناک‌ترین بخش گزارش

اگر بخواهیم یک نقطهٔ هشدار مرکزی در کل گزارش پیدا کنیم، همان حوزهٔ «ایمنی وجودی» یا بلندمدت است. طبق یافته‌ها، هیچ شرکتی در این بخش نمره‌ای بالاتر از «C-» نگرفته و بیشترشان در سطح «D» یا پایین‌تر مانده‌اند. یعنی درست در همان بخشی که به خطرهای بزرگ و سیستمی مربوط می‌شود، همهٔ صنعت ضعیف است.

داوران این وضعیت را با یک جملهٔ کوتاه اما مهم توصیف کرده‌اند: «تشخیص، همان پیشگیری نیست.» به این معنا که بسیاری از شرکت‌ها ابزارهایی برای «شناساییِ» رفتار خطرناک مدل دارند، اما توانایی «جلوگیری» از آن رفتار پیش از وقوع را ندارند. این شکاف میان تشخیص و پیشگیری، هستهٔ نگرانی کارشناسان است.

چنین یافته‌ای مسئولیت کاربران و کسب‌وکارها را هم بیشتر می‌کند؛ چون نمی‌توان صرفاً به تضمین سازنده دل بست. اگر به فکر استفادهٔ حرفه‌ای از این ابزارها هستید، آشنایی با اهمیت هوش مصنوعی در کسب‌وکار به شما کمک می‌کند تصمیم‌های آگاهانه‌تری بگیرید.

۶) شکاف میان حرف و عمل

یکی از تلخ‌ترین یافته‌های گزارش این است که «حرف» شرکت‌ها لزوماً با «عمل» آن‌ها یکی نیست. داوران اشاره کرده‌اند که برخی شرکت‌ها که پیش‌تر کاربردهای نظامی را ممنوع کرده بودند، به‌تدریج این محدودیت‌ها را کنار گذاشته‌اند. نتیجه این است که تعهدهای اعلام‌شده را نمی‌توان معیار قابل‌اعتمادی برای رفتار واقعی دانست.

مشکل دیگر، ضعف ساختاری چارچوب‌های ایمنی است. بسیاری از این چارچوب‌ها روی کاغذ وجود دارند اما فاقد «آستانه‌های کمّی مشخص»، «ممیزی مستقل» و «مرجع تصمیم‌گیری روشن» هستند. یعنی معلوم نیست دقیقاً در چه نقطه‌ای باید توسعهٔ یک مدل متوقف شود و چه کسی اختیار این تصمیم را دارد. بدون این جزئیات، چارچوب ایمنی بیشتر به یک بیانیهٔ روابط‌عمومی شبیه است تا یک سازوکار اجرایی.

۷) این یک مشکل جهانی است؛ از آمریکا تا چین و اروپا

ممکن است تصور شود ضعف ایمنی مشکل یک منطقهٔ خاص است، اما داده‌ها خلاف این را نشان می‌دهند. نمره‌های مردودی در هر سه قطب اصلی فناوری دیده می‌شود: xAI در ایالات متحده، دیپ‌سیک در چین و Mistral در اروپا، همگی «F» گرفتند. دو شرکت چینی دیگر هم در سطح «D-» ماندند.

این پراکندگی جغرافیایی پیام مهمی دارد: رقابت شدید برای عرضهٔ سریع‌تر مدل‌ها یک پدیدهٔ جهانی است و همه‌جا ایمنی را زیر فشار قرار داده است. به عبارت دیگر، مسئله فرهنگ یک شرکت یا قوانین یک کشور نیست، بلکه ماهیت مسابقه‌ای است که در آن «اول‌بودن» بر «امن‌بودن» اولویت پیدا کرده. همین موضوع، ضرورت استانداردهای مشترک بین‌المللی را پررنگ‌تر می‌کند.

۸) این گزارش برای کاربر عادی چه معنایی دارد؟

برای کاربری که هر روز از ابزارهایی مثل ChatGPT، کلاد یا Gemini استفاده می‌کند، این گزارش به معنای «خطر فوری» نیست؛ استفادهٔ روزمره از این ابزارها همچنان کاربردی و ارزشمند است. اما پیام روشن است: به تضمین‌های تبلیغاتی سازندگان تکیهٔ کامل نکنید و مسئولیت داده‌ها و تصمیم‌های حساس را به‌طور کامل به مدل نسپارید.

برای کسب‌وکارها این هشدار جدی‌تر است. اگر قرار است هوش مصنوعی را در فرایندهای مهم به کار بگیرید، باید سیاست‌های شفاف برای حریم داده، بازبینی انسانی و انتخاب ابزار مناسب داشته باشید. مهارت در نوشتن دستور درست هم بخشی از استفادهٔ ایمن و مؤثر است؛ برای شروع می‌توانید آموزش‌های ChatGPT و راهنمای نوشتن پرامپت به زبان ساده را دنبال کنید.

در نهایت، ارزش این شاخص در همین است که بحث ایمنی را از شعار به عدد تبدیل می‌کند و به کاربر و سیاست‌گذار ابزاری برای مقایسه می‌دهد. هرچه تقاضای عمومی برای شفافیت بیشتر شود، انگیزهٔ شرکت‌ها برای بهبود نمره‌شان هم بالاتر می‌رود.

پرسش‌وپاسخ کوتاه (FAQ)

کدام هوش مصنوعی امن‌ترین شناخته شد؟

در شاخص ایمنی تابستان ۲۰۲۶، شرکت Anthropic (سازندهٔ کلاد) با نمرهٔ «C+» رتبهٔ اول را گرفت. با این حال این نمره به معنای ایمنی کامل نیست، بلکه یعنی این شرکت نسبت به رقبا کمترین ضعف را داشته است.

چرا همهٔ نمره‌ها این‌قدر پایین بود؟

دلیل اصلی، شدت رقابت برای عرضهٔ سریع‌تر مدل‌هاست که باعث شده ایمنی به اولویت دوم تبدیل شود. نبود آستانه‌های کمّی، ممیزی مستقل و چارچوب‌های اجرایی روشن نیز نمره‌ها را پایین نگه داشته است.

آیا استفاده از این ابزارها خطرناک است؟

استفادهٔ روزمره برای کارهای معمول عموماً بی‌خطر است. نگرانی گزارش بیشتر متوجه ریسک‌های سیستمی و بلندمدت است، نه چت ساده. با این حال بهتر است داده‌های حساس را با احتیاط وارد کنید و به بازبینی انسانی تکیه کنید.

شاخص بعدی کی منتشر می‌شود؟

مؤسسهٔ Future of Life این گزارش را به‌صورت دوره‌ای منتشر می‌کند و انتظار می‌رود نسخهٔ بعدی نیز در ادامهٔ همین روند عرضه شود تا روند تغییر نمره‌ها قابل پیگیری باشد.

جمع‌بندی. شاخص ایمنی هوش مصنوعی تابستان ۲۰۲۶ تصویری صریح ارائه داد: هیچ غول فناوری‌ای هنوز به ایمنی مطمئن نرسیده و بالاترین نمره تنها «C+» بوده است. مسابقهٔ سرعت، ایمنی را قربانی کرده و شکاف میان حرف و عمل جدی است. برای دنبال‌کردن داغ‌ترین و دقیق‌ترین اخبار هوش مصنوعی به زبان فارسی، کانال ما را در تلگرام دنبال کنید: @MrChatGPT_IR.

نسخهٔ فوری این مطلب در تلگرام: اینجا بخوانید

(0 رأی)

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

ورود | ثبت نام
شماره موبایل یا پست الکترونیک خود را وارد کنید

روش دریافت کد تایید

ورود / ثبت‌نام با گوگل

ورود با تلگرام

ورود با لینک جادویی

برگشت
کد تایید را وارد کنید
کد تایید برای شماره موبایل شما ارسال گردید
کد تایید از طریق بازوی "رمز یکبار مصرف (OTP)" در پیام رسان بله برای شما ارسال شد"
برای دریافت کد تایید، شماره زیر را با موبایل خود به صورت کاملاً رایگان شماره گیری کنید"
تا لحظاتی دیگر برای اعلام کد تایید با شما تماس خواهیم گرفت
ارسال مجدد کد تا دیگر

روش دریافت کد تایید

ورود / ثبت‌نام با گوگل

ورود با تلگرام

ورود با لینک جادویی

برگشت
رمز عبور را وارد کنید
رمز عبور حساب کاربری خود را وارد کنید

ورود / ثبت‌نام با گوگل

ورود با تلگرام

ورود با لینک جادویی

برگشت
درخواست بازیابی رمز عبور
لطفاً پست الکترونیک یا موبایل خود را وارد نمایید

ورود / ثبت‌نام با گوگل

ورود با تلگرام

ورود با لینک جادویی

برگشت
کد تایید را وارد کنید
کد تایید برای شماره موبایل شما ارسال گردید
ارسال مجدد کد تا دیگر

ورود / ثبت‌نام با گوگل

ورود با تلگرام

ورود با لینک جادویی

ایمیل بازیابی ارسال شد!
لطفاً به صندوق الکترونیکی خود مراجعه کرده و بر روی لینک ارسال شده کلیک نمایید.

ورود / ثبت‌نام با گوگل

ورود با تلگرام

ورود با لینک جادویی

تغییر رمز عبور
یک رمز عبور برای اکانت خود تنظیم کنید

ورود / ثبت‌نام با گوگل

ورود با تلگرام

ورود با لینک جادویی

تغییر رمز با موفقیت انجام شد

ورود / ثبت‌نام با گوگل

ورود با تلگرام

ورود با لینک جادویی

دریافت ۵۰ پرامپت برای سوالات پیچیده

دریافت فایل