هشدار امنیتی: مهاجمان با جعل ربات‌های هوش مصنوعی به دنبال رمزهای شما هستند

هشدار امنیتی: مهاجمان با جعل ربات‌های هوش مصنوعی به دنبال رمزهای شما هستند

اخبار · هوش مصنوعی

شرکت امنیتی GreyNoise از کشف شبکه‌ای گسترده خبر داده که با جعل دقیق هویت ربات‌های خزنده‌ی OpenAI، Anthropic و DeepSeek، به‌طور سازمان‌یافته در جست‌وجوی رمز عبور و کلیدهای ابری سایت‌هاست.

چکیده. پژوهشگران امنیتی ۸۲۴ آدرس اینترنتی را شناسایی کرده‌اند که خود را به‌جای ربات‌های شناخته‌شده‌ای مثل ClaudeBot و GPTBot جا زده و به‌دنبال فایل‌های حساس مثل env. و پوشه‌ی گیت بوده‌اند. هیچ‌کدام از این آدرس‌ها به شرکت‌های واقعی هوش مصنوعی تعلق ندارد؛ تنها نام و شناسه‌ی آن‌ها بدون اجازه سوءاستفاده شده است.
تصویر هشدار امنیتی درباره جعل هویت ربات ClaudeBot برای سرقت اطلاعات سایت‌ها

۱. ماجرا از کجا شروع شد؟

در روزهای اخیر، تیم تحقیقاتی شرکت امنیتی GreyNoise گزارشی منتشر کرد که بازتاب گسترده‌ای در جامعه‌ی امنیت سایبری داشت. طبق این گزارش، گروهی از مهاجمان ناشناس، از تابستان امسال یک کارزار اسکن گسترده را علیه سرورهای وب در سراسر جهان به راه انداخته‌اند. نکته‌ی عجیب این کارزار آن بود که ترافیک آن دقیقاً شبیه رفتار ربات‌های خزنده‌ی معتبر هوش مصنوعی به نظر می‌رسید؛ ربات‌هایی که هر روز برای جمع‌آوری داده و آموزش مدل‌های زبانی از میلیون‌ها سایت بازدید می‌کنند.

بررسی‌های دقیق‌تر نشان داد که این ترافیک واقعاً از سوی شرکت‌های هوش مصنوعی نبود، بلکه مهاجمانی با دانش فنی بالا، شناسه‌ی کاربری (User-Agent) این ربات‌ها را کاراکتر به کاراکتر کپی کرده بودند تا فایروال‌ها و سامانه‌های امنیتی سایت‌ها را فریب دهند. برای آشنایی بیشتر با ماهیت این شرکت‌ها و نقش آن‌ها در اکوسیستم هوش مصنوعی، می‌توانید مقاله‌ی OpenAI چیست و چه می‌کند را در سایت ما بخوانید.

۲. کدام ربات‌ها جعل شدند؟

بر اساس گزارش GreyNoise، مهاجمان شناسه‌ی چند ربات معروف را به‌طور هم‌زمان جعل کرده بودند، از جمله ClaudeBot متعلق به Anthropic، و GPTBot، ChatGPT-User و OAI-SearchBot متعلق به OpenAI. علاوه بر این، ردپایی از جعل هویت Google-Extended (ربات گوگل برای آموزش مدل جمینای) و PerplexityBot نیز در داده‌ها دیده شده است. جالب اینکه شناسه‌ی جعلی ClaudeBot آن‌قدر دقیق ساخته شده بود که حتی حرف‌به‌حرف با نسخه‌ی رسمی و واقعی آن یکسان بود.

این سطح از دقت در جعل، نشان‌دهنده‌ی آن است که مهاجمان به‌خوبی می‌دانستند بسیاری از سامانه‌های امنیتی و فایروال‌های وب، ترافیک ربات‌های شناخته‌شده‌ی هوش مصنوعی را به‌طور پیش‌فرض «قابل‌اعتماد» یا کم‌خطر در نظر می‌گیرند و آن را کمتر بازرسی می‌کنند. رقابت فشرده‌ی این شرکت‌ها بر سر داده و رتبه‌بندی، حتی به موضوع کشمکش‌های فنی میان مدل‌ها هم رسیده؛ نمونه‌ی آن را در مقایسه‌ی ChatGPT و DeepSeek در شطرنج می‌توانید ببینید.

۳. مهاجمان دنبال چه چیزی بودند؟

هدف این کارزار، بازدید ساده از سایت‌ها نبود. تحلیل ترافیک نشان داد که این ربات‌های جعلی به‌طور مشخص و مکرر، مسیرهایی مانند فایل env.، env.production.، env.bak.، پوشه‌ی پیکربندی git.، مسیر aws/credentials/. و محل ذخیره‌ی کلیدهای خصوصی و رمزهای عبور را درخواست می‌کردند. این فایل‌ها معمولاً به‌اشتباه در دسترس عمومی قرار می‌گیرند و حاوی اطلاعاتی حیاتی مثل رمز پایگاه‌داده، کلید سرویس‌های ابری آمازون و مایکروسافت، و توکن‌های ورود به سرویس‌های شخص ثالث هستند.

به گفته‌ی پژوهشگران، حجم این درخواست‌ها به میلیون‌ها بار در طول چند هفته رسیده بود؛ رقمی که نشان می‌دهد این یک آزمایش کوچک نبوده، بلکه یک عملیات اسکن صنعتی و خودکار در مقیاس جهانی بوده است.

۴. سرنخی که همه‌چیز را لو داد

عادت کوچکی که ربات‌های واقعی همیشه دارند

یکی از قوانین نانوشته‌ی اینترنت این است که هر خزنده‌ی قانونمند، پیش از بازدید از یک سایت، ابتدا سراغ فایل robots.txt می‌رود تا محدودیت‌های تعیین‌شده توسط صاحب سایت را بشناسد و رعایت کند. ربات‌های واقعی OpenAI، Anthropic، گوگل و پرپلکسیتی، همه این کار را انجام می‌دهند. اما پژوهشگران GreyNoise متوجه شدند که هیچ‌کدام از ۸۲۴ آدرس مشکوک، حتی یک‌بار هم چنین درخواستی ثبت نکرده‌اند.

همین رفتار ساده و به‌ظاهر کوچک، سرنخ اصلی برای شناسایی این شبکه‌ی جعلی بود. پس از آن، تیم تحقیقاتی این آدرس‌ها را با فهرست رسمی بازه‌های آی‌پی منتشرشده توسط هر شرکت مقایسه کرد و به نتیجه‌ای قطعی رسید: هیچ‌کدام از این ۸۲۴ آدرس با آی‌پی رسمی OpenAI، Anthropic، گوگل یا آمازون هم‌خوانی نداشت، در حالی‌که هزاران نشست واقعی ClaudeBot در همان بازه‌ی زمانی، دقیقاً از آدرس‌های رسمی Anthropic ثبت شده بود.

۵. چرا این خبر برای همه مهم است و چه کسی مقصر است؟

این ماجرا فقط یک خبر امنیتی صرف نیست؛ نشانه‌ای است از اینکه چگونه اعتماد عمومی به برندهای بزرگ هوش مصنوعی می‌تواند به سلاحی در دست مهاجمان تبدیل شود. همان‌طور که در مقاله‌ی پتانسیل و محدودیت‌های واقعی هوش مصنوعی بررسی کرده‌ایم، رشد سریع این فناوری همیشه با ریسک‌های تازه همراه است؛ از سوءاستفاده در تولید محتوای جعلی گرفته تا جعل هویت زیرساختی ربات‌ها.

اما پرسش مهم‌تر این است: آیا خودِ OpenAI، Anthropic یا DeepSeek در این ماجرا مقصرند؟ پاسخ کوتاه، خیر است. هیچ‌کدام از این شرکت‌ها نقشی در طراحی یا اجرای این کارزار نداشته‌اند. آنچه رخ داده، سوءاستفاده از نام و شناسه‌ی فنی این شرکت‌ها توسط اشخاص ثالث ناشناس است؛ دقیقاً مانند کلاهبرداری‌های ایمیلی که با جعل نام یک بانک یا سازمان معتبر انجام می‌شود. با این حال، این اتفاق فشار تازه‌ای بر شرکت‌های هوش مصنوعی وارد می‌کند تا سازوکارهای تأیید هویت ربات‌های خود را شفاف‌تر و قابل‌اعتمادتر کنند.

نمودار خبری درباره جعل هویت ربات GPTBot متعلق به OpenAI برای اسکن سایت‌ها

۶. این اتفاق چه تأثیری بر کسب‌وکارها دارد؟

برای کسب‌وکارهایی که وب‌سایت یا سرویس آنلاین دارند، این خبر یادآوری جدی‌ای است که امنیت زیرساخت را نباید دست‌کم گرفت. بسیاری از استارتاپ‌ها و کسب‌وکارهای کوچک، بدون آگاهی کافی، فایل‌های پیکربندی حساس را در دسترس عمومی باقی می‌گذارند و همین سهل‌انگاری، هزینه‌ی سنگینی در پی دارد؛ از افشای اطلاعات مشتریان گرفته تا سوءاستفاده از حساب‌های ابری برای اجاره‌ی محاسبات به دیگران. همان‌طور که در مطلب اهمیت هوش مصنوعی در کسب‌وکار اشاره کرده‌ایم، بهره‌گیری از فناوری‌های نوین همیشه باید با رعایت اصول امنیتی همراه باشد، وگرنه همان مزیت رقابتی می‌تواند به یک نقطه‌ضعف بزرگ تبدیل شود. بیمه‌ی سایبری، ارزیابی دوره‌ای امنیت و آموزش تیم فنی، دیگر یک هزینه‌ی اضافه نیست بلکه بخشی جدایی‌ناپذیر از اداره‌ی هر کسب‌وکار آنلاین به شمار می‌رود.

۷. چطور بفهمیم سایت ما هدف قرار گرفته؟

بررسی لاگ سرور

مدیران سایت باید لاگ دسترسی سرور خود را برای درخواست‌های مشکوک به مسیرهایی مانند env./، git./ و aws/credentials/. بررسی کنند. اگر چنین درخواست‌هایی از آدرس‌هایی دیده شد که با فهرست رسمی منتشرشده توسط شرکت‌های هوش مصنوعی مطابقت ندارد، احتمال زیاد سایت هدف این کارزار بوده است.

مقایسه با فهرست رسمی

هر شرکت بزرگ هوش مصنوعی، فهرست رسمی بازه‌های آی‌پی ربات خود را منتشر می‌کند. تکیه‌ی صرف بر نام ربات در سربرگ درخواست (User-Agent) کافی نیست؛ چون همان‌طور که دیدیم، این نام به‌راحتی قابل جعل است. ابزارهای رایگان آنلاین هم وجود دارند که آدرس اینترنتی مشکوک را در لحظه با فهرست رسمی شرکت‌ها مقایسه می‌کنند.

۸. راهکارهای فوری برای محافظت از سایت

کارشناسان امنیتی چند اقدام فوری را به مدیران سایت توصیه می‌کنند: نخست، فایل‌های env.، پوشه‌ی git. و هر فایل حاوی رمز یا کلید باید کاملاً از دسترس عمومی و از مسیر اصلی سرور (وب‌روت) خارج شوند. دوم، در صورت هرگونه شک به افشای اطلاعات، باید فوراً تمام کلیدهای سرویس‌های ابری و رمزهای مرتبط را تعویض کرد؛ چراکه فرض بر این است که هر کلید در معرض دید عمومی، لو رفته تلقی شود. سوم، تیم‌های امنیتی باید هشدارهایی برای درخواست به مسیرهای حساس تنظیم کنند و ربات‌هایی را که هرگز سراغ robots.txt نمی‌روند، مشکوک تلقی کنند. چهارم، فعال‌سازی احراز هویت دومرحله‌ای برای همه‌ی حساب‌های مدیریتی سرور و پنل‌های ابری، لایه‌ی دفاعی دیگری در برابر سوءاستفاده از کلیدهای احتمالاً لو رفته ایجاد می‌کند.

در نهایت، بسیاری از این حوادث ریشه در پیکربندی نادرست یا بی‌توجهی انسانی دارند، نه ضعف خودِ فناوری. تفاوت میان یک توسعه‌دهنده‌ی مبتدی و یک مهندس باتجربه، دقیقاً در همین جزئیات امنیتی دیده می‌شود؛ موضوعی که در مقاله‌ی توهم توسعه‌دهنده‌ی تنها در برابر مهندس واقعی به آن پرداخته‌ایم.

تصویر خبری درباره سوءاستفاده از نام ربات Google-Extended برای سرقت فایل‌های حساس سایت‌ها

۹. چشم‌انداز آینده: اعتماد به ربات‌های هوش مصنوعی

با رشد روزافزون خزنده‌های هوش مصنوعی و افزایش سهم آن‌ها از ترافیک وب جهانی، احتمال می‌رود شرکت‌های بزرگ به سمت سازوکارهای تأیید هویت قوی‌تری مانند امضای دیجیتال درخواست‌ها یا گواهی‌های رمزنگاری‌شده حرکت کنند. تا آن زمان، مسئولیت اصلی بر عهده‌ی مدیران سایت است تا به شناسه‌ی نام یک ربات به‌تنهایی اعتماد نکنند. اگر می‌خواهید با نحوه‌ی درست نوشتن درخواست و تعامل امن با ابزارهای هوش مصنوعی بیشتر آشنا شوید، سری آموزش‌های آموزش ChatGPT در مرچت‌جی‌پی‌تی نقطه‌ی خوبی برای شروع است.

پرسش‌های پرتکرار

آیا حساب کاربری من در ChatGPT یا Claude در خطر است؟
خیر، این کارزار به سرورها و سایت‌ها حمله می‌کند، نه به حساب‌های کاربری سرویس‌های چت هوش مصنوعی. با این حال، رعایت اصول کلی امنیت حساب مثل رمز عبور قوی همیشه توصیه می‌شود.

چرا مهاجمان به‌جای حمله‌ی مستقیم، هویت ربات‌های هوش مصنوعی را جعل کردند؟
چون بسیاری از سامانه‌های امنیتی، ترافیک ربات‌های شناخته‌شده را کم‌خطرتر ارزیابی می‌کنند و آن را با دقت کمتری بازرسی می‌کنند؛ همین باعث می‌شود جعل هویت این ربات‌ها، احتمال شناسایی حمله را کاهش دهد.

چگونه بفهمیم یک درخواست واقعاً از OpenAI یا Anthropic آمده؟
باید آدرس اینترنتی درخواست‌کننده را با فهرست رسمی بازه‌های آی‌پی منتشرشده توسط همان شرکت مقایسه کرد، نه صرفاً به نام نوشته‌شده در سربرگ درخواست تکیه کرد.

آیا این اولین‌بار است که هویت ربات‌های هوش مصنوعی جعل می‌شود؟
خیر، اما مقیاس این کارزار با ۸۲۴ آدرس در ۷۹۵ شبکه‌ی مجزا، یکی از بزرگ‌ترین نمونه‌های ثبت‌شده تا امروز است.

جمع‌بندی. کشف این شبکه‌ی جعلی یادآوری جدی برای هر کسی است که یک سایت یا سرویس آنلاین اداره می‌کند: نام آشنا و معتبر یک ربات هوش مصنوعی، به‌تنهایی نشانه‌ی امنیت نیست. بررسی دقیق آدرس‌ها، پاک‌سازی فایل‌های حساس و به‌روز نگه‌داشتن دانش امنیتی، تنها راه مقابله با این نوع سوءاستفاده‌هاست. برای دنبال‌کردن جدیدترین اخبار و تحلیل‌های امنیتی و فناوری هوش مصنوعی، کانال اخبار هوش مصنوعی مرچت‌جی‌پی‌تی در سایت و صفحه‌ی @MrChatGPT_IR در تلگرام را دنبال کنید.

نسخهٔ فوری این مطلب در تلگرام: اینجا بخوانید

(0 رأی)

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *