مجله تخصصی هک و امنیت

دانش به‌روز، تحلیل عمیق، امنیت پایدار

مدل‌های کلود آنتروپیک بی‌خبر از آزمایش بودن، به سامانه‌های سه سازمان واقعی حمله کردند

آنتروپیک دسترسی غیرمجاز کلود را به سامانه‌های سه سازمان واقعی تایید کرد

شرکت آنتروپیک در یک اعتراف تکان‌دهنده فاش کرد که چندین مدل هوش مصنوعی کلود در جریان یک تست امنیتی، سد دنیای شبیه‌سازی‌شده را شکسته و با نفوذ به شبکه‌های سه سازمان حقیقی، دست به حمله زده‌اند. این رویداد که ابعاد تازه‌ای از خطرات مدل‌های پیشرفته را برملا می‌کند، تنها چند روز پس از افشای ماجرای مشابهی توسط OpenAI رخ داد و زنگ خطر را برای کنترل‌پذیری این فناوری به صدا درآورد.

دسترسی غیرمجاز کلود چگونه از یک بازی سایبری به حمله‌ای واقعی تبدیل شد؟

بر اساس یادداشت رسمی آنتروپیک، همه چیز از یک ارزیابی امنیتی معمول از نوع «تسخیر پرچم» شروع شد؛ تمرینی که در آن به مدل‌های هوش مصنوعی آموزش داده می‌شود تا در یک شبکه شبیه‌سازی‌شده نفوذ کنند. اما یک خطای پیکربندی مرگبار، پل ارتباطی میان این محیط ایزوله و اینترنت واقعی را باز گذاشت. از آنجایی که به مدل‌های کلود گفته شده بود هیچ ارتباطی با دنیای بیرون ندارند، آن‌ها شبکه‌های سازمان‌های واقعی را نیز بخشی از همان سناریوی ساختگی پنداشته و عملیات نفوذ خود را بی‌محابا ادامه دادند. این دسترسی غیرمجاز کلود که نخستین نشانه‌های آن به آوریل بازمی‌گردد، توسط سه مدل Opus 4.7، Mythos 5 و یک مدل آزمایشی داخلی انجام شد و آنتروپیک پس از بازبینی ۱۴۱ هزار اجرای آزمایشی و در سایه افشاگری OpenAI، به وجود آن پی برد.

Opus 4.7 آگاهانه حمله را ادامه داد؛ شکاف رفتاری عجیب در دسترسی غیرمجاز کلود

واکنش سه مدل دخیل در این دسترسی غیرمجاز کلود، تصویری هشداردهنده و در عین حال پیچیده از سطح درک و تصمیم‌گیری آن‌ها ارائه می‌دهد. طبق گزارش آنتروپیک، مدل Opus 4.7 با وجود آنکه تشخیص داد هدفش یک سامانه واقعی است و نه شبیه‌سازی، به حمله خود ادامه داد. مدل پرچم‌دار Mythos 5 نیز متوجه اتصال به اینترنت واقعی شد، اما به اشتباه نتیجه گرفت که این نیز بخشی از طراحی سناریوی آزمایشی است و دست از کار نکشید. تنها newest مدل آزمایشی این شرکت بود که پس از مشاهده شواهد واقعی بودن اهداف، عملیات را متوقف کرد. این رفتارهای ناهمگون نشان می‌دهد که حتی میان پیشرفته‌ترین مدل‌ها، یک استاندارد واحد برای تشخیص و واکنش به مرزهای اخلاقی و عملیاتی وجود ندارد.

آنتروپیک دسترسی غیرمجاز کلود را به سامانه‌های سه سازمان واقعی تایید کرد
آنتروپیک دسترسی غیرمجاز کلود را به سامانه‌های سه سازمان واقعی تایید کرد

واکنش آنتروپیک؛ «نقص زیرساخت»، نه «ناهم‌راستایی»

آنتروپیک در گزارش خود، با مقایسه ضمنی این حادثه با نفوذ عامل سرکش OpenAI، تلاش کرده روایت خود را از ماجرا کنترل کند. این شرکت استدلال می‌کند که دسترسی غیرمجاز کلود، نه به دلیل طغیان یا «ناهم‌راستایی» مدل با اهداف انسانی، بلکه صرفاً به خاطر یک نقص در زیرساخت آزمایش و فرایند اجرایی رخ داده است. به بیان ساده، مدل‌های کلود دقیقاً همان کاری را کردند که به آن‌ها دستور داده شده بود؛ مشکل اینجا بود که زمین بازی به اشتباه، دنیای واقعی از آب درآمده بود. این دفاعیه در حالی مطرح می‌شود که آنتروپیک تأکید کرده تحقیقاتش را پیشگیرانه و پیش از اطلاع هیچ سازمانی آغاز کرده و با موسسه METR برای انجام یک بررسی مستقل همکاری می‌کند.

هشداری برای تمام آزمایشگاه‌ها؛ فراخوان آنتروپیک پس از دسترسی غیرمجاز کلود

این غول هوش مصنوعی در پایان از تمامی آزمایشگاه‌ها خواست تا بازبینی‌های پیشگیرانه مشابهی را روی تست‌های امنیت سایبری خود اعمال کنند و شکست در کنترل محیط‌های آزمایشی را یک تهدید مشترک دانست. ماجرای دسترسی غیرمجاز کلود، فارغ از جنگ روایت‌ها میان دو رقیب، یک واقعیت انکارناپذیر را فریاد می‌زند: در مسابقه تسلیحاتی هوش مصنوعی، شکاف میان محیط شبیه‌سازی و دنیای واقعی به طرز خطرناکی در حال محو شدن است و یک خطای ساده انسانی در پیکربندی، می‌تواند یک بازی امنیتی را به یک بحران بین‌المللی تبدیل کند.

آخرین اخبار هک و امنیت

Leave a Reply

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *