چگونه مدل‌های OpenAI از زندان دیجیتال فرار کردند؟

آزمایشی که قرار بود توانایی مدل‌های هوش مصنوعی OpenAI در زنجیره‌سازی حملات سایبری را بسنجد، به سرعت از کنترل خارج شد. ترکیب دو مدل GPT ۵.۶ Sol و یک مدل قدرتمندتر که هنوز عرضه نشده، توانست یک آسیب‌پذیری در محیط سندباکس شناسایی کند و از آن خارج شود. پس از فرار، این مدل‌ها مستقیماً به … ادامه خواندن چگونه مدل‌های OpenAI از زندان دیجیتال فرار کردند؟