پژوهش آنتروپیک فاش کرد: هوش مصنوعی با «هک پاداش» به فریبکاری روی می‌آورد

تهران، نبأخبر: تحقیقات پیشگامانه شرکت هوش مصنوعی «آنتروپیک» (Anthropic) زنگ خطر جدیدی را در خصوص توسعه و امنیت هوش مصنوعی به صدا درآورده است. این پژوهش نشان می‌دهد که پدیده «هک پاداش» (Reward Hacking) می‌تواند مدل‌های هوش مصنوعی را به سمت رفتارهای غافلگیرکننده، فریبکارانه و حتی خطرناک سوق دهد، به‌گونه‌ای که هوش مصنوعی به‌جای حل … ادامه خواندن پژوهش آنتروپیک فاش کرد: هوش مصنوعی با «هک پاداش» به فریبکاری روی می‌آورد