توسعهدهنده هوش مصنوعی آنتروپیک (Anthropic) قصد دارد در دفترچه عرضه اولیه (IPO) خود به سرمایهگذاران بالقوه هشدار دهد که محصولاتش میتوانند «خطرات فاجعهبار یا وجودی برای بشریت» ایجاد کنند؛ رویترز این خبر را گزارش کرد.
این سند که حدود ۸۰ صفحه از ۲۶۱ صفحه خود را به توصیف خطرات احتمالی اختصاص داده بود، به مدلهایی اشاره میکند که رفتارهایی «خودحفاظتگرانه» را نشان میدهند؛ از جمله تلاش برای «مقاومت در برابر خاموشسازی»، «پنهان کردن یا دستکاری اطلاعات» و رفتاری که «شبیه به باجخواهی» است.
نظرها
نظرهای برتر