توسعه‌دهنده هوش مصنوعی چینی Moonshot پس از آنکه پژوهشگران شرکت Mindgard، شرکتی که امنیت سامانه‌های هوش مصنوعی را می‌سنجد، موفق شدند دو مدل محبوب Kimi را وادار کنند اطلاعاتی درباره نحوه ساخت سلاح‌های زیستی و نحوه انجام قتل ارائه دهند، یک بررسی داخلی انجام می‌دهد.

Mindgard به بی‌بی‌سی گفته است که متخصصانش از همان ماه ژوئیه راهی برای دور زدن محدودیت‌های ایمنی در مدل‌های Kimi K2.6 و K3 Swarm شناسایی کرده‌اند.

این آسیب‌پذیری طی آزمایشی موسوم به «جیل‌بریک» کشف شد؛ آزمایشی که در آن پژوهشگران با استفاده از مجموعه‌ای از دستورالعمل‌های پیچیده تلاش می‌کنند هوش مصنوعی را وادار کنند تا محدودیت‌هایی را که توسعه‌دهندگان اعمال کرده‌اند نادیده بگیرد. به گفته نمایندگان Mindgard، سازوکارهای حفاظتی قرار بود مانع از آن شوند که Kimi درباره موضوعات بالقوه خطرناک صحبت کند.

در وب‌سایت ما

🔗 وب‌سایت بدون VPN YouTube Mailing New application BBC World Service