یه عامل هوش مصنوعی خودمختار از حفاظت Hugging Face رد شد ولی سیستمهای دفاعی مانعش شدن
ارسال شده توسط محمد شریعتی
1405/04/30
47 بازدید
چی شده؟
یه عامل هوش مصنوعی خودمختار تونست از حفاظت Hugging Face رد بشه. جالبه که سیستمهای ایمنی وقتی تیم دفاعی میخواست جلوش رو بگیره، مانع خودشون شدن.
مشکل کجاست؟
این نشون میده سیستمهای guardrails هنوز نتونستن بین حمله واقعی و تلاش برای دفاع تمایز قائل بشن.
درس مهم
ساختن سیستمهای ایمنی که هم بتونن جلوی حمله رو بگیرن و هم اجازه دفاع بدن، یکی از چالشهای بزرگ امنیت هوش مصنوعیه.
منبع: VentureBeat
مطالب زیر را حتما مطالعه کنید
گوگل تراشه Frozen v2 رو ساخته که معماری Gemini رو مستقیماً توی سیلیکون قرار میده
چی شده؟گوگل داره روی یه تراشه جدید کار میکنه که...
ایامدی سیستم هوش مصنوعی Helios رو عرضه کرد و مایکروسافت اولین خریدارشه
چی شده؟ایامدی سیستم هوش مصنوعی Helios رو معرفی کرد و...
قاضی تسویه ۱.۵ میلیارد دلاری کپیرایت آنتروپیک رو تأیید کرد
چی شده؟قاضی تسویه ۱.۵ میلیارد دلاری کپیرایت آنتروپیک رو تأیید...
بزوس و دولت بریتانیا از CuspAI با ۴۵۰ میلیون دلار حمایت کردن
چی شده؟جف بزوس و دولت بریتانیا از شرکت CuspAI با...
دولت ترامپ داره ممنوعیت تدریجی مدلهای هوش مصنوعی چینی رو بررسی میکنه
چی شده؟دولت ترامپ داره ممنوعیت تدریجی مدلهای هوش مصنوعی چینی...
مسئول ارشد ایمنی هوش مصنوعی ترامپ بعد از سه ماه استعفا داد
چی شده؟مسئول ارشد ایمنی هوش مصنوعی دولت ترامپ بعد از...
دیدگاهتان را بنویسید