بنچمارک جدید Claude Fable 5 و GPT-5.6 Sol را در مسئله NP-hard مقایسه کرد
ارسال شده توسط محمد شریعتی
1405/04/28
9 بازدید
بنچمارک جدید Claude Fable 5 و GPT-5.6 Sol را در مسئله NP-hard مقایسه کرد
یک توسعهدهنده عملکرد Claude Fable 5 و GPT-5.6 Sol را روی یک مسئله بهینهسازی شبکه فیبر NP-hard منتشرنشده آزمایش کرد. این آزمایش با و بدون حالت /goal هر دو مدل انجام شد. Fable 5 بهترین راهحل را با ثبات غیرمعمولی ارائه داد و نویسنده آن را «هوش خام ناب» نامید.
حالت /goal ثابت کرد که یک کلید «تلاش بیشتر» عمومی نیست. این حالت گاهی حوضچه راهحل بهتری پیدا میکرد و گاهی اجازه میداد یک رویکرد نامناسب به بلوغ برسد. کد، پرامپتها و جداول نتایج در GitHub با نام CLIArena منتشر شدهاند.
این مقایسه نشاندهنده رقابت تنگاتنگ بین مدلهای پیشرفته هوش مصنوعی در حل مسائل پیچیده بهینهسازی است. نتایج حاصل اطلاعات ارزشمندی درباره قابلیتهای هر مدل در مقایسه با دیگری ارائه میدهد.
منبع: Hacker News
مطالب زیر را حتما مطالعه کنید
گوگل تراشه Frozen v2 رو ساخته که معماری Gemini رو مستقیماً توی سیلیکون قرار میده
چی شده؟گوگل داره روی یه تراشه جدید کار میکنه که...
ایامدی سیستم هوش مصنوعی Helios رو عرضه کرد و مایکروسافت اولین خریدارشه
چی شده؟ایامدی سیستم هوش مصنوعی Helios رو معرفی کرد و...
یه عامل هوش مصنوعی خودمختار از حفاظت Hugging Face رد شد ولی سیستمهای دفاعی مانعش شدن
چی شده؟یه عامل هوش مصنوعی خودمختار تونست از حفاظت Hugging...
قاضی تسویه ۱.۵ میلیارد دلاری کپیرایت آنتروپیک رو تأیید کرد
چی شده؟قاضی تسویه ۱.۵ میلیارد دلاری کپیرایت آنتروپیک رو تأیید...
بزوس و دولت بریتانیا از CuspAI با ۴۵۰ میلیون دلار حمایت کردن
چی شده؟جف بزوس و دولت بریتانیا از شرکت CuspAI با...
دولت ترامپ داره ممنوعیت تدریجی مدلهای هوش مصنوعی چینی رو بررسی میکنه
چی شده؟دولت ترامپ داره ممنوعیت تدریجی مدلهای هوش مصنوعی چینی...
دیدگاهتان را بنویسید