بهروزرسانی محرمانه Gemma 4: رفع باگ فراخوانی ابزار و بهبود پاسخدهی
گوگل بهروزرسانی محرمانهای را برای مدلهای متنباز Gemma 4 منتشر کرد که در آن Flash Attention 4 فعال شده است. این فناوری پردازش پرامپتها را بین ۲۵ تا ۷۰ درصد روی GPUهای انویدیا Hopper تسریع میکند و زمان تا اولین توکن را تا ۳۱ درصد کاهش میدهد. بهروزرسانی جدید همچنین باگهای فراخوانی ابزار و مواردی را که مدل پاسخها را ناقص برمیگرداند، رفع کرده است.
بهبود استدلال عاملی و پشتیبانی OCR
گوگل اعلام کرد که استدلال عاملی در تمام سناریوهای آزمایششده بهبود یافته و در یک مورد استفاده در حوزه مخابرات تا ۱۰.۱ درصد عملکرد بهتری ثبت شده است. کاربران همچنین میتوانند با افزایش پارامتر بودجه توکن، OCR را تا رزولوشن ۲.۵۱ مگاپیکسل بهبود بخشند.
واکنش جامعه به تغییرات نسخهگذاری
گوگل تمام اندازههای پارامتری نسل Gemma 4 را بهروزرسانی کرده اما همه را تحت همان نام Gemma 4 عرضه کرده است. این تصمیم با انتقاداتی از سوی جامعه توسعهدهندگان مواجه شده، زیرا تفکیک نسخهها را دشوار میکند. با این حال، عملکرد بهبودیافته مدلها بهویژه در حوزه ابزار فراخوانی و پاسخدهی کامل، گام مهمی در توسعه مدلهای متنباز گوگل محسوب میشود.
دیدگاهتان را بنویسید