خانهتکنولوژیهوش مصنوعی

در بنچمارک‌های تخصصی برنامه‌نویسی، مدل GLM-5.3 عملکرد قدرتمندی ثبت کرد.

در دیجیاتو ثبت‌نام کنید

جهت بهره‌مندی و دسترسی به امکانات ویژه و بخش‌های مختلف در دیجیاتو عضو ویژه دیجیاتو شوید.

    گوگل حذف واترمارک از محتوای تولیدشده با جمینای را ممکن کرد48 دقیقه قبلپژوهش آنتروپیک: تقابل ایجنت‌های هوش مصنوعی به جنگ بر سر قلمرو منجر می‌شود11 ساعت قبلپایانی برای گوشی تحول‌ساز اپل؛ آیفون X به فهرست محصولات منسوخ اضافه شد15 ساعت قبلدولت آمریکا به شرکت‌های خصوصی اجازه اجرای حملات سایبری علیه تبهکاران را می‌دهد16 ساعت قبلدومین دوره مسابقات جهانی ربات‌های انسان‌نما با بیش از ۲۰۰۰ ربات در چین برگزار می‌شود17 ساعت قبل

آزمایشگاه چینی هوش مصنوعی Zhipu AI یا Z.ai از جدیدترین مدل خود با نام GLM-5.3 رونمایی کرد. این مدل ۷۴۳ میلیارد پارامتری که با تمرکز بر مهارت‌های برنامه‌نویسی، ایجنتی و امنیت سایبری توسعه یافته، از طریق پلن‌های اشتراکی GLM Coding Plan و بستر ZCode در دسترس قرار گرفته است. دسترسی به API و دانلود وزن‌های آزاد مدل نیز پس از ارزیابی‌های امنیتی طی هفته‌های آینده به‌صورت مرحله‌ای انجام خواهد شد.

نکته قابل‌توجه در توسعهGLM-5.3این است که مانند نسخه قبلی‌اش ۷۴۳ میلیارد پارامتر دارد. تمامی پیشرفت‌ها و جهش‌های عملکردی در این مدل، صرفاً از طریق توسعه و مقیاس‌پذیری لایه پس‌آموزش حاصل شده‌اند. به گفته پژوهشگران Z.ai، آن‌ها به‌جای افزایش حجم مدل پایه، لایه آموزشی را با افزودن محیط‌های شبیه‌سازی بیشتر، تنوع‌دادن به وظایف و تخصیص توان پردازشی بالاتر برای یادگیری تعاملی ارتقا داده‌اند.

توسعه‌دهندگان علاوه‌بر دقت عملکرد، بر کارایی توکن‌ها نیز تمرکز ویژه‌ای داشته‌اند. در بنچمارک اختصاصی Z.ai Code Bench، مدل جدید با مصرف حدود ۷۵ هزار توکن خروجی به نرخ موفقیت ۳۴.۵ درصد دست یافت؛ درحالی‌که مدل GLM-5.2 در همین تست با مصرف ۹۶ هزار توکن، تنها نرخ ۲۳.۴ درصد را ثبت کرده بود.

مدل هوش مصنوعی GLM-5.3

در بنچمارک‌های تخصصی برنامه‌نویسی، مدل GLM-5.3 عملکرد قدرتمندی ثبت کرد، اگرچه همچنان در برخی شاخص‌ها پس از رقبای تجاری پیشتاز آمریکایی قرار می‌گیرد. در بنچمارک Terminal Bench 3.0 که توانایی کار با محیط‌های واقعی لینوکس و سیستم‌های خودکار را می‌سنجد، GLM-5.3 به امتیاز ۲۸.۳ دست یافت که رشدی ۶ برابری نسبت به امتیاز ۴.۶ در مدل GLM-5.2 محسوب می‌شود؛ اما همچنان پایین‌تر از مدل‌های بسته Claude Fable 5 با امتیاز ۳۳.۷ و GPT-5.6 Sol با امتیاز ۳۴.۶ قرار دارد.

در آزمون DeepSWE v1.1 که مربوط به رفع آسیب‌ها و باگ‌های واقعی پروژه‌های گیت‌هاب است، مدل GLM-5.3 امتیاز ۶۶.۹ را ثبت کرد که رشدی ۱.۵ برابری نسبت به نسل قبل نشان می‌دهد، هرچند رقیب هم‌وطن آن یعنی Kimi K3 با امتیاز ۶۷.۵ و مدل Fable 5 با امتیاز ۶۹.۷ بالاتر از آن قرار گرفتند. در کل، عملکرد GLM-5.3 نشان می‌دهد که این مدل نسبت به پیشینیان و برخی مدل‌های متن‌باز هم‌رده برتری مشهودی دارد، اما مدل‌های پیشرفته بسته تجاری همچنان صدر جدول برنامه‌نویسی را در اختیار دارند.

بزرگ‌ترین شگفتی GLM-5.3 به حوزه امنیت سایبری مربوط می‌شود. این مدل با ثبت امتیاز ۸۴.۵ درصد در بنچمارک CyberGym، موفق شد بالاتر از مدل‌های مطرحی مانند Claude Fable 5 با امتیاز ۸۳.۸ درصد و GPT-5.6 Sol با امتیاز ۸۳.۶ درصد در صدر جدول قرار بگیرد. همچنین توانایی این مدل در اجرای کدهای نفوذ و تحلیل امنیتی نسبت به نسل قبل بیش از ۲ برابر شده است.

آزمایشگاه Z.ai فهرستی از یافته‌های امنیتی این مدل منتشر کرد که نشان می‌دهد GLM-5.3 موفق به شناسایی ۲,۴۳۶ آسیب‌پذیری نرم‌افزاری در ۲۶۹ پروژه متن‌باز شده است. از این میان، ۱,۰۹۷ مورد در رده خطر «متوسط تا بسیار بالا» دسته‌بندی شده‌اند. جالب‌ترین نکته، کشف رخنه‌ای امنیتی بود که تاریخ ایجاد آن به سال ۱۹۸۱ بازمی‌گشت؛ باگی قدیمی که به‌طور متوسط به مدت ۲۶.۶ سال از دید تمامی اسکنرها و پژوهشگران امنیتی پنهان مانده بود.

دانش‌آموخته‌ زبان‌شناسی‌ هستم و همان‌قدر که به «کلمه» علاقه‌مندم، از سرک‌کشیدن به گوشه‌وکنارِ جهان تکنولوژی و علم هم حظ می‌کنم.

برای گفتگو با کاربرانثبت نامکنید یاوارد حساب کاربریخود شوید.

    ۱۰۰۰ میلیارد تومن رو ریختیم دور! | تک‌تاکقیمت روز پرفروش‌ترین گوشی‌های بازار ایران [20 مرداد 1405]معاون وزیر ارتباطات: در دوران جنگ هزار میلیارد تومان برای پیام‌رسان‌های داخلی هزینه کردیمکاربرد نادرست هوش‌مصنوعی! | اون‌ساید
#هوش_مصنوعی