همین حالا برای دوستان خود به اشتراک بگذارید: واتساپ | تلگرام |

رقیب جدید مدل‌های برنامه‌نویسی OpenAI و Anthropic از چین می‌آید

شرکت چینی Z.ai از مدل هوش مصنوعی جدید GLM-5.3 رونمایی کرده است؛ مدلی که تمرکز ویژه‌ای بر برنامه‌نویسی، مهندسی نرم‌افزار، اجرای وظایف طولانی و عملکرد Agentها دارد و قرار است وزن‌های آن نیز پس از تکمیل ارزیابی‌های امنیتی منتشر شود.

طبق بررسی تکراتو و اطلاعات رسمی Z.ai، نکته جالب درباره GLM-5.3 این است که شرکت برای دستیابی به این جهش عملکردی، مدل پایه جدیدی آموزش نداده و همچنان از همان Base Model نسل GLM-5.2 استفاده کرده است.

قیمت روز گوشی های بازار ایران

Z.ai می‌گوید پیشرفت‌های نسل جدید تقریباً به‌طور کامل از گسترش Post-training حاصل شده‌اند.

GLM-5.3 چگونه بدون تغییر مدل پایه قدرتمندتر شد؟

Z.ai در نسل جدید تمرکز خود را روی افزایش مقیاس مرحله پساآموزش گذاشته است.

براساس توضیحات رسمی شرکت، محیط‌های آموزشی مربوط به وظایف طولانی‌مدت حدود ۱۰ برابر افزایش یافته‌اند و مدل برای انجام پروژه‌هایی آموزش دیده که نیازمند برنامه‌ریزی، استفاده از ابزارها، تغییر کد و بررسی نتیجه در چندین مرحله هستند.

هدف این است که GLM-5.3 فقط قطعه‌ای از کد تولید نکند، بلکه بتواند مانند یک Agent توسعه نرم‌افزار، پروژه را در چند مرحله جلو ببرد.

جهش قابل‌توجه GLM-5.3 در بنچمارک‌های برنامه‌نویسی

نتایج منتشرشده توسط Z.ai از پیشرفت چشمگیر مدل جدید در چند بنچمارک تخصصی حکایت دارند.

برای مثال امتیاز GLM در Terminal-Bench 3.0 از ۴٫۶ در نسل قبل به ۲۸٫۳ رسیده است.

در DeepSWE v1.1 نیز امتیاز از ۴۶٫۲ به ۶۶٫۹ افزایش یافته است.

این اعداد نشان می‌دهند تمرکز روی Post-training تأثیر قابل‌توجهی بر توانایی مدل در انجام وظایف واقعی مهندسی نرم‌افزار داشته است.

عملکرد عجیب GLM-5.3 در امنیت سایبری

بخش جالب‌تر ماجرا به قابلیت‌های امنیت سایبری GLM-5.3 مربوط می‌شود.

این مدل در بنچمارک CyberGym امتیاز ۸۴٫۵ درصد را ثبت کرده است؛ بنچمارکی که توانایی مدل‌ها در شناسایی آسیب‌پذیری‌های نرم‌افزاری را ارزیابی می‌کند.

رویترز گزارش می‌دهد این نتیجه حتی اندکی بالاتر از امتیاز ۸۳٫۸ درصدی Mythos 5 شرکت Anthropic در همین ارزیابی قرار می‌گیرد.

بااین‌حال تصویر کاملاً یک‌طرفه نیست.

GLM-5.3 در ExploitBench امتیاز ۵۴٫۴ درصد را کسب کرده، درحالی‌که Mythos 5 به امتیاز ۷۸ درصد رسیده است. بنابراین توانایی بالای مدل در پیدا کردن آسیب‌پذیری الزاماً به معنی برتری آن در تمام وظایف امنیت سایبری نیست.

بیش از ۲۴۰۰ آسیب‌پذیری کشف‌شده

Z.ai همچنین اعلام کرده مدل‌های GLM تاکنون بیش از ۲۴۰۰ آسیب‌پذیری نرم‌افزاری را شناسایی کرده‌اند.

توانایی‌های امنیتی پیشرفته GLM-5.3 ظاهراً حتی خود شرکت را نیز به احتیاط بیشتر درباره انتشار عمومی مدل واداشته است.

Z.ai به‌جای انتشار فوری وزن‌ها، تصمیم گرفته ابتدا ارزیابی‌ها و اقدامات امنیتی بیشتری انجام دهد.

آیا GLM-5.3 واقعاً Open Weight است؟

در زمان انتشار این خبر، پاسخ دقیق این است: هنوز نه، اما قرار است باشد.

Z.ai اعلام کرده وزن‌های GLM-5.3 حدود دو هفته پس از معرفی و بعد از تکمیل بررسی‌های ایمنی منتشر خواهند شد.

بنابراین برخلاف برخی تیترهای اولیه، وزن‌های مدل در روز معرفی در اختیار عموم قرار نگرفته‌اند.

GLM-5.3 را الان از کجا می‌توان استفاده کرد؟

توسعه‌دهندگان درحال‌حاضر می‌توانند از GLM-5.3 از طریق GLM Coding Plan و محیط توسعه Agentمحور ZCode استفاده کنند.

ZCode برای پروژه‌های برنامه‌نویسی طولانی طراحی شده و می‌تواند اطلاعات مربوط به فایل‌ها، ترمینال، مرورگر و وضعیت Git را در طول انجام یک Task حفظ کند.

مستندات رسمی Z.ai همچنین به Context پایدار یک میلیون توکنی GLM-5.3 برای چنین وظایفی اشاره می‌کنند.

رقابت مدل‌های چینی با غول‌های آمریکایی جدی‌تر می‌شود

GLM-5.3 نمونه دیگری از سرعت پیشرفت آزمایشگاه‌های هوش مصنوعی چین است.

Z.ai تلاش می‌کند با ترکیب مدل‌های قدرتمند، قابلیت‌های Agentic Coding و در نهایت انتشار وزن‌های مدل، گزینه‌ای جدی در برابر مدل‌های بسته شرکت‌های آمریکایی ایجاد کند.

البته بسیاری از اعداد عملکرد GLM-5.3 فعلاً براساس ارزیابی‌های منتشرشده توسط خود Z.ai هستند و مقایسه‌های مستقل گسترده‌تر پس از دسترسی عمومی به وزن‌های مدل تصویر دقیق‌تری از جایگاه آن ارائه خواهند کرد.

اگر نتایج فعلی در آزمون‌های مستقل نیز تکرار شوند، GLM-5.3 می‌تواند به یکی از مهم‌ترین مدل‌های Open Weight برای توسعه‌دهندگان در سال ۲۰۲۶ تبدیل شود.

ارسال برای دوستان در: واتساپ | تلگرام |




ارسال نظر