استارتاپ Reflection AI از مدل جدید Beam رونمایی کرده است؛ یک مدل هوش مصنوعی Open-Weight با ۵۰۱ میلیارد پارامتر که بهطور ویژه برای کدنویسی، استدلال و انجام وظایف عاملمحور طراحی شده است.
Reflection AI که انویدیا نیز در میان سرمایهگذاران آن قرار دارد، میگوید Beam با وجود ابعاد بزرگ خود تنها ۲۳ میلیارد پارامتر را برای هر توکن فعال میکند و در برخی وظایف میتواند با مدلهای قدرتمند متنباز رقابت کند.
مدل ۵۰۱ میلیارد پارامتری با معماری MoE
Beam براساس معماری Mixture-of-Experts یا MoE ساخته شده و درمجموع ۵۰۱ میلیارد پارامتر دارد. بااینحال، در هر مرحله تنها حدود ۲۳ میلیارد پارامتر آن فعال میشوند.
این ساختار به Reflection اجازه داده است مدلی بزرگ با هزینه محاسباتی پایینتر هنگام اجرا بسازد. تمرکز اصلی Beam نیز روی کدنویسی، استدلال، استفاده از ابزارها و اجرای وظایف چندمرحلهای توسط عاملهای هوش مصنوعی است.
آموزش روی ۲۳٫۸ تریلیون توکن
Reflection AI اعلام کرده مدل پایه Beam روی ۲۳٫۸ تریلیون توکن از دادههای وب، منابع عمومی و مجموعهدادههای دارای مجوز آموزش دیده است.
مرحله پیشآموزش این مدل با استفاده از ۶۱۴۴ پردازنده گرافیکی NVIDIA GB300 NVL72 انجام شده و طبق اعلام شرکت، کل فرایند در کمتر از چهار هفته به پایان رسیده است.
Reflection همچنین برای تقویت قابلیتهای استدلالی Beam سرمایهگذاری گستردهای روی یادگیری تقویتی انجام داده است.
بیش از ۱۰ هزار GPU برای یادگیری تقویتی
یکی از قابلتوجهترین بخشهای توسعه Beam به مرحله Reinforcement Learning مربوط میشود. Reflection میگوید برای این مرحله از حدود ۱۰۵۰۰ پردازنده گرافیکی NVIDIA GB300 بهمدت چهار هفته استفاده کرده است.
در این فرایند بیش از ۱۰۰ میلیون Rollout تولید شد و حدود ۱٫۳ میلیارد محیط Sandbox برای آموزش و ارزیابی مورد استفاده قرار گرفت.
Beam همچنین از طول زمینه حداکثر یک میلیون توکن در مرحله Midtraining بهره برده است.
عملکرد قدرتمند در کدنویسی و استدلال
براساس بنچمارکهای منتشرشده توسط Reflection AI، مدل Beam در برخی آزمونهای کدنویسی و عاملمحور عملکرد رقابتی ارائه میدهد.
این مدل در SWE-Bench Verified امتیاز ۸۰٫۹، در Terminal Bench 2.1 امتیاز ۸۰٫۱ و در آزمون AIME 2026 امتیاز ۹۷٫۸ را ثبت کرده است.
Reflection میگوید Beam در برخی وظایف به مدلهای بزرگتر نزدیک میشود، اما مزیت اصلی آن بهرهوری محاسباتی هنگام استنتاج است. البته این نتایج فعلاً براساس ارزیابیها و دادههای منتشرشده توسط خود سازنده هستند و ارزیابیهای مستقل تصویر دقیقتری از توانایی مدل ارائه خواهند کرد.
وزنهای Beam بهصورت عمومی منتشر میشوند
Beam درحالحاضر مراحل نهایی Red Teaming و ارزیابیهای ایمنی را پشت سر میگذارد و دسترسی اولیه آن تنها برای گروه محدودی از کاربران فراهم شده است.
Reflection AI اعلام کرده قصد دارد در ادامه ماه جاری وزنهای مدل را تحت مجوز Apache 2.0 منتشر کند. گزارش فنی، Model Card و ابزارهای موردنیاز توسعهدهندگان نیز قرار است همراه آن منتشر شوند.
Beam اولین مدل از مجموعهای است که Reflection قصد دارد برای توسعه هوش مصنوعی باز عرضه کند. این شرکت میخواهد توسعهدهندگان بتوانند مدلهای آن را روی زیرساخت خود اجرا، شخصیسازی و Fine-tune کنند.






دیدگاهها