علی‌بابا به‌دنبال ساخت مدل هوش مصنوعی ۱۰ تریلیون پارامتری؛ تراشه قدرتمند Zhenwu V900 هم معرفی شد

علی‌بابا برنامه بزرگی برای نسل‌های بعدی مدل‌های هوش مصنوعی Qwen دارد و قصد دارد مدل‌هایی با ظرفیت بین ۵ تا ۱۰ تریلیون پارامتر توسعه دهد. این برنامه بخشی از سرمایه‌گذاری گسترده غول فناوری چینی روی مدل‌های هوش مصنوعی، تراشه‌های اختصاصی و زیرساخت مراکز داده است.

«ادی وو»، مدیرعامل علی‌بابا، در کنفرانس سالانه Apsara Cloud اعلام کرد تیم Qwen همچنان درحال توسعه معماری مدل‌ها و بهینه‌سازی داده‌های آموزشی است تا نسل‌های آینده بتوانند وظایف پیچیده‌تر و طولانی‌تری را انجام دهند.

هدف نهایی علی‌بابا، حرکت از هوش مصنوعی فعلی به سمت ابرهوش مصنوعی یا ASI است؛ مفهومی که به سیستم‌هایی با توانایی‌های بسیار گسترده‌تر از مدل‌های هوش مصنوعی امروزی اشاره دارد.

مدل‌های Qwen آینده تا ۱۰ تریلیون پارامتر خواهند داشت

علی‌بابا اعلام کرده آموزش نسل بعدی Qwen 4 درحال انجام است و در ادامه، مدل‌های Qwen 4.5 و Qwen 5 می‌توانند به ابعادی بین ۵ تا ۱۰ تریلیون پارامتر برسند.

برای مقایسه، مدل پرچمدار فعلی این شرکت یعنی Qwen 3.8 Max حدود ۲.۴ تریلیون پارامتر دارد. در نتیجه مدل‌های آینده علی‌بابا می‌توانند تقریباً دو تا چهار برابر بزرگ‌تر از پرچمدار کنونی باشند.

تعداد پارامترها یکی از شاخص‌های اندازه یک مدل هوش مصنوعی محسوب می‌شود، هرچند افزایش تعداد پارامتر به‌تنهایی به معنای افزایش مستقیم کیفیت یا هوشمندی مدل نیست و معماری، داده‌های آموزشی و روش آموزش نیز نقش مهمی در عملکرد نهایی دارند.

ادی وو همچنین اعلام کرده ابرکامپیوتر M890 علی‌بابا اکنون توانایی اجرای استنتاج مدل‌هایی با بیش از ۲ تریلیون پارامتر را دارد.

علی‌بابا روی مدل‌هایی که خودشان را بهبود می‌دهند کار می‌کند

یکی دیگر از حوزه‌هایی که تیم Qwen روی آن کار می‌کند، مفهوم «خودبهبودی بازگشتی» است.

در این روش، مدل هوش مصنوعی می‌تواند محدودیت‌ها و ضعف‌های خود را شناسایی کند، آزمایش‌هایی طراحی کند و داده‌های جدیدی تولید کند تا از آن‌ها برای بهبود عملکرد خود استفاده شود.

علی‌بابا این فناوری را یکی از مسیرهای مهم برای توسعه نسل‌های آینده هوش مصنوعی می‌داند و آن را بخشی از حرکت خود به سمت سیستم‌های پیشرفته‌تر عنوان کرده است.

تراشه Zhenwu V900 معرفی شد

علی‌بابا هم‌زمان با اعلام برنامه‌های جدید خود برای Qwen، نسل تازه تراشه هوش مصنوعی Zhenwu V900 را نیز معرفی کرده است.

این تراشه توسط واحد نیمه‌رسانای T-Head علی‌بابا توسعه یافته و مدیرعامل این شرکت آن را قدرتمندترین تراشه هوش مصنوعی چین توصیف کرده است.

براساس اطلاعات منتشرشده، Zhenwu V900 حدود سه برابر عملکرد بیشتری نسبت به تراشه M890 دارد.

علی‌بابا می‌گوید کلاسترهایی که براساس V900 ساخته می‌شوند می‌توانند تا ۵۰۰ هزار کارت را برای آموزش و استنتاج مدل‌های پیشرفته هوش مصنوعی در کنار یکدیگر قرار دهند.

تولید انبوه و عرضه تجاری Zhenwu V900 برای سه‌ماهه نخست سال ۲۰۲۷ برنامه‌ریزی شده است.

مراکز داده ۲۰ گیگاواتی علی‌بابا تا سال ۲۰۳۲

برنامه‌های علی‌بابا تنها به مدل و تراشه محدود نمی‌شود. این شرکت قصد دارد ظرفیت مراکز داده جهانی Alibaba Cloud را تا سال ۲۰۳۲ به بیش از ۲۰ گیگاوات افزایش دهد.

به گفته مدیرعامل علی‌بابا، تقاضا برای خدمات هوش مصنوعی همچنان بسیار بالا است و همین موضوع باعث افزایش رشد درآمد بخش ابری این شرکت شده است.

بااین‌حال، کمبود تجهیزات و محدودیت‌های جهانی زنجیره تأمین مراکز داده هوش مصنوعی همچنان یکی از موانع توسعه سریع‌تر زیرساخت‌های این شرکت محسوب می‌شود.

ترکیب مدل‌های چندتریلیون پارامتری، تراشه‌های اختصاصی و مراکز داده عظیم نشان می‌دهد علی‌بابا قصد دارد حضور خود را در رقابت جهانی هوش مصنوعی بسیار گسترده‌تر کند؛ رقابتی که اکنون علاوه‌بر مدل‌های هوش مصنوعی، به زیرساخت پردازشی و تراشه‌های اختصاصی نیز وابسته شده است.

ا
امیررضا هادی تهرانی
مشاهده کلیه مقالات منتشر شده
گفت‌وگوی کاربران

دیدگاه‌ها

۰ دیدگاه

دیدگاه شما

نشانی ایمیل شما منتشر نخواهد شد.

اپلیکیشن و نرم‌افزار

معرفی نرم افزار و اپلیکیشن

مشاهده بیشتر