علیبابا برنامه بزرگی برای نسلهای بعدی مدلهای هوش مصنوعی Qwen دارد و قصد دارد مدلهایی با ظرفیت بین ۵ تا ۱۰ تریلیون پارامتر توسعه دهد. این برنامه بخشی از سرمایهگذاری گسترده غول فناوری چینی روی مدلهای هوش مصنوعی، تراشههای اختصاصی و زیرساخت مراکز داده است.
«ادی وو»، مدیرعامل علیبابا، در کنفرانس سالانه Apsara Cloud اعلام کرد تیم Qwen همچنان درحال توسعه معماری مدلها و بهینهسازی دادههای آموزشی است تا نسلهای آینده بتوانند وظایف پیچیدهتر و طولانیتری را انجام دهند.
هدف نهایی علیبابا، حرکت از هوش مصنوعی فعلی به سمت ابرهوش مصنوعی یا ASI است؛ مفهومی که به سیستمهایی با تواناییهای بسیار گستردهتر از مدلهای هوش مصنوعی امروزی اشاره دارد.
مدلهای Qwen آینده تا ۱۰ تریلیون پارامتر خواهند داشت
علیبابا اعلام کرده آموزش نسل بعدی Qwen 4 درحال انجام است و در ادامه، مدلهای Qwen 4.5 و Qwen 5 میتوانند به ابعادی بین ۵ تا ۱۰ تریلیون پارامتر برسند.
برای مقایسه، مدل پرچمدار فعلی این شرکت یعنی Qwen 3.8 Max حدود ۲.۴ تریلیون پارامتر دارد. در نتیجه مدلهای آینده علیبابا میتوانند تقریباً دو تا چهار برابر بزرگتر از پرچمدار کنونی باشند.
تعداد پارامترها یکی از شاخصهای اندازه یک مدل هوش مصنوعی محسوب میشود، هرچند افزایش تعداد پارامتر بهتنهایی به معنای افزایش مستقیم کیفیت یا هوشمندی مدل نیست و معماری، دادههای آموزشی و روش آموزش نیز نقش مهمی در عملکرد نهایی دارند.
ادی وو همچنین اعلام کرده ابرکامپیوتر M890 علیبابا اکنون توانایی اجرای استنتاج مدلهایی با بیش از ۲ تریلیون پارامتر را دارد.
علیبابا روی مدلهایی که خودشان را بهبود میدهند کار میکند
یکی دیگر از حوزههایی که تیم Qwen روی آن کار میکند، مفهوم «خودبهبودی بازگشتی» است.
در این روش، مدل هوش مصنوعی میتواند محدودیتها و ضعفهای خود را شناسایی کند، آزمایشهایی طراحی کند و دادههای جدیدی تولید کند تا از آنها برای بهبود عملکرد خود استفاده شود.
علیبابا این فناوری را یکی از مسیرهای مهم برای توسعه نسلهای آینده هوش مصنوعی میداند و آن را بخشی از حرکت خود به سمت سیستمهای پیشرفتهتر عنوان کرده است.
تراشه Zhenwu V900 معرفی شد
علیبابا همزمان با اعلام برنامههای جدید خود برای Qwen، نسل تازه تراشه هوش مصنوعی Zhenwu V900 را نیز معرفی کرده است.
این تراشه توسط واحد نیمهرسانای T-Head علیبابا توسعه یافته و مدیرعامل این شرکت آن را قدرتمندترین تراشه هوش مصنوعی چین توصیف کرده است.
براساس اطلاعات منتشرشده، Zhenwu V900 حدود سه برابر عملکرد بیشتری نسبت به تراشه M890 دارد.
علیبابا میگوید کلاسترهایی که براساس V900 ساخته میشوند میتوانند تا ۵۰۰ هزار کارت را برای آموزش و استنتاج مدلهای پیشرفته هوش مصنوعی در کنار یکدیگر قرار دهند.
تولید انبوه و عرضه تجاری Zhenwu V900 برای سهماهه نخست سال ۲۰۲۷ برنامهریزی شده است.
مراکز داده ۲۰ گیگاواتی علیبابا تا سال ۲۰۳۲
برنامههای علیبابا تنها به مدل و تراشه محدود نمیشود. این شرکت قصد دارد ظرفیت مراکز داده جهانی Alibaba Cloud را تا سال ۲۰۳۲ به بیش از ۲۰ گیگاوات افزایش دهد.
به گفته مدیرعامل علیبابا، تقاضا برای خدمات هوش مصنوعی همچنان بسیار بالا است و همین موضوع باعث افزایش رشد درآمد بخش ابری این شرکت شده است.
بااینحال، کمبود تجهیزات و محدودیتهای جهانی زنجیره تأمین مراکز داده هوش مصنوعی همچنان یکی از موانع توسعه سریعتر زیرساختهای این شرکت محسوب میشود.
ترکیب مدلهای چندتریلیون پارامتری، تراشههای اختصاصی و مراکز داده عظیم نشان میدهد علیبابا قصد دارد حضور خود را در رقابت جهانی هوش مصنوعی بسیار گستردهتر کند؛ رقابتی که اکنون علاوهبر مدلهای هوش مصنوعی، به زیرساخت پردازشی و تراشههای اختصاصی نیز وابسته شده است.





دیدگاهها