شرکت علیبابا از برنامههای توسعهای جسورانهای برای آینده مدلهای زبانی خود رونمایی کرد. طبق گزارش رویترز، این شرکت در حال آموزش مدل Qwen 4 است و قصد دارد نسلهای بعدی یعنی Qwen 4.5 و Qwen 5 را تا مقیاس ۱۰ تریلیون پارامتر توسعه دهد.
مهمترین نکات این نقشه راه عبارتند از:
• تمرکز بر خوداصلاحی بازگشتی: مدلها نقاط ضعف خود را شناسایی کرده، آزمایش طراحی میکنند و دادههای لازم برای آموزش نسل بعدی خود را تولید میکنند.
• استفاده از زیرساخت قدرتمند
M890 برای استنتاج مدلهای بالای ۲ تریلیون پارامتر که در حال حاضر تنها در اختیار تعداد محدودی از شرکتهای پیشرو جهان است.• برنامهریزی برای ایجاد کلاسترهای عظیم روی پردازندههای جدید
V900 با قابلیت اتصال ۵۰۰ هزار شتابدهنده به یکدیگر.ادی وو، مدیرعامل علیبابا، پیشبینی میکند که با این مقیاسپذیری، توان محاسباتی و قدرت «تفکر» ماشینها در آینده میتواند تا ۱۰۰۰ برابر از هوش انسانی پیشی بگیرد.
نقشه راه جاهطلبانه علیبابا: توسعه مدلهای Qwen تا ۱۰ تریلیون پارامتر و زیرساختهای نوین
📊 Data➕Science

