اشتراک
فناوری هوش مصنوعی چین

علی‌بابای چین از بزرگ‌ترین مدل هوش مصنوعی خود تا به امروز، Qwen3.8-Max رونمایی کرد

در یک نگاه چکیدهٔ خودکار موتور هوش مصنوعی افق آبی

شرکت علی‌بابای چین از قدرتمندترین مدل هوش مصنوعی خود با نام Qwen3.8-Max رونمایی کرد که با ۲.۴ تریلیون پارامتر، رقیبی جدی برای مدل‌های پیشرفته داخلی و بین‌المللی محسوب می‌شود. این مدل که از معماری «ترکیب کارشناسان» (Mixture-of-Experts) بهره می‌برد، برای افزایش بهره‌وری و کاهش هزینه‌های محاسباتی، به جای فعال‌سازی کل سیستم، تنها از بخشی از پارامترهای خود در هر لحظه استفاده می‌کند. Qwen3.8-Max قابلیت پردازش متن، تصویر و ویدیو را دارد و می‌تواند تا ۱ میلیون توکن را به‌طور هم‌زمان تحلیل کند که این ویژگی آن را برای بررسی اسناد طولانی و کدهای نرم‌افزاری بسیار توانمند می‌سازد. این مدل در پلتفرم مقایسه‌ای Arena.AI در بخش تحلیل محتوای بصری به رتبه دوم جهانی دست یافته و به عنوان برترین مدل چینی در رده‌بندی متنی شناخته شده است. برخلاف شرکت‌های آمریکایی مانند OpenAI و گوگل که جزئیات پارامترهای خود را منتشر نمی‌کنند، شرکت‌های فناوری چینی برای جذب توسعه‌دهندگان و ترویج استفاده از مدل‌های متن‌باز، استراتژی شفاف‌سازی تعداد پارامترها را در پیش گرفته‌اند. علی‌بابا قصد دارد این مدل را از هفته آینده در پلتفرم ابری خود در دسترس کاربران قرار دهد.

پکن، ۳ اوت (رویترز) - علی‌بابای چین روز دوشنبه از بزرگ‌ترین و توانمندترین مدل هوش مصنوعی خود به نام Qwen3.8-Max رونمایی کرد که از نظر اندازه چندان از مدل رقیب داخلی Moonshot AI که ماه گذشته منتشر شد، عقب نیست.

شرکت‌های فناوری چینی - که نیروی عظیمی در مدل‌های هوش مصنوعی متن‌باز در جهان هستند - در رقابتی شدید و سریع برای ساخت سیستم‌های قدرتمندتر بدون هزینه‌های سرسام‌آور اجرا هستند.

Qwen3.8-Max دارای ۲.۴ تریلیون پارامتر است که تنظیمات عددی است که مدل از داده‌ها یاد می‌گیرد و برای تشخیص الگوها، تولید پاسخ‌ها و انجام وظایف استفاده می‌کند. Kimi K3 شرکت Moonshot دارای ۲.۸ تریلیون پارامتر است.

عدد بالاتر به طور خودکار مدل را بهتر نمی‌کند، اما به معیاری دقیق برای مقیاس محاسبات و داده‌های پشت سیستم‌های پیشرفته هوش مصنوعی تبدیل شده است.

شرکت‌های فناوری چینی مشتاق انتشار تعداد پارامترها برای کمک به جذب توسعه‌دهندگان هستند. مدل‌های آن‌ها معمولاً متن‌باز هستند، به این معنی که تنظیمات یادگیری پایه که به توسعه‌دهندگان اجازه می‌دهد سیستم را اجرا یا تطبیق دهند، قابل دانلود هستند.

در مقابل، OpenAI، Anthropic و Google (GOOGL.O) تعداد پارامترهای مدل‌های متن‌بسته خود را منتشر نمی‌کنند.

Qwen3.8-Max در پلتفرم مقایسه مدل‌های جمع‌سپاری شده Arena.AI رونمایی شد، جایی که بلافاصله به بالاترین مدل چینی در رده‌بندی مدل‌های متنی تبدیل شد، اما هنوز از Claude Fable 5 و سه نسخه Opus که همه از Anthropic هستند، عقب است.

اما در رده‌بندی Arena.AI برای مدل‌های هوش مصنوعی که تصاویر و سایر مطالب بصری را تحلیل می‌کنند، Qwen3.8-Max در رتبه دوم جهانی قرار گرفت و تنها از یک نسخه Claude Fable 5 عقب است.

هر دو Qwen3.8-Max و Kimi K3 می‌توانند متن، تصویر و ویدیو را پردازش کنند و تا ۱ میلیون توکن را در یک زمان پردازش کنند.

توکن‌ها تکه‌هایی از داده هستند که اغلب بخشی از کلمات یا کلمات کوتاه هستند و عدد بزرگ به این معنی است که مدل می‌تواند مقادیر زیادی از مطالب را در یک بار دریافت کند، مانند پرونده‌های حقوقی طولانی، یک پایگاه کد نرم‌افزاری بزرگ یا صدها صفحه اسناد.

علی‌بابا گفت که مدل آن از طراحی "mixture-of-experts" استفاده می‌کند که کار را بین بخش‌های تخصصی سیستم تقسیم می‌کند به جای اینکه کل مدل را برای هر درخواست فعال کند. تنها ۹۵ میلیارد پارامتر در هر بار استفاده می‌شود و هزینه‌ها و تأخیر پاسخ را کاهش می‌دهد.

این غول فناوری گفت که مدل یک پروژه مهندسی نرم‌افزار را در ۱۶ روز تکمیل کرده است.

Qwen3.8-Max قرار است هفته آینده از طریق پلتفرم Model Studio ابر علی‌بابا منتشر شود.

اشتراک:
این گزارش ترجمه و بازنویسی خبری با موتور هوش مصنوعی افق آبی است و برای خوانندهٔ فارسی‌زبان بازتنظیم شده. منبع اصلی: reuters.com