علیبابا اخیراً از نسل جدید مدلهای هوش مصنوعی خود با نام Qwen3 رونمایی کرده است. این مدلها بر اساس ادعای شرکت، قابلیت رقابت با محصولات برتر گوگل و OpenAI را دارا هستند و شامل مدلهای ترکیبی هستند که توانایی استدلال و پاسخگویی سریع را همزمان دارند.
مدلهای Qwen3 از ۱۱۹ زبان پشتیبانی کرده و با ۳۶ تریلیون توکن آموزش دیدهاند. این نسل شامل مدلهایی با مقیاسهای متفاوت از ۰٫۶ میلیارد تا ۲۳۵ میلیارد پارامتر است، که تواناییهای آنها در حل مسائل پیچیده را افزایش میدهد. معماریهای نوآورانه از جمله Mixture of Experts در این مدلها به کار رفته است.
نتایج اولیه نشان میدهد که مدل بزرگ Qwen3-235B-A22B در بسیاری از آزمونها، حتی در مقایسه با برخی مدلهای قدرتمند OpenAI و گوگل، عملکرد بهتری از خود نشان داده است. علیبابا معتقد است با پیشرفتهای چشمگیر Qwen3، قابلیتهای رقبای آمریکایی به چالش کشیده میشود.
روز دوشنبه شرکت فناوری چینی علیبابا نسل تازه مدلهای هوش مصنوعی خود را با نام Qwen3 منتشر کرد؛ مدلهایی که بنا به ادعای شرکت، میتوانند با برترین محصولات گوگل و OpenAI رقابت کنند و حتی در برخی سناریوها عملکرد بهتری نشان دهند.
بیشتر این مدلها زیر مجوز باز روی پلتفرمهای Hugging Face و GitHub قرار گرفتهاند یا بهزودی قرار میگیرند. اندازهشان از ۰٫۶ میلیارد پارامتر شروع میشود و تا ۲۳۵ میلیارد پارامتر میرسد؛ هرچه پارامتر بیشتر باشد، توان حل مسئله بالاتر است.
موفقیت مدلهای بومی چین فشار مضاعفی بر آزمایشگاههای آمریکایی، از جمله OpenAI، وارد کرده تا فناوریهای توانمندتری عرضه کنند. همین موضوع سیاستگذاران را هم واداشته محدودیتهایی برای دسترسی شرکتهای چینی به تراشههای لازم جهت آموزش مدلها اعمال کنند.
تیم Qwen در وبلاگ رسمی نوشت:
«حالتهای تفکر و غیرتفکر را در کنار هم قرار دادهایم تا کاربر بتواند بودجه فکری را مدیریت کند؛ در نتیجه تنظیم منابع برای هر وظیفه سادهتر میشود.»
برخی نسخهها معماری Mixture of Experts (MoE) را به کار گرفتهاند؛ رویکردی که کار را به زیردستههای متخصص واگذار میکند و از نظر محاسباتی بهینهتر است.
علیبابا اعلام کرد مدلهای Qwen3 از ۱۱۹ زبان پشتیبانی میکنند و با بیش از ۳۶ تریلیون توکن آموزش دیدهاند؛ مجموعه دادهای شامل کتاب درسی، جفت پرسشـپاسخ، قطعهکد و داده تولیدشده توسط هوش مصنوعی.
این بهبودها Qwen3 را نسبت به نسل قبلی (Qwen2) بسیار توانمندتر کرده است. با این حال، فاصله چشمگیری بین Qwen3 و مدلهای تازه نفس ردهبالای OpenAI مثل o3 یا o4-mini دیده نمیشود؛ هر دو دسته عملکرد بالایی دارند.
در پلتفرم مسابقات برنامهنویسی Codeforces، بزرگترین مدل این سری (Qwen-3-235B-A22B) اندکی بالاتر از o3-mini (OpenAI) و Gemini 2.5 Pro (گوگل) قرار گرفت. همین مدل در نسخه تازه آزمون ریاضی AIME و معیار BFCL نیز از o3-mini پیش افتاده است؛ البته هنوز در دسترس عموم نیست.
بزرگترین مدلی که هماکنون میتوان دانلود کرد Qwen3-32B است. این نسخه در چندین آزمون ـ از جمله بنچمارک کدنویسی LiveCodeBench ـ عملکرد بهتری از مدل o1 OpenAI نشان داده و با مدلهای باز و بسته دیگری مانند DeepSeek R1 برابری میکند.

علیبابا میگوید Qwen3 در فراخوانی ابزارها، پیروی دقیق از دستورالعملها و حفظ قالب داده عملکرد درخشانی دارد. افزون بر نسخههای قابل دانلود، سرویسهای ابری Fireworks AI و Hyperbolic هم این مدل را ارائه میدهند.
«توحین سریواستاوا»، همبنیانگذار و مدیرعامل میزبان ابری Baseten، در گفتوگویی گفت:
«ایالات متحده فروش تراشه به چین را محدود کرده، اما مدلهای باز و پیشرفتهای مثل Qwen3 بدون تردید در داخل چین به کار گرفته میشوند. واقعیت این است که کسبوکارها هم ابزار اختصاصی میسازند و هم محصولات آماده شرکتهایی مثل Anthropic و OpenAI را میخرند.»














