علیبابا با هوش مصنوعی Qwen 3.8-Flash-Next، پیشنمایشی از معماری نسل بعدی مدلهای هوش مصنوعی خود را بهنمایش خواهد گذاشت.
تیم توسعهدهندهی Qwen در علیبابا، مدل جدید Qwen 3.8-Flash-Next را با معماری پیشرفتهی مخلوطی از متخصصان (MoE) عرضه خواهد کرد. ساختار مذکور بهمنزلهی پیشنمایشی رسمی از مدل نسل بعدی یعنی Qwen 4 طراحی شده است تا توسعهدهندگان پیش از عرضهی پرچمدار اصلی، با ساختار فنی آن آشنا شوند.
اطلاعات ارائهشده در نشستهای پیش از انتشار نشان میدهد مدل مذکور در مجموع دارای ۱۲۵ میلیارد پارامتر است؛ اما در زمان پردازش هر توکن تنها ۶ میلیارد پارامتر فعال میشوند؛ روندی سبب میشود هزینههای محاسباتی پردازش تا سطح یک مدل ۶ میلیارد پارامتری کاهش یابد.
تیم توسعهدهندهی علیبابا Qwen 3.8-Flash-Next را مدلی چندوجهی میداند که دسترسی زودهنگام به قابلیتهای فنی خانوادهی Qwen 4 را ممکن میکند. وزنهای این مدل متنباز پس از انتشار نهایی، علاوهبر پلتفرمهای چینی در دسترس توسعهدهندگان سراسر جهان قرار میگیرد.
تا زمان انتشار این گزارش، بنچمارکهای رسمی و امتیازهای عملکردی دقیق در مقایسه با سایر رقبا منتشر نشدهاند؛ اما مدلهای متنباز با پارامترهای فعال اندک میتوانند تواناییهای پیشرفتهی محاسباتی را روی سختافزارهای تجاری استاندارد اجرا کنند.
خانواده ما
دیدگاهها