1. Qwen4架构预览模型登顶多项基准
本周Qwen发布多模态MoE模型Qwen3.8-Flash,作为Qwen4架构的早期预览。该模型仅有6B活跃参数,但在14项基准测试中的8项登顶,涵盖MMLU-Pro等。其API已在QwenCloud上线,并通过Unsloth支持在75GB内存上本地运行125B参数版本。同时,QSA注意力机制在1M-token上下文下实现显著提速。这表明开源模型在效率和性能上正快速逼近闭源,架构创新已能在极低活跃参数下释放高能力。
- 2026-08-26:Qwen发布Qwen3.8-Flash作为Qwen4架构预览,登顶8项基准。(Qwen(@Alibaba_Qwen))
- 2026-08-27:模型API在QwenCloud上线,Unsloth支持本地运行125B版本。(Qwen(@Alibaba_Qwen) / NVIDIA AI(@NVIDIAAI))