阿里通义发布多模态 MoE 模型 Qwen3.8-Flash,并开源作为 Qwen4 架构预览的 Qwen3.8-Flash-Next。模型 125B 参数、每 token 仅激活 6B,上下文原生 262K、可扩展至 1M。阿里称其性能可比肩 Anthropic Opus 4.6 和 DeepSeek V4-Flash。
阿里通义发布多模态 MoE 模型 Qwen3.8-Flash,并开源作为 Qwen4 架构预览的 Qwen3.8-Flash-Next。模型 125B 参数、每 token 仅激活 6B,上下文原生 262K、可扩展至 1M。阿里称其性能可比肩 Anthropic Opus 4.6 和 DeepSeek V4-Flash。