阿里发布 Qwen3.8-Flash 模型

阿里通义发布多模态 MoE 模型 Qwen3.8-Flash,并开源作为 Qwen4 架构预览的 Qwen3.8-Flash-Next。模型 125B 参数、每 token 仅激活 6B,上下文原生 262K、可扩展至 1M。阿里称其性能可比肩 Anthropic Opus 4.6 和 DeepSeek V4-Flash。

上一篇:

下一篇:

发表回复

登录后才能评论
分享本页
返回顶部
🍁
🔈Hi,朋友。欢迎来到 木木的博客小站 !