在 NVIDIA GB300 NVL72 上体验 Qwen3.8-Flash-Next 的智能体编码

NVIDIA Developer Blog 2026-08-27T12:46:50.966840

阿里巴巴发布了 Qwen3.8-Flash-Next 的模型权重,这是即将推出的 Qwen4 架构的预览版本,供开发者试用和评估。它是一个多模态混合专家(MoE)模型,主模型有 125B 参数,另外补充了 51B 的 N-gram 嵌入参数,每个 token 激活 6B 参数。原生上下文窗口为 262,144 token,可扩展到 1M token……

来源

查看原文