阿里发布Qwen3.8Flash 今晚阿里正式推出多模态MoE模型Qwen3.8-Flash,主模型参数量125B,搭配51B N-gram Embedding,每token仅激活6B参数,训练开销仅为Qwen3.7-Plus的1/9。模型主打高效推理,原生支持超长上下文,代码、Agent办公能力大幅升级,还同步开源了下一代架构权重。国产大模型持续内卷,实测它的速度、工具调用表现对比Kimi K3、Fable5究竟处于什么水平?你会第一时间上手体验吗?

阿里发布Qwen3.8Flash 今晚阿里正式推出多模态MoE模型Qwen3.8-Flash,主模型参数量125B,搭配51B N-gram Embedding,每token仅激活6B参数,训练开销仅为Qwen3.7-Plus的1/9。模型主打高效推理,原生支持超长上下文,代码、Agent办公能力大幅升级,还同步开源了下一代架构权重。国产大模型持续内卷,实测它的速度、工具调用表现对比Kimi K3、Fable5究竟处于什么水平?你会第一时间上手体验吗?
