Qwen3.8-Flash 开源,Qwen4 架构预览

通义千问发布 Qwen3.8-Flash,一款多模态 MoE 模型,作为 Qwen4 架构的早期预览并开放权重。该模型总参数 125B,每 token 仅激活 6B,训练成本仅为 Qwen3.7-Plus 的 1/9,性能全面超越后者。生产版 API 定价 $0.16/1M 输入 tokens 和 $0.47/1M 输出 tokens,原生上下文 262K,可扩展至 1M。

🔗 阅读原文

via AIHOT ·

添加评论
点赞收藏
点踩分享查看原文
评论
?
参与讨论