本文来源:时代财经
8 月 26 日晚,阿里巴巴发布并同步开源千问最新模型 Qwen3.8-Flash。据介绍,这是一个多模态 MoE 模型,主模型参数量为 125B,额外配备 51B 的 N-gram Embedding,每 token 激活 6B 参数。它原生支持 262,144token 上下文,并可通过 YaRN 扩展至 1M token。
相比于 Qwen3.7-Plus,Qwen3.8-Flash 显著降低了训练与推理成本,训练成本较前者下降近 90%,推理成本每百万 Tokens 输入 1 元,输出 3 元,价格最低至 DeepSeek-V4-Flash 的 1/3。今晚,Qwen3.8-Flash 将首发上线 " 千问办公 "。


登录后才可以发布评论哦
打开小程序可以发布评论哦