(资料图片)
8月26日,阿里千问正式发布Qwen3.8-Flash。据介绍,这是一个多模态MoE模型,主模型参数量为125B,额外配备51B的N-gram Embedding,每token激活6B参数。它原生支持262,144 token上下文,并可通过YaRN扩展至1M token。相比于Qwen3.7-Plus,Qwen3.8-Flash显著降低了训练与推理成本,训练开销仅约为前者的1/9,但在编码和办公任务上却具有更强的能力。Qwen3.8-Flash即将上线千问AI平台,对外提供API服务,每百万Tokens输入1元,输出3元。今晚,Qwen3.8-Flash还将首发上线“千问办公”。
阿里千问同时发布了Qwen3.8-Flash-Next的开源权重,Next新架构将是全新一代Qwen4系列模型的雏形。本次提前释出结构上的改动,以便在基于此构建Qwen4完整模型家族之前,先让社区对其进行检验。模型权重将在Hugging Face与ModelScope发布,默认1M上下文并内置官方工具的生产版本,以Qwen3.8-Flash的形式在千问AI平台提供服务。
内容搜集整理于网络,不代表本站同意文章中的说法或者描述。文中陈述文字和内容未经本站证实,其全部或者部分内容、文字的真实性、完整性、及时性本站不做任何保证或者承诺,并且本站对内容资料不承担任何法律责任,请读者自行甄别。如因文章内容、版权和其他问题侵犯了您的合法权益请联系邮箱:5 146 761 13 @qq.com 进行删除处理,谢谢合作!