阿里千问正式发布Qwen3.8-Flash,推理成本大幅下降
本文来源:时代财经
8月26日晚,阿里巴巴发布并同步开源千问最新模型 Qwen3.8-Flash。据介绍,这是一个多模态MoE模型,主模型参数量为125B,额外配备51B的N-gram Embedding,每token激活6B参数。它原生支持262,144token上下文,并可通过YaRN扩展至1M token。
相比于Qwen3.7-Plus,Qwen3.8-Flash显著降低了训练与推理成本,训练成本较前者下降近90%,推理成本每百万Tokens输入1元,输出3元,价格最低至DeepSeek-V4-Flash的1/3。今晚,Qwen3.8-Flash将首发上线“千问办公”。
更多精彩内容,关注云掌财经公众号(ID:yzcjapp)
以上内容仅供学习交流,不作为投资依据,据此操作风险自担。股市有风险,入市需谨慎! 点击查看风险提示及免责声明
- 热股榜
-
代码/名称 现价 涨跌幅 加载中...
加载中 ...![]()