阿里开源Qwen3.8-Flash 推理价格最低降至DeepSeek-V4-Flash三分之一
8月26日晚间,阿里发布并同步开源千问最新模型Qwen3.8-Flash。该模型采用全新下一代架构,千亿总参数仅激活60亿(6B)即可获得超越Claude Opus4.6的前沿性能,创下模型效率全球新基准。Qwen3.8-Flash今晚将首发上线"千问办公",开发者和企业也可通过千问AI平台获取新模型API服务。
Qwen3.8-Flash的最大看点,是训练与推理成本的"断崖式下降"。得益于架构和训练的革新,Qwen3.8-Flash训练成本较Qwen3.7-Plus骤降近90%,推理成本同样大幅下降,每百万Tokens输入仅1元,输出3元,价格最低至DeepSeek-V4-Flash的1/3。这意味着,无论对头部企业还是中小开发者,接入主流大模型能力的边际成本正在被压缩到"几乎可忽略"。
在性能对标上,Qwen3.8-Flash以60亿激活参数实现"千亿级模型效果",这意味着模型架构在MoE(混合专家)路径上已经走通"小激活、强性能"的工程化路线。开源协议下,开发者可以下载模型权重进行本地部署和二次训练,这意味着国内大模型生态将进一步"普惠化"——从头部企业到中小开发者,都能用极低的推理成本接入主流水平的模型能力。当训练成本降低九成,模型迭代速度也将明显加快,应用层创新的"密度"将显著提升。
对应用层而言,推理价格被打到DeepSeek-V4-Flash的三分之一,意味着AI Agent、企业知识库、智能客服、AI办公等高频调用场景的"Token经济"将出现根本性改变。当大模型推理进入"毛分钱时代",AI应用的商业模型有望从"按调用次数计费"走向"按业务结果计费",SaaS化、行业方案化的盈利空间被显著打开。同时,Qwen3.8-Flash的发布将与近期阿里在AI基础设施、芯片、网络等领域的全栈布局形成协同——上游有阿里云、磐久AI服务器、平头哥芯片,中游有Qwen系列模型矩阵,下游有千问办公、淘宝问问、钉钉AI助理等应用场景。
从产业竞争看,Qwen3.8-Flash的开源降价,将把国内大模型竞争推向"以效率换市场"的新阶段。在DeepSeek、月之暗面等同行持续推新降价的背景下,阿里通过架构级创新把成本曲线整体下移,传递了"开源+普惠"战略的清晰信号。可以预期的是,未来一段时间,围绕MoE架构、长文本理解、多模态能力、工程化部署的竞争将更激烈;与此同时,应用层的创新也将因基础模型成本的下降而进入更活跃的阶段。
免责声明:
1、凡本网注明 '来源:大湾区经济网' 所有内容与数据,均属于大湾区经济网综合公开信息整理的数据(内容不构成投资建议,使用前请核实);欢迎转载、摘编使用上述作品,转载时应注明出处。
2、文章内容仅供参考,不构成投资建议。投资者据此操作,风险自担。
3、本网所有的图片为政企或百度图库公开检索及配图,版权归原权利人和单位;如政企单位投稿所配的图片均默认授权给大湾区经济网,并有权使用和存用资料库中。
4、凡本网注明 '来源:XXX(非大湾区经济网)' 的,均转载自其它媒体或平台,转载目的在于传递更多信息,并不代表本网赞同其观点和对其真实性负责。
5、如涉及版权问题,请作者持权属证明联系侵删。
※ 欢迎上市公司、政府、商协会合作投稿,邮箱:dwqce@qq.com


