📌 信息分类:数据要素
📰 信息来源:36kr.com
📅 原文发布时间:2026-09-20 16:00
🕒 本站采集时间:2026-09-21 06:03:44
📝 核心摘要
2026年9月,一场从深圳蔓延至硅谷的大模型“换模潮”正在兴起,核心趋势是大模型集体向“小”转型,厂商纷纷推出Flash版本的小参数模型,成为AI领域效率与成本革命的核心载体。深圳某十人人AI创业公司此前依赖OpenAI GPT系列模型,因并发任务处理有限、调用成本高,于今年9月试用后选中DeepSeek V4.1 Flash,其反馈更快、性价比更高,成为团队日常开发的核心工具。与此同时,全球头部模型厂商均加速布局小参数模型:Google在I/O大会推出Gemini 3.5 Flash,瞄准日常开发与办公场景;OpenAI于7月将GPT-5.6 Luna价格下调80%,以性价比优势争夺Agent客户;国内厂商动作密集,7月31日DeepSeek发布V4 Flash正式版,8月26日阿里Qwen团队推出Qwen3.8-Flash-Next、智谱发布GLM-5.3-Flash,9月DeepSeek再推V4.1 Flash,这些Flash模型参数均处于100B-500B区间,远小于旗舰模型的万亿级参数。小模型兴起的核心动因在于AI Agent场景的爆发:频繁调用大模型会带来高成本与低效率,而Flash模型单次调用参数少,适合处理日常高频任务,复杂问题仍可交由旗舰模型解决。关键数据显示,千问办公将Qwen3.8-Flash应用于标准办公模式后,单项任务速度提升约一倍,平均Token消耗减少75%,可覆盖95%的日常任务;美国创业公司Lindy切换至DeepSeek V4 Flash后,模型调用费用下降约九成,产品质量未受影响;OpenRouter平台数据显示,DeepSeek的Token用量份额从年初9%升至6月初的18%,增长主要来自Agent任务。当前,全球模型厂商围绕Flash模型形成新的竞争主线:在AGI能力上限竞争之外,谁能以高性价比模型覆盖更多真实任务、服务更多用户,成为商业化突破的关键。国内模型公司虽获资本押注,但仍面临商业化压力,如智谱2026年8月ARR约16亿美元,市销率达46倍,DeepSeek估值为预估年化收入的163倍,需通过Flash模型打开更大市场。此外,Flash模型还承担技术试验与能力下放的作用:智谱用旗舰GLM-5.3优化GLM-5.3-Flash部署,两周内实现国产芯片适配,处理请求能力提升三倍;Qwen在Qwen3.8-Flash-Next上测试Qwen4的新架构,训练算力仅为Qwen3.7-Plus的九分之一。这场从“编程”到“日常办公”的需求转型,正推动大模型产业向更高效、更普惠的方向发展。
🔗 阅读原文
🏷️ 标签:大模型轻量化, Flash模型, AI Agent, 模型性价比