推理单价年均跌 90%,但 Agent 化工作流将单任务 Token 消耗推高 5–1000 倍,企业 AI 总支出持续…
人工智能的单位推理成本正以断崖式速度下行,但企业的 AI 账单却在持续攀升。这一看似矛盾的现象背后,是「单价暴跌、消耗爆发」的双曲线作用机制。36 氪转载的 Michael Watkins 分析文章指出,理解这一机制正在成为企业决策层的核心命题。
行业数据印证了算力价格的快速下降。Epoch AI 评估六项核心基准后发现,达成特定性能标准的算力成本,依任务类型差异,每年降幅在 9 倍至 900 倍之间。以解答博士级科学问题为例,达到 GPT-4 级性能的单位成本每年缩减约 40 倍;Andreessen Horowitz 的测算也显示,同等性能模型的市场均价每年下跌 90%。
推动价格快速下行的核心动力是白热化的市场竞争,中国开源力量的冲击尤为突出:
与此同时,代表行业顶尖水平的「前沿能力」依然掌握定价权。OpenAI 推出首款具备前沿推理能力的模型时,初始定价仍维持在每百万 Token 60 美元的高位。更关键的是,代理式工作流(Agentic Workflow)为完成一项任务,需要经过目标拆解、工具调用、结果校验、自我修正等多轮迭代,每一步都要重复提交海量上下文信息。
将两条曲线结合,企业的 AI 账单即「单位价格 × 消耗总量」。假设某项任务去年单次成本为 1 美元、今年降至 10 美分(降幅 90%),但代理化工作流让单次任务的调用频次暴涨 50 倍,实际账单就会从 1 美元升至 5 美元,价格红利被完全抵消。
微观层面的冲击同样显著:Uber 首席技术官透露,公司 2026 年度 AI 预算仅四个月便消耗殆尽,根源是 5000 名工程师全面启用智能代理编程工具,单人月均成本攀升至 500 至 2000 美元。Menlo Ventures 数据显示,2025 年企业对大语言模型的投入半年内便实现翻倍;Gartner 预测,2026 年全球企业在 AI 模型与平台上的支出将超过 643 亿美元。
只有同时审视两条曲线,才能看清 AI 商业格局的真实面貌:模型能力以极快的半衰期向价格底线坠落,本季度还具备高价值的差异化壁垒,下一季度就可能沦为免费的通用能力,新一代前沿能力随即补位登顶。这条分水岭的动态迁移永不停歇,且始终保持单向演进。
汽车行业的「代际迭代机制」是理解这一现象的参照——旧款逐年贬值降价,新款始终维持高价,循环往复。但在 AI 领域,「年款」并非以自然年为单位,实际技术迭代周期已压缩至季度级。如果企业高管仍沿用传统的年度规划节奏,决策节奏实质上已落后市场整整三个技术周期。
经典战略管理理论的 VRIO 框架指出,一项资源要构建长期竞争优势,必须同时满足价值性、稀缺性与不可替代性。上一代 AI 模型虽具备极高价值,却已失去稀缺性与模仿壁垒。当某项能力跌入免费的价格底线,就自然成为所有竞争对手乃至新进入者的通用基础设施。
战略学界对这一演化路径早已熟知:当一项创新价值巨大却极易复制时,最终捕获商业价值的往往不是创新的直接应用者,而是掌握「互补性资产」的主体。在 AI 时代,这些不可替代的互补性资产包括:
「模型代际迭代机制」为经典战略框架叠加了更残酷的动态属性。即便企业拥有雄厚的静态资产,若无法围绕新一代 AI 能力完成敏捷的组织重构,原有优势仍会被持续侵蚀。真正持久的竞争优势,来自战略管理学定义的「动态能力」——持续识别 AI 能力所属代际的洞察力、比竞争对手更快落地商品化能力的技术执行力,以及随价格底线下移精准调配人才与资本的组织弹性。静态护城河决定企业当下的竞争位势,重构迭代速度决定企业能否保持长期领先。
文章以年营收 100 亿美元的区域性医疗集团为例,将 AI 项目拆分为三类并提出差异化策略:
硬件投入的确定性很高,真正的未知数是这些投入能转化为多少有效智能产出。文章勾勒了三种潜在方向:
文章最后指出一个耐人寻味的现实错位:多数企业正盲目按照情景一规划未来,AI 供应商却在按照情景二制定高价。这一错位,是 AI 时代企业战略决策中最值得警惕的认知偏差。