本周国内多家大模型厂商先后宣布下调 API 定价,其中长上下文调用价格最高降幅达 60%。这是继去年之后的又一轮价格调整,竞争焦点明显转向超长文本与多模态场景。
厂商在公告中普遍提到,降价的基础来自推理效率优化,包括更激进的稀疏化策略与缓存复用机制。部分厂商还推出了阶梯计费与离线批量任务折扣,进一步降低文档处理类应用的成本。
行业分析认为,随着推理成本持续下探,长文档分析、代码库理解与多轮研究对话等高价值场景将率先受益,应用层的商业化空间正在被重新打开。
本周国内多家大模型厂商先后宣布下调 API 定价,其中长上下文调用价格最高降幅达 60%。这是继去年之后的又一轮价格调整,竞争焦点明显转向超长文本与多模态场景。
厂商在公告中普遍提到,降价的基础来自推理效率优化,包括更激进的稀疏化策略与缓存复用机制。部分厂商还推出了阶梯计费与离线批量任务折扣,进一步降低文档处理类应用的成本。
行业分析认为,随着推理成本持续下探,长文档分析、代码库理解与多轮研究对话等高价值场景将率先受益,应用层的商业化空间正在被重新打开。