2026年9月1日
科技

多模态输入降近72%:阿里云Qwen3-VL-Rerank再探大模型价格底价

qwen模型报错原因排查指南

0.5元时代到来

0.7元降至0.5元,1.8元也降至0.5元。9月1日,阿里云公告,旗下大模型服务平台百炼对北京地域Qwen3-VL-Rerank模型的计费单价作出下调,调整自北京时间2026年8月31日10时13分起生效。其中,文本输入从0.7元/百万tokens降至0.5元/百万tokens,降幅约28.6%;多模态输入则从1.8元/百万tokens直降至0.5元/百万tokens,降幅接近72%。

值得注意的是,本次调价后,文本输入与多模态输入的计费单价实现"拉平"。对于以图文混合检索、跨模态搜索为主要场景的开发者而言,这意味着使用多模态Rerank能力时,单位成本从此前的3.6倍于纯文本,变为与纯文本完全一致。

[IMG:1]

从"按模态定价"到"同价同权"

回顾国内大模型服务这几年的定价演变,路径清晰可辨。2023年大模型商业化初期,头部厂商普遍以较高单价试探市场;2024年起的几轮"价格战",让主流通用大模型的文本推理价格大幅下探,部分轻量模型甚至进入免费区间。而Rerank(重排序)这类检索增强场景的专用模型,因调用量大、单次计算轻,一直是价格敏感度最高的品类之一。

此轮Qwen3-VL-Rerank的调价,可以视作价格战从文本生成环节向检索与多模态环节延伸的信号。Rerank模型的典型用途,是在RAG(检索增强生成)架构中对召回的候选文档做精排——它的调用频率往往远高于生成模型本身。对规模化应用来说,Rerank价格的下降,直接压缩了整体检索链路的成本。

一位从业内人士处了解到的观点是,多模态输入此前单价更高,主要源于图像Token化处理带来的额外算力开销。此番将多模态价格压至与文本持平,一方面可能得益于推理优化和推理引擎的持续降本,另一方面也反映出厂商希望在图文混合检索这一新兴场景中抢占开发者心智。

[IMG:2]

价格让利背后的账本

对阿里云而言,降价并非单纯的"让利"。云厂商大模型业务的核心逻辑在于:以低门槛的模型API吸引用户迁移上云,再通过算力、存储、数据服务等周边产品实现整体变现。Rerank模型单价虽低,但作为RAG��用的"标配组件",其价格锚点效应明显——谁先降,谁就更容易成为开发者搭建检索链路时的默认选项。

风险同样存在。持续降价意味着模型服务毛利率承压,若行业整体进入低价竞争循环,中小厂商的生存空间将被进一步挤压,头部厂商也需在"换市场份额"与"保利润"之间反复权衡。此外,价格拉平后,多模态Rerank的实际推理成本是否与文本一致,考验的是厂商底层优化能力的可持续性。

对开发者来说,这无疑是一则利好。基于公开信息的测算,一个日均处理百万级多模态文档排序的应用,按新价格计算,仅在输入环节每年即可节省相当可观的支出。而更值得关注的是,随着多模态检索成本逼近纯文本,图文混合的RAG应用有望从"技术上可行"走向"商业上划算",这将直接推动企业级知识库、电商搜索、内容审核等场景的多模态化进程。

[IMG:3]

行业观察

价格从来只是竞争的一个维度。当多模态Rerank进入0.5元区间,下一阶段的比拼将转向排序精度、延迟表现、长文档处理能力等服务质量指标。价格战打开了大门,但留住开发者的,最终还是效果与稳定性。

本次调价目前仅针对北京地域生效,后续是否扩展至其他地域、其他模型品类,据公开信息尚无明确披露。本报道将持续关注。

本文由AI辅助生成

分享到: