2026年9月9日
科技

松延动力发布世界模型加码具身大脑 微信支付押注智能眼镜新场景

OpenArm2.0 它来了(世界模型)

从本体到大脑:松延动力发布HERON-World Model

9月8日上午,北京一家机器人公司的内部实验室里,一台人形机器人正对着面前的桌子反复“思考”——它在预测自己伸手拿起水杯之后,桌面会发生怎样的变化。这不是科幻电影的场景,而是松延动力最新发布的世界模型正在进行的测试。

当天,这家以人形机器人本体见长的创业公司正式推出通用具身智能技术子品牌Scalabot,并同步发布HERON技术架构体系下的首个世界模型HERON-World Model。这是一款面向具身智能的动作条件世界模型,核心功能是预测机器人采取不同动作后环境可能发生的变化,为自主决策提供依据。

此次发布标志着松延动力从机器人本体制造向“本体+具身大脑”的全栈能力布局迈出关键一步。过去三年,这家公司一直聚焦于机器人本体的研发制造——从结构设计、运动控制,到供应链整合和规模化制造。2025年10月,松延动力发布了高性能消费级人形机器人“小布米”,采用轻量化材料,将价格带入万元级区间。同年12月,公司与慧辰股份达成1000台订单签约。

但在本体能力逐步夯实之后,松延动力意识到一个根本性问题:真实世界的开放性与不确定性,对机器人的感知、理解和决策能力提出了更高要求。机器人不能只是“能动”,还必须“能想”。这正是Scalabot诞生的逻辑——将业务从硬件延伸至模型层。

Scalabot的品牌含义耐人寻味。它取自“Scale”和“Robot”的组合,松延动力认为规模法则在物理世界同样成立——数据规模是提升具身智能能力的关键。围绕这一判断,Scalabot将探索模型能力如何随着数据、模型和机器人数量的扩大而持续成长。

在软硬件协同方面,松延动力与Scalabot将在机器人硬件定义阶段就考虑智能系统对传感器、算力、自由度和数据接口的需求。更重要的是,Scalabot的模型架构不绑定单一本体——通过统一的动作表示和跨平台设计,面向不同构型、不同自由度的机器人,推动智能能力的迁移与泛化。

HERON-World Model是这一方向下的首项公开成果。后续,Scalabot还将陆续发布HERON系列模型,以家庭服务为重要场景,并向商业服务等领域延伸。

这一布局背后有充足的资金支撑。据公开信息,2026年3月,松延动力完成B轮融资,由宁德时代系产业投资平台晨道资本领投,国科投资、京国盛基金、九合创投等机构跟投,B轮融资规模累计近10亿元。公司已累计完成9轮融资并完成股份制改革。

从行业视角看,2026年被业界称为“世界模型元年”。具身智能的投资逻辑正从押注机器人本体转向押注具身大脑。毕马威发布的《世界模型如何重塑具身智能产业与商业新范式》报告指出,具身世界模型正沿着“物理一致、因果干预、离线策略评估、实时闭环控制及自我进化”等方向持续演进。松延动力此次出手,踩在了这一技术路线的关键节点上。

微信支付上线智能眼镜SDK:抬眼即付

同一天,另一项技术发布同样值得关注。微信支付智能眼镜SDK正式上线——微信支付将“扫一扫”支付能力封装成一套标准SDK,面向符合接入标准的智能眼镜厂商开放。用户可以在适配的智能眼镜上完成付款,Rokid乐奇AI眼镜是首款完成适配的产品。

实际使用流程被压缩到四个步骤:说一句“微信扫一扫”唤起功能;将视线对准商家收款二维码;在眼镜屏幕上查看商户和金额后滑动镜腿确认;支付成功后眼镜屏幕显示结果并语音播报。

微信官方强调,这并非新的支付方式,本质仍是微信支付“扫一扫”付款能力。在安全方面,基础版本支持每日200元限额,配备虹膜、指纹等身份识别功能的眼镜设备可享有更高额度。目前SDK仅支持扫描收款码付款,覆盖便利店、菜市场、路边摊等小额、高频交易场景,暂不支持扫描小程序码等其他功能。

目前SDK仍处于Beta阶段。但这一动作的信号意义明确——微信支付正在为下一代计算平台提前布局支付基础设施。智能眼镜作为被业界广泛看好的下一代个人计算终端,支付能力是不可或缺的基础模块。微信选择以标准化SDK的方式开放这一能力,而非自研硬件,路径与当年在智能手机时代的策略一脉相承。

AI行业的“9月8日”:多线并进

9月8日这一天,AI行业的动作远不止上述两项。

网易有道推出了首款AI原生语音Agent“网易叭哥说”,官方称语音输入效率达键盘5倍,支持124种语言实时翻译,数据全程本地处理、终身免费。产品依托有道多年沉淀的语音识别和翻译技术,跳出传统“语音转文字”的工具定位,将自然口语直接转化为结构化、可直接复用的高质量文本。

腾讯文档宣布AI服务全端升级,正式推出“AI工作台”。基于WorkBuddy提供的Agent内核框架,AI从单纯生成内容进一步进入真实文件和办公任务的完整流程——可以直接修改文件、参与协作和执行后续任务。

字节跳动被曝正准备推出一款实时空间视频生成AI模型,基于现有的电影级视频生成模型Seedance构建。该模型允许用户为直播、短剧和游戏创建交互式虚拟世界,每秒20帧的帧率下延迟约0.05秒。据彭博社报道,创始人张一鸣亲自督导该项目。

DeepSeek启动新一轮招聘,计划招募约150名工程师,全部集中于服务端开发与Agent弹性计算研发两个方向,重点面向2至10年经验的资深工程师。这是DeepSeek在两个多月内的第二次大规模招聘,但与6月全面铺开的综合招聘不同,此次150个岗位全部押注工程化与基础设施。据公开信息,DeepSeek研究与工程团队已增加至270人,公司总员工约300人。此次新增150人,相当于再招“半个DeepSeek”。

法国AI公司Mistral宣布完成30亿欧元D轮融资,投后估值超过210亿欧元。这是欧洲科技企业迄今规模最大的股权融资。三星电子领投本轮融资。Mistral主打“开放权重”模型路线,企业可在自有服务器或指定云环境中部署和调整模型。公司称目前已在20个国家开展业务,为超过125家大型企业提供AI转型支持,客户包括空客、ASML和汇丰等。

从松延动力从本体向大脑的延伸,到微信支付对下一代终端的提前卡位,从DeepSeek重金押注工程化基建,到Mistral创纪录的欧洲融资——2026年9月8日这一天的密集动作揭示了一个清晰的信号:AI行业的竞争正在从单一的技术突破,转向全栈能力、基础设施和场景落地的全面较量。具身智能的世界模型、智能眼镜的支付场景、语音Agent的交互革命、办公AI的流程再造,每一条战线都在加速推进。

这场竞赛远未到终局。但有一点已经明确:谁能把AI从“能说会道”变成“能做会想”,谁就能在下一阶段的竞争中占据先机。

本文由AI辅助生成

分享到: