我的数字人播报新闻
一块石壁,一次特殊的播报
西藏吉隆口岸国门一侧的半山腰上,“我爱你中国”五个大字镌刻在石壁之间。近日,泥石流裹挟泥浆冲刷而下,字迹依然遒劲清晰。这条短视频由AI主播聂一菁完成播报,剪辑工作则交由后期团队处理。
看似一条普通的主题报道,背后是一次典型的“AI+新闻”生产实践:真人声音克隆、虚拟形象驱动、自动化剪辑流水线。这已经不是实验室里的演示,而是日常新闻流程中的一环。

从“能用”到“常用”,AI主播进入量产期
虚拟数字人主播的普及速度,超出了很多人的预期。据中国传媒大学媒体融合与传播国家重点实验室2025年发布的《智能媒体技术应用报告》,国内已有超过60家省市级广电机构在常规栏目中引入AI主播或数字人播报系统,较2022年增长约三倍。
技术路径上,目前的AI主播主要依赖三项能力:语音合成(TTS)让机器“开口”,口型与表情驱动让虚拟形象“对得上”,以及自动图文匹配剪辑让内容“排得快”。据业内公开信息,主流大模型的语音克隆只需数分钟真人录音样本,即可输出接近真人的播报音色。
与上一代“录播抠像+预设口型”的方案相比,新一代系统可以基于文本实时生成表情与手势,单条短视频的制作周期从数小时压缩到分钟级。这对时间播报类、快讯类高频内容而言,是实打实的效率提升。
效率红利之外,风险同样具体
收益摆在明面上,隐忧同样清晰。其一是成本:高清数字人的建模、算力与持续训练投入不低,中小媒体的投入产出比并不乐观。其二是同质化,当AI主播的声音与形象趋于模板化,新闻产品的辨识度反而可能被稀释。
更值得注意的是信任问题。据清华大学新闻与传播学院2025年底发布的《生成式人工智能在媒体中的应用调查》,受众对AI播报内容的信任评分普遍低于真人主播约15个百分点。观众接受机器念稿,但期待情感类、现场类内容中“人的在场”。
监管也在跟进。国家网信办等部门发布的《生成式人工智能服务管理暂行办法》及后续深度合成内容标识相关规定,要求AI生成内容进行显著标识。对新闻机构而言,“哪里用AI、哪里必须真人”正在成为一条明确的编辑边界。
人机分工,重划新闻编辑部
回到吉隆口岸这条报道本身:机器负责播报的“形”,选题、判断与情感立意仍来自人的“核”。业内普遍的共识是,AI主播最适合承担标准化、高频次、强时效的播报任务,而深度调查、现场连线等场景依然由真人主导。
据IDC(国际数据公司)2026年初发布的《中国数字人市场跟踪报告》,2025年中国数字人相关市场规模已突破百亿元人民币,预计未来三年复合增长率将保持在25%以上。新闻传媒只是其中一个场景,但可能是公众感知最直接的一个。
石壁上的字迹经得起泥浆冲刷,靠的是刻进石头里的深度。对新闻业而言,AI能刻下的是速度与效率;至于那点真正打动人心的东西,仍要靠人来一笔一画地凿。
本文由AI辅助生成



