news 2026/8/10 10:49:46

播了半年,听众才发现主持人是AI

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
播了半年,听众才发现主持人是AI

悉尼有一家叫CADA的音乐电台,工作日的白天有一档节目叫《Workdays with Thy》。主持人Thy,声音年轻、亲和,每个工作日陪着听众四个小时,一播就是将近半年。这半年里,没人觉得哪里不对。她报歌、串场、聊几句轻松话题,语气自然,节奏也稳。

2025年4月,一位叫Stephanie Coombes的作家起了疑心。她发现这个Thy在网上查不到任何一次公开露面,没有能对上号的照片,也没有过往的采访。她追问下去,电台才承认:Thy不是真人,是AI生成的虚拟主持,声音用ElevenLabs的声音克隆技术做出来,克隆的对象是电台母公司ARN的一名真实员工。

事后回看,破绽就藏在那张照片里。有报道指出,Thy的头像用的是ARN一名员工的脸,只是换了个名字;而电台网站上其他主持人的照片,文件名里都嵌着本人的名字,唯独Thy这张写的是另一个名字。一个平时没人会点开细看的地方,成了这档节目最先露出的马脚。

在澳大利亚,这件事不违法。当时没有任何法律要求电台披露主持人是不是AI。CADA没有触犯规则,它只是没说。可正是"没说"这两个字,点着了后面所有的争论。

▲图:Thy在悉尼的白天档播了近半年。争议的起点不是电台用了AI,而是它默认听众不需要知道。

瞒得住,是因为已经听不出来

争论的第一层,是技术已经好到听不出来。半年没人起疑,不是听众不上心,而是合成的声音加上生成的稿子,在正常收听的状态下确实找不到破绽。

过去分辨真人和合成,靠耳朵就够。一段机器合成的语音,语调平、换气假、连读生硬,听两句就露馅。现在不一样了。合成语音能带上语气的起伏,能在该停顿的地方停顿,能把一句串场说得像临场发挥;配上大模型写的稿子,内容也接得上时事、对得上当天的歌单。同一类技术,正在把两个人对谈式的播客整段整段地生成出来,一次做几十种语言。放到一档四小时的音乐节目里,这些早就够用了。

听众失去的不是判断力,是判断的依据。你没法再从声音本身找出破绽,因为破绽被磨掉了。

于是问题从"听不听得出"变成"该不该告诉你"

分辨这件事一旦交不回给耳朵,就只能交给规则。Thy事件真正扎人的地方,不在于电台用了AI,而在于它默认这件事不必让听众知道。一档每天四小时的陪伴节目,建立在一个人格之上,听众以为这个人格是真的,其实是虚构的。争议由此而来:这不是技术问题,是知情问题。你可以接受机器陪你聊天,前提是你知道对面是机器。

行业里已经有人给出了最直接的答案——干脆不用。2025年12月,美国规模最大的广播集团之一iHeartMedia成文规定,旗下电台上麦的主持、台歌串词、节目包装,每一个声音都必须是真人,内部备忘录的原话是"每个声音必须是人"。幕后的排期、剪辑、数据分析用AI可以,话筒前不行。这是一种极端而清晰的立场:与其事后解释哪一段是AI,不如让话筒前根本没有AI。

▲图:面对同一个问题,一头是干脆不用,一头是用可以但必须声明。Thy出事,出在中间那片还没有规矩的地带。

中国把另一个答案写进了法规

另一个方向不是禁止,是强制说明。2025年9月1日,《人工智能生成合成内容标识办法》正式施行。它把音频和文本、图片、视频并列,明确列为必须标识的AI生成合成内容。也就是说,AI配音、语音克隆、AI生成的播客节目,全都在监管范围里。

办法对音频给出的标识方式很具体:在音频的起始、末尾或者中间适当的位置,加一段语音提示,或者加一段音频节奏提示。所谓音频节奏提示,是一段特定节奏的信号,配套的国标把它定成"短长短短"这样的模式。一句话,一段AI生成的声音,要么开口告诉你它是AI,要么在音频里留下一个能被机器读出来的节奏印记。

把这套规则放回Thy这件事上,结论就变了。在中国,一档《Workdays with Thy》从第一天起就得让听众知道台前是AI,无论它做得多像真人。分辨的责任,从听众的耳朵,挪到了内容方的标识义务上,你不必再听得出,因为对方必须先讲明。

广播要重新学会自报家门

这件事对广播的意味,比对播客更直接。广播是单向的、伴随性的收听。人们开着车、做着饭,并不盯着屏幕,就让声音陪着。正因为不盯着,声音的可信度就是这门生意的地基:话筒后面是一个真人,是广播默认了一百年、从没被追问过的前提。Thy把这个前提第一次摆到了台面上——当台前可能是AI,而听众无从分辨,这块地基就需要一个新的支撑:不是让声音更像真人,而是让台前是不是真人这件事本身变得可查。

国内的AI音频不是纸面上的推演。已经有平台把AI接进了有声内容的录制和后期,用自有版权的语料训练出音频大模型,十几秒就能克隆一个人的音色。技术早就到位,先落地成规矩的,是标识。

广播花了一百年,让听众习惯了话筒后面站着一个人。现在这条默认不再自动成立,要补的是一套办法,让听众重新能弄清话筒后面到底是谁。Thy在悉尼播了半年没人问,是因为没人想到要问。等到想问的人多起来,声音值不值得被信任,就不再取决于它像不像真人,而取决于说话的一方肯不肯先讲清楚,自己到底是不是人。这一步,规则已经先于习惯迈了出去。

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/8/10 10:48:25

智能暂停更新策略:提升Web应用体验

一、引言:为什么需要离线暂停更新策略?在当今追求极致用户体验的Web应用开发中,应用的更新与发布是一个高频操作。然而,直接、强制性的更新(如刷新页面、中断用户操作)会带来糟糕的用户体验,尤其…

作者头像 李华
网站建设 2026/8/10 10:48:04

51单片机自动门设计:红外感应、Proteus仿真与Keil源码全解析

这次我们来看一个基于51单片机的自动门设计项目,它完整包含了红外感应、Proteus仿真、Keil源码和设计报告。对于单片机初学者、电子爱好者或需要完成课程设计的同学来说,这是一个非常经典的实战案例。它不涉及复杂的AI模型或高算力需求,核心在…

作者头像 李华
网站建设 2026/8/10 10:47:20

Figma到Unity UI自动导入:原理、工具与高效工作流实践

1. 项目概述:为什么我们需要Figma到Unity的导入工具?如果你是一个Unity开发者,或者是一个需要与Unity开发者协作的UI/UX设计师,那么“设计稿还原”这个词对你来说一定不陌生,甚至可能有点头疼。设计师在Figma里精心打磨…

作者头像 李华
网站建设 2026/8/10 10:45:19

Linux下Ghostscript编译安装与优化指南

1. 为什么选择编译安装Ghostscript? 在Linux环境下处理PDF和PostScript文件时,Ghostscript堪称瑞士军刀级别的存在。这个开源解释器能够处理PS/EPS/PDF/XPS等多种格式的文档转换和渲染工作。虽然大多数Linux发行版的仓库中都提供了Ghostscript的二进制包…

作者头像 李华
网站建设 2026/8/10 10:44:50

基于Stable Diffusion与Gradio的AI寻人启事生成器实战部署指南

最近在尝试将AI技术应用到实际生活场景时,发现了一个非常有趣且实用的开源项目—— fofr 。它不是一个简单的AI聊天工具,而是一个能够根据用户提供的描述,自动生成“寻人启事”海报的智能体。想象一下,你只需要用文字描述一个人…

作者头像 李华
网站建设 2026/8/10 10:44:15

AI降重与查重系统博弈:学术写作的实战策略

1. 当AI降重遇上查重率飙升:学术写作的双重困境去年帮导师审阅研究生论文时,我发现一个有趣现象:有位同学用AI工具降重后,查重报告里标红部分确实减少了,但总重复率却从12%暴涨到28%。拆解查重报告发现,AI改…

作者头像 李华