首页AI 频道AI 术语词典语音合成(TTS)
语

语音合成(TTS)

应用与产品 1 次浏览 更新于 2026-10-07 14:50
返回术语列表

一句话理解

让机器开口说话——把文字变成自然的人声,导航播报、有声书、语音客服背后都是它。

定义

语音合成(TTS,Text-To-Speech)指把文字转换为语音的技术。深度学习让它从“机器人腔”进化到与真人难辨,支持情感表达、多说话人、多方言。

你会在哪遇到它

手机导航的语音播报;有声书与短视频配音;无障碍读屏;AI 客服电话;数字人开口说话。

背后的原理

经典流程分三步:文本先转成带韵律信息的中间表示(在哪停顿、哪里重音、什么情绪),声学模型把它变成声音特征,声码器合成最终波形。大模型时代的端到端方案直接从文字到语音,自然度大幅跃升。

和相近概念的区别

1 与语音识别(ASR):一个负责说、一个负责听,反向兄弟。 2 与声音克隆:语音合成用现成音色库,克隆是先复刻指定真人的音色再合成。 3 与语音对话:一次语音聊天等于合成(说)加识别(听)加大模型(想)三件套联动。

常见误区

1 合成音一听就知道——顶尖产品已难辨真伪,对“听起来像真人”的电话保持警惕。 2 只会说标准普通话——主流产品已支持多种方言和外语。 3 没有滥用风险——语音伪造是真实威胁,涉及钱财务必用官方渠道二次核实。

所属分类应用与产品
更新时间2026-10-07 14:50
浏览量1
点赞0
每个 IP 仅可点赞一次 · 点赞后不可取消

评论 (0)

发表评论

0/300

暂无评论,来发表第一条评论吧!

便签
已输入:0/500字

    扫码访问工具