utilduck
Home · 办公 · 文字转语音

文字转语音

输入或粘贴文字,选择声音,点击播放即可听朗读。

关于文字转语音

utilduck只把文本交给Web Speech API,不会上传到utilduck服务器。语音合成是在设备本地完成还是使用平台服务,取决于所选浏览器、操作系统和语音引擎;输入敏感文字前,请先查看相应平台的隐私设置。

调节语速和音调可以放慢速度听得更清楚,也可以加快速度快速浏览长文本。这对通过听觉校对文字、预览文案朗读效果或作为阅读辅助都很有用。

如何在浏览器中使用文本转语音

要让文本朗读出来,在输入框中输入或粘贴文本,从设备提供的列表中选择一个语音,如需可调整语速和音调,然后点击播放——浏览器内置的Web Speech API会立即将文本转换为语音。

文本转语音操作步骤

  1. 在文本框中输入或粘贴要朗读的文本。
  2. 从下拉列表中选择语音,与页面语言匹配的语音会排在最前面。
  3. 拖动语速滑块,放慢以听得更清楚,或加快以快速浏览。
  4. 如需更高或更低的音调,调整音调滑块。
  5. 点击播放即可听到朗读,随时点击停止可取消播放。

浏览器生成语音的原理

文字 → Web Speech API → 浏览器与操作系统选择的语音引擎或服务 → 音频
  • 可用语音、音质和处理路径取决于浏览器、操作系统、所选语音及平台设置。处理可能在设备上完成,也可能使用平台服务;utilduck无法通过Web Speech API判断具体路径。
  • 语速/音调 = 播放速度与音高,二者可分别独立调整

语速与音调设置及其效果

设置数值效果
语速0.5倍较慢,适合仔细听或语言学习
语速1.0倍正常说话速度(默认)
语速2.0倍快速浏览长文本
音调0.0音调较低的声音
音调2.0音调较高的声音

常见问题

为什么可选的语音很少,甚至只有一个?

可用语音、音质和处理路径取决于浏览器、操作系统、所选语音及平台设置。处理可能在设备上完成,也可能使用平台服务;utilduck无法通过Web Speech API判断具体路径。

生成语音时,我输入的文字会上传到服务器吗?

utilduck只把文本交给Web Speech API,不会上传到utilduck服务器。语音合成是在设备本地完成还是使用平台服务,取决于所选浏览器、操作系统和语音引擎;输入敏感文字前,请先查看相应平台的隐私设置。

为什么听起来的声音很机械,和平时用的语音助手不一样?

可用语音、音质和处理路径取决于浏览器、操作系统、所选语音及平台设置。处理可能在设备上完成,也可能使用平台服务;utilduck无法通过Web Speech API判断具体路径。

文字转语音除了无障碍用途,还能用来做什么?

除了帮助有视力障碍或阅读困难的人,它也常被用来听读校对文字(用耳朵发现眼睛容易忽略的别扭表达)、提前听一下演讲稿或文案念出来的效果,或者在不方便看屏幕时听完长文章。

可用语音、音质和处理路径取决于浏览器、操作系统、所选语音及平台设置。处理可能在设备上完成,也可能使用平台服务;utilduck无法通过Web Speech API判断具体路径。

Sources: MDN — Web Speech API

隐私与安全

  • 在浏览器中计算 — 您输入的内容仅在本机设备上计算,不会发送到 utilduck 服务器。
  • 加密连接 — 所有页面均通过 HTTPS 提供,传输过程中无法被读取。
  • 不提供给第三方 — 您输入的内容不会传递给分析或广告服务。
  • 不保存 — 计算结果不会保存到任何服务器,也无需注册账号。

最后更新: 2026-08-17

浏览器朗读结果为何会不同

文字转语音调用设备和浏览器提供的语音引擎,因此可选声音、语言、发音和停顿会随系统而变。同一段文字在另一台手机上不一定完全相同。朗读前应选择与文本一致的语言,并把缩写、数字、网址和专有名词单独试听;必要时用空格、标点或完整写法帮助引擎正确断句。

该功能适合校对草稿、辅助阅读和快速试听,不等同于专业配音或无障碍合规测试。重要通知要同时保留可读文本,不能只提供音频。若浏览器没有安装对应语言的声音,可能退回默认语音或无法播放,此时可在系统设置中添加语音,或换用支持该语言的浏览器。

为了得到更可懂的朗读,可先按意思编辑文本,而不是只调快慢和音高。过长句子、缺少标点、连续缩写、网址、货币、日期和混合语言都会让语音引擎难以选择停顿与读法。可以把标题、正文和列表分段试听,为容易误读的专有名词改用完整写法或人工可理解的分隔,并让目标语言与所选语音一致。同一个“声音名称”在系统更新、设备切换或另一浏览器中也可能不可用,因此制作说明时应记录语言、设备和设置,而不要把某次试听结果当成可移植音频文件。

若朗读用于学习、校对或辅助阅读,应同时保留可选择和可复制的文字,并由实际使用者确认语速、发音与操作是否合适。浏览器语音功能的处理路径可能随操作系统、浏览器和已安装语音而异;输入敏感、受保密约束或包含个人资料的文字前,应查看所用平台的隐私说明和组织政策,不能仅凭页面界面推断所有处理都在本机。该工具也不会生成专业配音授权、字幕同步或无障碍合规证明。重要通知还应提供人工复核的文本版本,并测试键盘、屏幕阅读器和播放控制。需要发布音频时,应改用明确允许导出与再分发的制作流程,并检查语音许可、录音质量和后期编辑。浏览器播放中断、设备静音或语音列表尚未加载时,先确认系统可用声音与权限,再重试短句;不要用无声结果推断原文损坏。医学、法律和紧急信息还需由人核对发音与含义。