把文字粘进去,选个音色,点生成,下载 WAV。整个过程都在你浏览器里跑——不用账号、没有额度、什么都不上传。

流程就这么简单。机械感和「能直接发布」之间的差距,全在几个小选择上。

先把音色选对

别的先不管,先用同一句话试听两三个音色。音色之间的差别比标签上看起来大得多——有的温暖像聊天,有的平得像念新闻稿。适合冥想文案的那个,放到产品演示里就是错的。

试听时念你脚本里真实的一句,别用「你好世界」。你要判断的是它怎么处理你的标点和节奏,不是一句通用短语。

按耳朵的节奏来,不是眼睛

在屏幕上读着顺的文字,念出来常常显得急。两个调节点有用:

  • 语速。大多数情况留 正常。教程、或带数字和人名、需要听清的内容,降到 较慢;只有轻松、熟悉的内容才用 较快
  • 标点。逗号、句号会变成停顿。一整段没有逗号的文字念起来会上气不接下气。把长句拆开,段落之间空一行,能给听者一个消化的拍子。

一个快速检验:闭上眼听一遍。哪里走神了,那里就该加停顿。

导出和使用

生成的音频以 WAV 下载——音质高,但体积大。如果要发到有大小限制的地方(聊天软件、幻灯片),事后用音频压缩工具转成更小的 MP3,听感几乎无损。

为什么本地很重要

一切都在你设备上完成——模型在浏览器里运行,脚本不会发到任何服务器。对未发布的内容、客户文案、或任何你不想粘进云端工具的东西来说,这就是关键。顺带还没有按字符计费,也不用注册。


想听听效果?把文字放进文字转语音工具,并排试两个音色。