在线 TTS 和系统自带朗读有什么不同
手机和电脑本身就带有文字转语音功能:读屏软件、浏览器的大声朗读、安卓系统的语音引擎等。它们很适合在自己的设备上听,但用的是系统音色,也不会给你一个可以发布的音频文件。
谷歌也通过 Google Cloud 向开发者出售文字转语音服务,需要创建项目、开通计费并写代码调用。这个生成器在一个网页里集成了 MiniMax、OpenAI 和谷歌 Gemini 的神经网络音色,直接给你音频文件,不需要任何配置。
这个文本转语音在线生成器能把粘贴的文字变成可下载的音频文件。粘贴最多 4,000 个字符,选择模型、音色和语速,几秒后即可播放,并下载为 MP3(MiniMax、OpenAI)或 WAV(Gemini)。每字符 1 积分,生成记录保存在你的私人历史中。
每段语音都能下载成音频文件,直接放进剪辑软件、播客应用、演示文稿或电话系统。
计数器显示 4,000 字符上限已用掉多少,价格也随输入实时更新。
生成好的语音保存在账号里,之后可以随时重听或再次下载。
在 MiniMax、OpenAI 和 Gemini 之间随意切换,不用注册多个账号,也不用申请 API 密钥。
控制在字数上限以内;更长的内容按段落分几次生成。
打开音色列表(MiniMax 按语言分组),如果模型支持,再选一个语速。
点击“生成语音”,试听结果,然后下载文件。
手机和电脑本身就带有文字转语音功能:读屏软件、浏览器的大声朗读、安卓系统的语音引擎等。它们很适合在自己的设备上听,但用的是系统音色,也不会给你一个可以发布的音频文件。
谷歌也通过 Google Cloud 向开发者出售文字转语音服务,需要创建项目、开通计费并写代码调用。这个生成器在一个网页里集成了 MiniMax、OpenAI 和谷歌 Gemini 的神经网络音色,直接给你音频文件,不需要任何配置。
每段最多 4,000 个字符,约 16 分钟普通话或 4 分钟英文。整篇文章或一节课的讲稿,可以按标题或场景切分,每段用同一个音色和语速生成,再在任意音频或视频剪辑软件里拼接。分段还有一个好处:只需重做出问题的那一段,不用整篇重来。
大家最常用它来做:
做的事情一样,都是把文字变成语音,但这里是直接给你音频文件的网页工具。安卓自带的引擎在手机上朗读文字;Google Cloud Text-to-Speech 是面向开发者的付费 API。在这里,你粘贴文字,在 MiniMax、OpenAI 和 Gemini 的音色里挑选,然后下载。我们与谷歌没有关联。
MiniMax 和 OpenAI 的音色下载为 MP3,几乎所有剪辑软件和播放器都支持。Gemini 的音色下载为 WAV,这是无压缩格式,文件更大,但更适合后期处理。
可以,分段进行。每段最多 4,000 个字符。用同一个音色和语速逐段粘贴生成,再把文件拼起来;一份 20,000 字符的文档分五段生成,总价和一次生成完全相同。
不需要。电脑或手机上的现代浏览器都能用。登录后粘贴文字即可生成,生成记录保存在账号历史里。
最后更新:2026年10月6日