基于浏览器的文本转语音
直接在浏览器中根据文本生成语音,然后将结果下载为音频文件。首页还说明该产品可处理从短音频片段到书籍长度旁白的各种内容。
SpeechGen 是一款基于浏览器的 AI 文本转语音工具,可从文本和上传文档生成可下载配音。支持 150 多种语言、5,000 多种声音,并可导出 MP3、WAV、FLAC 等格式。
SpeechGen 是一款在线文本转语音和 AI 语音生成工具,可在浏览器中创建可下载的配音。它支持粘贴文本和上传文档,提供大量语音和语言选择,并可导出 MP3、WAV 和 FLAC 等格式的音频。
该产品同时面向手动配音工作和自动化生成。用户可以调整语速、音高、音量、停顿和风格,添加背景音乐或多个说话人,还可以通过 API 进行程序化合成。
直接在浏览器中根据文本生成语音,然后将结果下载为音频文件。首页还说明该产品可处理从短音频片段到书籍长度旁白的各种内容。
从 150 种语言中的 5,000 多种声音里进行选择,并可按声音质量等级和声音特征筛选。网站还提供声音样本,方便你在生成音频前预览选项。
上传 DOCX、PDF 或 SRT 文件,或将纯文本粘贴到编辑器中。FAQ 还说明平台可处理非常长的输入,因此适合较长脚本和文档。
在支持的情况下,可控制语速、音高、音量、停顿时长和情感风格。编辑器和 API 都提供这些设置,以实现更精确的语音输出。
添加背景音乐,在一个文件中使用多个说话人,并通过章节或切点标记将内容拆分为独立音频输出。这些工具支持更结构化的配音工作流。
使用 API 通过编程方式合成语音,并提供即时文本、长文本和字幕对齐输出端点。文档提供了 cURL、PHP、Python 和 JavaScript 示例。
将脚本、落地页文案或产品说明转化为可下载的旁白,无需为每次修改都聘请配音演员。
根据文本文档生成课程音频、培训模块和旁白课件,包括长篇内容和上传文件。
为电话系统和接待流程创建提示、公告或多语言呼叫处理音频。
使用语音、停顿和可选背景音乐,制作有旁白的展陈、导览或引导式音频体验。
通过用于短文本、长文本或字幕式合成的 API 端点,在应用、聊天机器人或内容流水线中自动创建语音。
SpeechGen 可直接在浏览器中根据粘贴的文本或上传的文件生成语音。来源提到支持纯文本、DOCX、PDF 和 SRT 输入,但最佳工作流程取决于内容类型。
网站说明该服务支持 150 多种语言和 5,000 多种声音。先选择语言,再选择声音并生成音频。
网页应用可导出 MP3、WAV、FLAC、OGG、Opus、M4A 以及多种 WAV 变体。API 文档也将 MP3、WAV、FLAC、OGG 和 Opus 列为输出格式。
定价页面显示其采用按需付费模式,无需订阅;首页还说明你可以免费开始使用 1,000 个字符,且无需账号。提供的来源中未展示具体套餐价格和限制。
可以。API 文档说明 API 访问需要付费账号,并且请求使用令牌和邮箱进行认证。