G v1 发布:自然AI语音合成与多角色对话功能

我们非常高兴地在 simpleTTS.ai Studio 中推出 G v1 —— 一款全新的文本转语音引擎,也是我们全新的AI驱动语音引擎。G v1 带来了一种全然不同的语音合成方式:它不仅仅是朗读文字,而是理解上下文、情感和意图,从而生成听起来真正自然的语音。
它与我们现有的 AZ v1 引擎并行运行,让您可以自由选择最适合每个项目的工具。只需一键即可在不同引擎之间切换。
为什么选择 G v1?
传统的TTS引擎使用预定义的语音模式将文本转换为音频。G v1 则不同 —— 它基于大语言模型构建,不仅知道说什么,还知道怎么说。最终呈现的是具有自然节奏、恰当重音和情感细腻度的语音,能够根据您的内容自适应调整。
G v1 支持跨24种语言的30个预置音色,具备增强的表现力、上下文感知的节奏控制,以及原生多角色对话功能 —— 所有这些都可以通过自然语言提示来控制,无需复杂的配置。
核心功能
30种富有表现力的音色
从30种独特的音色中选择,每种都有独特的个性和风格。从 Kore 的坚定沉稳到 Puck 的活力四射,从 Achernar 的柔和细腻到 Sulafat 的温暖亲切 —— 总有一种音色适合您的需求。按性别和风格浏览音色,按名称搜索,并收藏常用音色以便快速使用。
单人朗读模式
非常适合旁白、公告和简单的内容朗读。选择一种音色,粘贴您的文本,然后生成即可。模型会根据内容自动处理节奏和语调 —— 遇到激动的内容会加速,需要强调时则放慢节奏。
多角色对话模式
这是 G v1 真正大放异彩的地方。为不同的角色分配不同的音色,一次性生成自然流畅的对话 —— 无需拼接单独的音频片段。模型在整个对话中保持一致的角色音色,并自然地处理对话轮换。
只需用角色标签格式化您的文本:
- Speaker 1: 欢迎收听今天的节目!
- Speaker 2: 感谢邀请。让我们开始吧。
- Speaker 1: 请给我们介绍一下您最新的项目……
每位角色都由您指定的音色配音,模型会生成一个具有自然对话流程的完整音频文件。
语音指令
使用自然语言控制语音效果。无需调节滑块和参数,只需描述您想要的效果:
- "用温暖、对话式的语气朗读"
- "用充满热情和活力的方式朗读"
- "像新闻主播一样播报"
不确定写什么?点击AI生成按钮,系统会根据您的内容自动推荐语音指令。
使用方法
- 切换到 G v1 —— 在右侧面板的引擎切换按钮中(AZ v1 旁边)点击 G v1 按钮。
- 选择模式 —— 选择「单人朗读」用于旁白,或选择「多角色对话」用于对话场景。
- 选择音色 —— 浏览音色面板,按名称或风格搜索,选择最适合您内容的音色。在多角色模式下,为每位角色选择不同的音色。
- 添加语音指令(可选)—— 描述您想要的语气、节奏或风格。
- 生成 —— 点击生成按钮,几秒钟内即可获得您的音频。
您可以创建什么
- 播客和访谈节目 —— 使用多角色模式生成主持人与嘉宾的对话,音色独特且始终一致。
- 有声书和故事 —— 以自然的节奏和情感表达朗读长篇内容,根据材料自适应调整。
- 在线教育和教程 —— 创建引人入胜的教学音频,语速清晰、节奏适当。
- 营销和广告 —— 生成专业的配音,精确匹配您需要的语气和感染力。
- 无障碍内容 —— 将文字内容转换为自然流畅的音频,服务视障用户。
定价
G v1 使用您现有的积分余额,费率为每字符2积分。免费账户每月包含10,000积分供您上手体验。您的积分可在两个引擎之间通用,因此您可以根据每个项目的需求灵活搭配使用。
G v1 与 AZ v1:如何选择
两个引擎均完全可用。以下是快速选择指南:
- 选择 G v1 —— 当您需要自然的对话效果、富有表现力的旁白,或通过自然语言指令进行精细的语气控制时。
- 选择 AZ v1 —— 当您需要500+音色、SSML级别的控制,或覆盖70+种语言时。
立即开始
G v1 现已向所有注册用户开放。前往 simpleTTS.ai Studio,切换到 G v1,亲自感受不同。您现有的积分可直接使用 —— 无需额外设置。
我们迫不及待想听到您的创作。


