AI & Voice

G v1 发布:自然AI语音合成与多角色对话功能

April 1, 2026 ·6 分钟阅读
G v1 发布:自然AI语音合成与多角色对话功能

我们非常高兴地在 simpleTTS.ai Studio 中推出 G v1 —— 一款全新的文本转语音引擎,也是我们全新的AI驱动语音引擎。G v1 带来了一种全然不同的语音合成方式:它不仅仅是朗读文字,而是理解上下文、情感和意图,从而生成听起来真正自然的语音。

它与我们现有的 AZ v1 引擎并行运行,让您可以自由选择最适合每个项目的工具。只需一键即可在不同引擎之间切换。

为什么选择 G v1?

传统的TTS引擎使用预定义的语音模式将文本转换为音频。G v1 则不同 —— 它基于大语言模型构建,不仅知道说什么,还知道怎么说。最终呈现的是具有自然节奏、恰当重音和情感细腻度的语音,能够根据您的内容自适应调整。

G v1 支持跨24种语言的30个预置音色,具备增强的表现力、上下文感知的节奏控制,以及原生多角色对话功能 —— 所有这些都可以通过自然语言提示来控制,无需复杂的配置。

核心功能

30种富有表现力的音色

从30种独特的音色中选择,每种都有独特的个性和风格。从 Kore 的坚定沉稳到 Puck 的活力四射,从 Achernar 的柔和细腻到 Sulafat 的温暖亲切 —— 总有一种音色适合您的需求。按性别和风格浏览音色,按名称搜索,并收藏常用音色以便快速使用。

单人朗读模式

非常适合旁白、公告和简单的内容朗读。选择一种音色,粘贴您的文本,然后生成即可。模型会根据内容自动处理节奏和语调 —— 遇到激动的内容会加速,需要强调时则放慢节奏。

多角色对话模式

这是 G v1 真正大放异彩的地方。为不同的角色分配不同的音色,一次性生成自然流畅的对话 —— 无需拼接单独的音频片段。模型在整个对话中保持一致的角色音色,并自然地处理对话轮换。

只需用角色标签格式化您的文本:

  • Speaker 1: 欢迎收听今天的节目!
  • Speaker 2: 感谢邀请。让我们开始吧。
  • Speaker 1: 请给我们介绍一下您最新的项目……

每位角色都由您指定的音色配音,模型会生成一个具有自然对话流程的完整音频文件。

语音指令

使用自然语言控制语音效果。无需调节滑块和参数,只需描述您想要的效果:

  • "用温暖、对话式的语气朗读"
  • "用充满热情和活力的方式朗读"
  • "像新闻主播一样播报"

不确定写什么?点击AI生成按钮,系统会根据您的内容自动推荐语音指令。

使用方法

  1. 切换到 G v1 —— 在右侧面板的引擎切换按钮中(AZ v1 旁边)点击 G v1 按钮。
  2. 选择模式 —— 选择「单人朗读」用于旁白,或选择「多角色对话」用于对话场景。
  3. 选择音色 —— 浏览音色面板,按名称或风格搜索,选择最适合您内容的音色。在多角色模式下,为每位角色选择不同的音色。
  4. 添加语音指令(可选)—— 描述您想要的语气、节奏或风格。
  5. 生成 —— 点击生成按钮,几秒钟内即可获得您的音频。

您可以创建什么

  • 播客和访谈节目 —— 使用多角色模式生成主持人与嘉宾的对话,音色独特且始终一致。
  • 有声书和故事 —— 以自然的节奏和情感表达朗读长篇内容,根据材料自适应调整。
  • 在线教育和教程 —— 创建引人入胜的教学音频,语速清晰、节奏适当。
  • 营销和广告 —— 生成专业的配音,精确匹配您需要的语气和感染力。
  • 无障碍内容 —— 将文字内容转换为自然流畅的音频,服务视障用户。

定价

G v1 使用您现有的积分余额,费率为每字符2积分。免费账户每月包含10,000积分供您上手体验。您的积分可在两个引擎之间通用,因此您可以根据每个项目的需求灵活搭配使用。

G v1 与 AZ v1:如何选择

两个引擎均完全可用。以下是快速选择指南:

  • 选择 G v1 —— 当您需要自然的对话效果、富有表现力的旁白,或通过自然语言指令进行精细的语气控制时。
  • 选择 AZ v1 —— 当您需要500+音色、SSML级别的控制,或覆盖70+种语言时。

立即开始

G v1 现已向所有注册用户开放。前往 simpleTTS.ai Studio,切换到 G v1,亲自感受不同。您现有的积分可直接使用 —— 无需额外设置。

我们迫不及待想听到您的创作。

相关文章