AI & Voice

文件附件功能上线:将任何文档、图片、音频或视频转化为语音

March 4, 2026 ·5 分钟阅读
文件附件功能上线:将任何文档、图片、音频或视频转化为语音

我们很高兴地宣布 simpleTTS Studio 推出了一项强大的新功能——AI 内容生成的文件附件功能。您现在可以在输入文本提示的同时直接上传文件,让我们的 AI 进行多模态处理后再将输出转换为语音。

新功能介绍

Studio 中的 AI 提示输入现在新增了一个附件按钮(回形针图标),可让您上传文件供 AI 分析。搭配文本提示来精确告诉 AI 您想要什么——或者切换到摘要模式,让 AI 自动精简文件内容。

支持的文件类型

  • 文档 — PDF、TXT(最大 20 MB / 1 MB)
  • 图片 — PNG、JPEG、WEBP、HEIC、HEIF(最大 7 MB)
  • 音频 — MP3、WAV、M4A、OGG、FLAC、AAC(最大 25 MB)
  • 视频 — MP4、WEBM、MOV、MPEG、3GPP(最大 25 MB)

工作原理

  1. 附加文件 — 点击 AI 提示栏中的回形针图标,选择您的文件。
  2. 编写提示 — 告诉 AI 如何处理文件(例如“提取这份 PDF 的要点”或“描述这段视频中发生了什么”)。
  3. 或者直接摘要 — 切换摘要按钮,无需输入提示即可提交。AI 将自动为您的文件生成简洁的摘要。
  4. 生成语音 — AI 输出的内容将出现在您的文本编辑器中,随时可用任何声音转换为语音。

文件会被安全上传到临时存储,经 AI 处理后自动清除——不会保留任何数据。

使用场景

  • 讲座笔记转音频 — 上传录制的讲座(MP3/WAV),输入提示“根据这段讲座创建学习指南”,然后将其转换为语音,方便随时随地复习。
  • PDF 摘要 — 导入研究论文或报告,点击摘要,将关键要点转化为播客风格的音频片段。
  • 图片描述 — 上传照片或信息图表,让 AI 详细描述——非常适合无障碍内容制作。
  • 视频回顾 — 附加一段短视频,输入提示“编写一段总结这个视频的脚本”,即可创建配音就绪的脚本。
  • 文档翻译工作流 — 上传文档,输入提示“将要点翻译成西班牙语”,然后使用西班牙语声音生成语音。

智能 UI 行为

  • 当附加文件时,模板字数控制会自动禁用,因为内容由文件驱动。
  • 摘要模式下,您只需上传文件即可提交——无需文本提示。
  • 生成模式下,始终需要文本提示,以便 AI 知道如何处理您的文件。
  • 文本区域下方会出现一个文件标签,显示附加的文件名和快速移除按钮。
  • 成功生成后,附件会自动清除,方便您重新开始。

可用性

文件附件功能面向所有注册用户开放,适用于 Studio 中的AI 生成语音克隆应用。

准备好试试了吗?前往Studio,开始将您的文件转化为语音。

相关文章