中文 ▾
用于 TTS 流水线的无审查文本 APIhttps://api.ttsapihub.com/v1

ElevenLabs API 检查清单:生产级 TTS 流水线指南

本检查清单涵盖了 ElevenLabs API 的关键集成步骤,确保你的文本转语音流水线能处理流式输出、上下文限制和速率限制,避免在生产环境中出错。我们还指出了无审查文本 API 在何处可替换标准 LLM,以消除对话生成中的创作审查。

更新于

关键点

  • 构建你的 ElevenLabs 集成以处理流式音频块,实现低延迟的用户体验。
  • 在文本生成层使用函数调用,输出结构化的 JSON,以实现一致的语音选择和元数据。
  • 严格监控请求速率限制,避免在高吞吐量叙述任务期间出现 429 错误。
  • 将上下文窗口保持在安全范围内,以防止长篇音频脚本中的 token 截断。

为什么文本质量决定 TTS 质量

任何 TTS 流水线的输出质量取决于输入文本。如果你的 LLM 生成生硬的措辞、不一致的标点或意外的中断,ElevenLabs API 将按原样将这些错误语音化。这就是为什么文本生成步骤通常是架构中最关键的部分。

标准模型通常会应用企业安全过滤器,为避免争议话题,它们会在对话中途截断句子或改变语气。对于创意写作、游戏或成人内容管道,这些中断会破坏沉浸感。无审查 LLM 确保你的脚本按你预期的方式原样传输到 TTS 引擎,保留细微差别和流畅度。

  • 检查长文本中角色声音的一致性。
  • 确保标点符号符合预期的说话节奏。
  • 验证安全过滤器是否未重写关键对话。

如果你的文本流水线使用标准模型,当话题跨越隐藏阈值时,你可能会看到语气突然变化。切换到专为创作自由调优的模型可消除此变量。

用于创作自由的无审查脚本

在为故事讲述、有声书或互动小说构建应用程序时,你需要一个不会根据任意准则拒绝内容的文本引擎。我们的 API 提供针对合法成人用途、安全研究和创意小说优化的无审查 LLM。

该模型标识为 uncensored,运行于我们自有的 GPU 服务器上,不会使用您的提示词进行训练。它支持通过 SSE 进行流式输出,使您能够几乎立即开始生成音频文本块。

我们按每 1M 输入 token 收取 $0.25,每 1M 输出 token 收取 $1.00。没有月费,预付额度永不失效。这种按量付费模型可与任何 OpenAI 兼容客户端无缝集成,包括标准的 ElevenLabs 文本输入。

  • 支持用于结构化输出的工具/函数调用。
  • 100,000 token 上下文窗口,适用于长篇叙事。
  • 标准成人或争议性主题无内容拒绝。

流式文本到 ElevenLabs API

低延迟对于实时 TTS 应用至关重要。虽然 ElevenLabs 支持流式音频,但文本生成层也必须进行流式传输以最小化首字节时间。使用标准的 OpenAI 兼容接口POST /v1/chat/completions并设置stream: true。

实时接收文本块,并直接将其馈送到 ElevenLabs 流式音频接口。这创建了一个连续流水线,音频在生成整个脚本之前即可播放。

我们的 API 支持 SSE(服务器发送事件),使你可以轻松将文本直接导入音频引擎。确保你的客户端优雅地处理部分句子,以避免音频故障。

  • 在 LLM 客户端中启用流式输出。
  • 音频块到达时进行缓冲。
  • 通过仅重试缺失的片段来处理网络中断。

处理长篇叙事的上下文窗口

用于文本生成的tts api必须能够处理长上下文窗口,如果你正在制作有声书或长篇文章。我们的模型支持 100,000 token,这大约涵盖 40-50 页文本。

如果你的叙事超过此限制,你必须实施分块策略。将文本拆分为逻辑段,通过 API 处理每一段,然后连接结果。注意不要在块之间丢失叙事连贯性。

密切监控你的 token 使用情况。输入 token 比输出 token 便宜,但长提示词仍会累积。在发送大文本之前预计算 token 数量,以避免意外成本。

  • 按章节或场景拆分文本。
  • 传递系统提示词以保持声音一致性。
  • 缓存已完成的片段以避免重新处理。

用于结构化对话的工具调用

对于复杂应用,你需要的不仅仅是纯文本。使用函数调用生成包含语音 ID、情感标签和元数据的结构化 JSON。这确保你的ElevenLabs API调用一致且可预测。

定义包含voice_id、stability和similarity_boost字段的模式。LLM 输出此 JSON,你的后端解析并发送给 ElevenLabs。这减少了手动配置并防止错误。

我们的 API 原生支持函数调用。在tools参数中定义你的工具,让模型决定何时使用它们。这对于动态角色或多说话者对话非常理想。

  • 定义语音参数的 JSON 模式。
  • 在调用 TTS API 之前解析 LLM 输出。
  • 如果 LLM 遗漏字段,请优雅地处理错误。

隐私:不对你的脚本进行训练

对于专业内容创作者,隐私至关重要。我们的 API 确保你的提示词不用于训练。注册时,你只需提供邮箱和密码,你的数据保持安全。

与一些免费层级不同,我们不使用你的文本来改进模型。这对于专有故事、商业脚本或个人数据至关重要。你的创作作品仍归你所有。

我们还强制执行严格的内容限制:不涉及未成年人的性内容。这是对你合法内容的唯一限制。其他所有内容都是你的管道可以使用的。

  • 不对你的提示词进行训练。
  • 最小化的注册要求。
  • 清晰的内容边界。

限制你的 TTS API 请求

速率限制不仅仅是出于礼貌;它们是稳定生产的必要条件。我们的 API 允许每个密钥每分钟 300 个请求。如果超过此限制,你将收到 429 错误。

在客户端实现指数退避以高效处理重试。如果可能,避免通过并发请求频繁调用接口。使用队列来管理高负载任务。

监控使用仪表板以跟踪消耗量。如果需要更高的限制,请考虑重新生成 API 密钥,这将使旧密钥失效并重置速率限制计数器。这对于突发流量很有用。

  • 将请求限制设置为每分钟最多 300 次。
  • 使用指数退避进行重试。
  • 如需重置限制,请重新生成密钥。

高负载 TTS 的成本优化

成本控制对于扩展至关重要。我们的 API 按每 1M 输入 token 收取 $0.25,按每 1M 输出 token 收取 $1.00。这对于无审查模型来说具有竞争力,但成本可能会迅速增加。

通过删除不必要的空白和上下文来优化提示词。使用函数调用减少往返次数。预计算 token 数量以保持在预算内。

我们提供带有奖金的预付额度。充值 $50 可获得 5% 的奖金,或充值 $100 获得 10% 的奖金。这显著降低了你每个 token 的有效成本。

  • 每日监控 token 使用情况。
  • 使用预付额度获取折扣。
  • 优化提示词长度。

问答

无审查模型的上下文窗口是多少?

该模型支持 100,000 token 的上下文窗口,包括提示词和补全 token。这允许长达约 50 页文本的长篇幅叙事。

你们会使用我的提示词进行训练吗?

不是。你的提示词不用于训练。我们只需要电子邮件和密码进行注册,你的数据保持私密。

哪些内容会被屏蔽?

我们对涉及未成年人的色情内容执行硬性限制。所有其他合法的成人、虚构或争议性主题均允许,不会拒绝。

我如何开始试用?

使用邮箱和密码注册以获取 $0.50 的免费试用额度,有效期为 7 天。开始时无需信用卡。

只差一张表单,即可获得密钥

创建账户,复制密钥,更改 Base URL。这就是全部设置。

获取 API 密钥