CastReader
clone-v1短篇预生成多语言音频与授权声音克隆。保存 MP3/WAV,可恢复的排队任务。
开通、限制与来源
当前验证身份后自助开通,无需人工审批;3,000 个试用字符。每账号一次,保留有效期与每日限制。
当前配置:en、zh、de、ja、fr、es、ko、pt、ru、it;排队任务 500 字符,并发 1。无流式、实时、情绪参数或延迟 SLA。
TTS API SELECTION · PRIMARY SOURCES
六家服务,不同的计价单位、限制与工作流程。先核对需求,再计算真实文本成本,最后用音频验证效果。
由 CastReader 整理。竞品资料核查日期: · 官方文档对照,不是独立音频横评。
使用授权克隆声音预生成学习短句、产品引导或短篇旁白。当前部署:10 种语言,每任务 500 字符,并发 1。
如果必须支持流式对话、原生多角色编排、情绪控制或约定延迟 SLA,不要只因价格选择当前 CastReader 服务。我们目前不提供这些能力。
价格为美元公开标价,不是报价承诺。试用、税费、折扣、最低充值与账户条款可能改变实付金额。未确认不等于不支持。
短篇预生成多语言音频与授权声音克隆。保存 MP3/WAV,可恢复的排队任务。
当前验证身份后自助开通,无需人工审批;3,000 个试用字符。每账号一次,保留有效期与每日限制。
当前配置:en、zh、de、ja、fr、es、ko、pt、ru、it;排队任务 500 字符,并发 1。无流式、实时、情绪参数或延迟 SLA。
需要更快交付、更多语言或更长单次输入时的候选。
已有按量付费;另行核对免费、初创优惠与账户条款。
官方 Flash/Turbo 列出 32 种语言、40,000 字符输入上限。v2/v3 价格与能力不同,不应混为同一模型评测。
官方 Python/TypeScript 客户端,声音克隆、REST 与 WebSocket 流式。
按量付费。官方还列出 $0 的 s2.1-pro-free;选择付费前先核对免费模型的准入与限制。
字节不等于字符。价格表列出入门并发 5;免费模型具体限制与生产条款需另行确认。
可纳入语音服务选型;使用自己的工作负载评估具体音色与语言。
按量付费与 Growth 档单价不同;免费额度和其他模型另计。
Aura-1 另列 $15/百万字符;Flux 使用独立价格与优惠。本行不混用模型,也不证明克隆能力等价。
音色或克隆流程适配时可评估;比较套餐利用率,不只比较标价。
流式语音与表达指令;已有 OpenAI 接入的应用可以纳入候选。
API 准入与限流依账户而定;自定义声音有单独的准入和授权流程。
模型页标注最多 2,000 输入 tokens。仅凭字符数无法知道输出音频 tokens,不给出固定的每百万字符换算。
SAME TEXT · DIFFERENT METERS
只在浏览器中计算,不上传文本,不生成音频。
输入 1–1,000,000 的整数。这是分次生成相同文本,不是一次超长请求。
统一使用显式预处理后的文本估算:CRLF 转 LF、NFC 规范化、去除首尾空白;保留内部空格和标点。
这是付费单价示例,不是“最低价”结论。Fish 另列 $0 的 s2.1-pro-free,需核对准入与限制。未计入免费额度、订阅、折扣、税费及最低充值。
ElevenLabs/Deepgram 估算假设每个 Unicode 字符计为一个计费字符,精确口径以其规定为准。Credits 与输出音频 tokens 需要各自用量数据,不强行换算。这不代表音质或速度等价。
安装已发布的准确客户端版本,检查鉴权和就绪音色,提交前保存请求与幂等键。超时不意味着可以直接再建一个收费任务。
运行接入检查 →扩展第一方测试记录 30 次尝试、29 条输出与 1 条失败。它不是竞品模型横评,也不是母语者结论。核对原始参考、生成音频、文本与实际用量。
查看真实报告 →total_cost = successful_audio_usage
+ deliberate_regenerations
+ subscription_or_unused_minimums
+ app_hosting_storage_and_delivery
+ integration_and_recovery_work
// Measure complete-job time separately from first-audio time.
// Do not infer output audio tokens from text character count.