All models

s1

Fish AudioAudio
110.28 Credits
Get your API key
s1

让长篇文稿保持稳定、清晰的声音表达

Fish Audio S1 是面向文本转语音的模型,适合课程、章节朗读与持续更新的解说内容。平台指南将它定位为偏重稳定性的选择,尤其适合先把长文读顺、再调整音色与节奏的制作流程。指定 model: s1 后,可复用已有声音或使用参考录音合成语音,并通过音频链接交付结果。

Fish Audio模型品牌
文本转语音模型类型
声音克隆任务能力

规格与接口特性

在选型前明确型号、输入输出与调用方式。

模型选择
HTTP 请求头 model: s1
平台接口
POST /fish/tts;text 为必填输入
音频交付
同步返回 audio_url;支持 callback_url 异步回调
输出格式
mp3、wav、pcm;wav 与 pcm 均返回 WAV 容器
声音参考
reference_id 或单个 references 样本,二者互斥
韵律控制
prosody.speed 控制语速,prosody.volume 控制音量增益

能力描述结合公开模型资料与本平台文档;实际参数、输出和计费规则以对应 API 和定价栏目为准。

核心能力

了解 s1 适合解决的声音任务。

以稳定朗读为起点

课程和长文配音需要持续保持语句关系与声线。平台指南建议在更关注长文本稳定性的任务中比较 S1;制作时仍应按章节拆分、校听专有名词和数字,避免把型号定位当作每次输出都无误的保证。

固定声音,持续更新内容

通过 reference_id 复用保存的声音,让同一系列的开场、正文和补充内容沿用统一声线。音色引用与模型型号分别设置,适合有固定播音员或品牌声音的内容项目。

把语音放进编辑流程

可选择 MP3 交付,或使用 WAV 容器进入混音与剪辑流程。prosody 控制语速和音量,便于先生成短样、确定节奏,再按相同设置安排后续章节。

适用场景

从具体内容和交付方式出发选择。

课程与知识讲解

把教学稿按主题拆成段落,预先处理缩写、公式和专业名称。使用相同声音与语速生成各节内容,校听后配合字幕和画面完成课程制作。

有声章节与长篇解说

以章节为单位保存文稿、模型和音色信息。发现发音或停顿问题时,仅重做需要修订的段落,减少整篇返工并保持编辑节奏。

持续维护的应用提示

将产品教程、操作说明和帮助文案转换为统一声线。对新增或修改的文本保留版本记录,方便在产品更新后重新制作对应提示。

如何选择这个模型

结合文稿、音色与制作成本进行比较。

优先比较稳定朗读

如果任务更关注章节连贯与可重复编辑,可以从 S1 开始试听。表达性较强的短内容可同时比较 S2 Pro;升级型号并不代替对实际文稿的评估。

明确选择,保留版本

平台默认型号为 s2-pro,使用 S1 必须设置 model 请求头。保存型号、音色、格式和文稿版本,有助于复现一批内容的制作设置。

开始使用

先试听,再扩展到正式内容。

准备文稿与声音

明确朗读目的,校对文稿,选择保存音色或准备参考录音与逐字稿。

生成短样并校听

显式指定 s1,用代表性段落确认发音、节奏和输出格式。

接入制作工作流

保存设置和任务编号,在完成后取得音频链接,再安排播放、剪辑或内容交付。

使用边界

了解合成方式与交付范围。

  • 此入口用于文本转语音,不等同于语音识别、音乐生成或原生实时音频流。长篇内容应分段制作并安排校听,检查数字、缩写与专有名词。
  • 一次性克隆仅接受一个公开 HTTPS MP3/WAV 录音样本及其准确逐字稿,不接受 Base64、data URI 或带凭据的 URL;不会自动保存长期音色。
  • format=pcm 返回 WAV 容器,不能直接作为裸 PCM 字节处理;opus 不受支持。生成参数的支持范围和实际计费请查看本平台 API 文档与定价。

常见问题

解答使用 s1 时的常见疑问。

为什么选择 S1?

平台指南将 S1 推荐为偏重长文本稳定性的选择,适合先关注清晰朗读的内容。实际表现与文稿、声音参考和生成设置相关,应先用代表性段落试听。

型号应该写在哪里?

通过 HTTP 请求头 model 指定 s1。不指定时默认 s2-pro;音色 reference_id 属于声音选择,与合成型号分别设置。

保存声音与一次性克隆怎么选?

固定角色或系列内容可用 reference_id 复用声音;单次项目可以用 references 提供录音与逐字稿。两者互斥,一次性克隆只接受一个参考样本。

怎样控制语速和输出格式?

prosody.speed=1.0 表示原速,volume 使用 dB,0 表示不改变音量。可选择 mp3、wav 或 pcm;后两者都使用 WAV 容器,MP3 码率可选 64、128 或 192。

长稿怎样跟踪完成结果?

设置 callback_url 后先保存 task_id 和 started_at,等待完成回调,也可按任务编号查询。取得 audio_url 才表示可以进入播放或编辑环节。

模型资料 · 更新日期:2026-10-01。调用参数与计费规则请查看 API 和定价栏目。

把 s1 用到你的下一项配音任务

从代表性文稿开始,在试听与实际交付中判断它是否适合。