跳转到主要内容
POST
Fish Audio 音频复刻
Fish Audio API 用于创建语音模型(声音克隆)。

请求头

Content-Type
string
必填
枚举值: application/json
Authorization
string
必填
Bearer 身份验证格式: Bearer {{API 密钥}}。

请求体

type
enum<string>
必填
模型类型,tts 代表文本转语音。可选值: tts允许的值: "tts"
title
string
必填
模型标题或名称。
train_mode
enum<string>
必填
模型训练模式,对于 TTS 模型,fast 表示模型在创建后立即可用。可选值: fast允许的值: "fast"
voices
file[]
必填
上传用于调优模型的语音文件。
visibility
enum<string>
默认值:"public"
模型可见性,public 将显示在发现页面,unlist 允许任何拥有链接的人访问,private 仅对创建者可见。可选值: public, unlist, private
description
string | null
模型描述。
cover_image
file | null
模型封面图片,如果模型为 public,则此项为必填。
texts
string[]
与语音对应的文本,如果未指定,将对语音执行 ASR(自动语音识别)。
tags
string[]
模型标签。
enhance_audio_quality
boolean
默认值:false
增强音频质量。

响应信息

_id
string
必填
已创建模型的唯一标识符。
type
enum<string>
必填
模型类型。可选值: svc, tts
title
string
必填
模型标题或名称。
description
string
必填
模型描述。
cover_image
string
必填
模型封面图片的 URL。
state
enum<string>
必填
模型的当前状态。可选值: created, training, trained, failed
tags
string[]
必填
模型标签。
created_at
string<date-time>
必填
模型创建时的时间戳。
updated_at
string<date-time>
必填
模型最后更新时的时间戳。
visibility
enum<string>
必填
模型可见性设置。可选值: public, unlist, private
like_count
integer
必填
模型收到的点赞数。
mark_count
integer
必填
模型收到的收藏/书签数。
shared_count
integer
必填
模型被分享的次数。
task_count
integer
必填
与模型关联的任务数量。
author
AuthorEntity · object
必填
模型作者的信息。
train_mode
enum<string>
默认值:"full"
模型使用的训练模式。可选值: fast, full
samples
SampleEntity · object[]
与模型关联的样本数据。
languages
string[]
模型支持的语言。
lock_visibility
boolean
默认值:false
可见性设置是否被锁定。
unliked
boolean
默认值:false
当前用户是否已取消点赞该模型。
liked
boolean
默认值:false
当前用户是否已点赞该模型。
marked
boolean
默认值:false
当前用户是否已收藏/书签该模型。