import_actor
Create a reusable voice actor from a supplied recording, so later text-to-speech lines keep that voice even when audio comes from human recordings or other TTS.
Instructions
用一段现成的录音铸声 —— 声音是别处做的(真人录音 / 其它 TTS)也照样能保持一致。
和 create_actor 得到的东西完全一样, 只是参考音由你提供而不是我们生成。之后 actor_tts 让他说任意台词, 音色都来自这段录音。
参数: name: 角色名, 之后 actor_tts 用它指代 audio_path: 录音的本机路径。16-bit PCM WAV, 2~30 秒, 单人清唱式的干净人声 最好(没有背景音乐和混响)。采样率/声道数会自动转成 24 kHz 单声道。 其它格式先转: ffmpeg -i 原文件 -acodec pcm_s16le -ac 1 -ar 24000 ref.wav transcript: 那段录音里念的是什么。不给就自动听写一遍填上, 但那是机器听的, 会在返回里标出来让你核 —— 克隆模型拿它对齐音频和文字, 错一个词 音色就会明显不对。手上有准确的文字就直接给, 别让它猜。 force: 覆盖已有角色
注意: 你有权使用这段声音才导入它。克隆一个真人的嗓子在很多地方是需要本人同意的。
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| name | Yes | ||
| force | No | ||
| audio_path | Yes | ||
| transcript | No |
Output Schema
| Name | Required | Description | Default |
|---|---|---|---|
| ok | Yes | ||
| kind | No | actor | |
| name | No | ||
| seed | No | ||
| error | No | ||
| voice | No | ||
| warnings | No | ||
| truncated | No | ||
| error_code | No | ||
| transcript | No | ||
| ref_seconds | No | ||
| imported_from | No | ||
| source_format | No | ||
| reference_path | No |