返回节点手册

音频生成

生成

使用 MiniMax 语音模型将文本合成语音

音频生成

功能说明

把文字转换成新的语音音频,适合旁白、产品讲解和原型配音。当前能力是文本转语音,不是音乐创作、语音识别或音频剪辑。

使用方法

把要朗读的文字接到 prompt,选择当前可用的模型、音色、情绪与文件格式后运行。标点和段落会影响节奏;先用短样本确认声线与读法,再生成长内容。不要在文档里依赖完整音色列表,因为可用项会随能力更新。

案例

例如,文本节点提供旁白稿,Audio Generation 的 output 进入预览节点进行试听。

搭配与上下游

上游通常是 文本 或经过审阅的 文本生成 结果;下游可接 预览。已有音频文件应使用 音频输入

常见问题

输出语音读错专有名词时,先在 prompt 中调整拼写、停顿和标点,而不是反复切换模型。生成内容仍需检查发音、版权和可用场景。