返回节点手册
音频生成
生成使用 MiniMax 语音模型将文本合成语音

功能说明
把文字转换成新的语音音频,适合旁白、产品讲解和原型配音。当前能力是文本转语音,不是音乐创作、语音识别或音频剪辑。
使用方法
把要朗读的文字接到 prompt,选择当前可用的模型、音色、情绪与文件格式后运行。标点和段落会影响节奏;先用短样本确认声线与读法,再生成长内容。不要在文档里依赖完整音色列表,因为可用项会随能力更新。
案例
例如,文本节点提供旁白稿,Audio Generation 的 output 进入预览节点进行试听。
搭配与上下游
上游通常是 文本 或经过审阅的 文本生成 结果;下游可接 预览。已有音频文件应使用 音频输入。
常见问题
输出语音读错专有名词时,先在 prompt 中调整拼写、停顿和标点,而不是反复切换模型。生成内容仍需检查发音、版权和可用场景。