了解 Voice Design 能生成什么
Voice Design 是 Noiz AI 的生成式音色创作工具。不是从预设库里挑,而是用自然语言描述你想要的音色——性别、年龄、语气、口音、语速、人设——模型从零打造出来。
入口在左侧边栏 Playground → Voice Design,和 Voice Library、Voice Clone 并列。
常见用法:
有声书或游戏里虚构角色的独特音色
内容用的一致品牌配音人设
为受众量身定制的旁白音色——沉稳、权威、亲和
在做 Voice Clone 之前先原型多种声音风格
每次生成会给出三个变体供你试听,再选一个保存到音色库。
写好音色描述
从侧边栏打开 Voice Design。在文字输入区描述你要生成的音色。
在语气、性别、年龄、口音、语速和人设上尽量具体。细节越多,结果越贴近你想要的。最多可以写 1000 个字符。
也可以在文字描述旁边上传一张角色图片。模型会从图片里读视觉线索——年龄、表情、风格——用来引导音色人设。
Follow Prompt 滑块(0–100)控制模型贴合描述的程度。数值越高越严格执行。先从 50 开始,感觉不对再调。
不知道从哪起步?用灵感模板——Wise Elder、Sci-Fi AI、News Anchor、Dark Hero——一键填入一个不错的起点,再改成贴合你项目的版本。
从三个变体里挑一个
点 Generate Voice。Noiz AI 会基于你的描述生成三个不同的音色,分别标为 Voice 1、Voice 2、Voice 3。
每一个都试听一下。找到贴合的那个,选中后点 Select 进入保存页面。
如果三个都不合适,调整描述——加更具体的细节、调 Follow Prompt 滑块、换一个模板——再生成一次。
命名并保存音色
保存页面里,给音色起个名字(必填)。可以选填语言、性别和年龄段,方便以后筛选查找。
加一个 Label 在音色库里做标签,用 Description 记录这个音色是为什么设计的。都填好后点 Save。
Description 字段特别有用——如果你以后想回来用,这就是给自己的一个提醒,说明这个音色当初是为什么设计的。
在 Text-to-Speech 里使用生成的音色
保存后,新音色就进入了你的个人 Voice Library,可以在 Text-to-Speech、Studio 或 API 里选用。
点 Use this voice 直接跳到 Text-to-Speech,音色预选好;或者 Design another voice 继续做下一个。
在 Text-to-Speech 里,粘上脚本,从 Voice Library 下拉里选你保存的音色。它会出现在 My Voices 分组下。
在做更多变体之前,先在 Text-to-Speech 里跑一句测试——你就能听到这个人设在真实语境里落不落地。
写出更好的音色提示词
描述人物,别写参数。 别写"低沉的男声",试试"经验丰富的纪录片旁白,40 多岁末段,沉稳权威,带一点南方口音的温度"。人物式描述生成的音色更丰富。
提到节奏和能量。 "从容"、"清脆"、"对话感"、"利落"这类词给模型的是表达上的方向——不只是声音听起来什么样,而是它怎么说话。
指明口音和语言。 要英式 RP、通用美式还是澳大利亚口音,就直说。模糊描述通常默认走美式英语。
图片加文字组合。 视觉线索能进一步收敛结果时,就把角色肖像和文字一起上传。
多生成几次。 每次描述里的一点措辞调整都能带出明显不同的结果。把每次尝试当作草稿。
用好 Follow Prompt 滑块。 50 时模型在创造性和准确度之间平衡。想让它严格执行描述的每个细节,就推到 80–100。