语音工作室
用一段录音克隆一个声音,或者用一段描述设计一个。
语音工作室是你做出预置列表里没有的声音的地方。有两条路进来——从一小段音频样本 克隆 一个声音,或者从一段文字描述 设计 一个——两条路的终点是一样的:一个可以反复使用的声音,存进你的 我的声音 库里,你可以把它安到任何角色身上。
打开语音工作室
去 聊天设置 → 语音与输入 → 语音工作室,点 打开语音工作室(那个魔杖图标)。你的声音库是按账号来的,所以从任何一段聊天里看过去都是一样的。
进去之后你会看到你的语音克隆点数余额、两个创建动作——克隆声音 和 设计声音——以及 我的声音。
在群聊里工作室是只读的。 你可以打开它、创建声音,但 使用 这个动作不会 把声音指派出去。给群聊成员指派声音,请改用 聊天设置 → 语音与输入 → 语音 下面那些按成员排的行。
从样本克隆
打开 克隆声音 并给它起名
名字是必填的,最长 60 个字符。
挑一个提供方
MiMo —— 限时免费。MiniMax —— 从你的语音克隆余额里扣 1 次。
给出一个样本
录音 用你的麦克风录一段;上传 接受一个音频文件。目标是 10–30 秒清晰的说话声。
创建这个克隆
点 创建克隆。声音在同一个请求里就做好了——没有队列要等。
样本必须满足什么
| 规则 | 取值 |
|---|---|
| 最短长度 | 5 秒,录音和上传都强制 |
| 推荐长度 | 10–30 秒 |
| 浏览器内录音上限 | 60 秒 —— 到点录音自己停 |
| 文件大小 | 无限制 |
| 格式 | 浏览器能读的都行;上传前一律转成 WAV |
| 人声检查 | 只对录音做 |
一段大部分是静音的录音会被拒绝,提示「没有检测到清晰的人声,请重试。」上传的文件完全跳过这项检查——它只检查长度——所以一个安静或嘈杂的上传照样被接受,做出来的克隆很差。不管哪条路都录干净的音:一个人说话,没有音乐,没有房间回声。
如果麦克风被挡住了,工作室会这么说,并把你指向 上传。
从描述设计
不用录音,不用样本。打开 设计声音,给它起名,写一段 1 到 1,000 个字符的 声音描述——比如「一位温暖、温柔、带点英式口音的年轻女性」——然后点 创建声音。
声音设计只跑在 MiMo 上,并且限时免费。MiniMax 不能设计声音。
提交之后会发生什么
两个提供方都在同一个请求里就把做好的声音返回来,所以新声音会立刻显示为 可用。随之还会生成一小段预览片段——在任何 可用 的声音上点播放就能听。如果出了岔子,声音会显示 失败 并附一条简短的原因,你可以把它删掉重来。
| 提供方 | 克隆 | 设计 | 创建费用 |
|---|---|---|---|
| MiMo | 可以 | 可以 | 本次活动期间免费 |
| MiniMax | 可以 | 不行 | 1 次语音克隆点数 |
你留多少个声音是没有限制的——只有你的点数余额限制你能做多少个 MiniMax 克隆。
把一个声音安到角色身上
只给你自己听的话,打开声音选择器(聊天设置 → 语音与输入 → 语音),切到 我的声音 标签页选中它。这个选择只属于你一个人。
要让所有人都听到它,就在编辑器里打开那个角色,去 通用设置 → 语音选择 挑那个自定义声音。Reverie 会先让你确认:
把一个克隆声音绑上去,就是把它的声音公开出去。 任何跟那个角色聊天的人 默认都会听到这个克隆声音。他们可以换成别的声音,也没法把你的加进自己的库里 ——但只要这个角色还挂着,他们就能听到它、试听它。
语音克隆点数
语音克隆点数和聊天点数是两笔分开的余额:赠送的加上买来的,减去用掉的。语音工作室在顶部显示这笔明细。
| 来源 | 数量 |
|---|---|
| Pro,年付 | 每年续费给 1 次 |
| Premium,年付 | 每年续费给 2 次 |
| Ultimate,年付 | 每年续费给 3 次 |
| 月付方案 | 没有 |
| 单次购买 | 一次克隆 $5 |
只有年付方案会赠送克隆次数。 任何档位的月付订阅都给 0 次语音克隆点数。 要么买那个单次克隆,要么趁 MiMo 还免费的时候用它。
花掉一次点数的是创建声音这件事。之后播放它,是按那个提供方的费率当作普通的文字转语音计费的——见把消息读出来。
授权与你的样本
在创建按钮上方,工作室写着:「继续即表示你确认拥有使用该声音的权利。」只克隆属于你的,或者你有明确许可去用的声音。
你的样本存放在一个私有存储桶里,并一直保留到你把那个声音删掉。删掉一个声音会把它从你的库里移走,并清理掉存下来的样本以及提供方手上那份副本。
这个工作室为什么存在。 关于为什么是克隆和设计,而不是从一份列表里挑, 背后的想法在最难的一直是声音里。