把说话人匿名化
还没做 打算在你的浏览器里运行
这个东西还不存在。这一页上没有任何你今天能用的功能 —— 它在这里是为了让你判断出它会做什么、 以及实际缺的是什么,而不是在导航里看到它然后一头雾水。真正能用的那一个是 降噪,它现在就能用,在你的浏览器里。
它打算做什么
让录音里的说话人认不出来。这件事分成两半,而那其实是两件不同的活:
- **声音。**把音高和共振峰移动到足够的程度,使得说话人既不能靠耳朵辨认、 也不能和一段声音样本比对上,同时把话说的内容留得能听懂。不是变成机器人音 —— 那种声音听一分钟以上就难受,而如果有人真的要看完这段采访,那就本末倒置了。
- 脸,如果录的是带画面的。在整个镜头里找到那张脸并遮住或打码, 而不需要你一帧一帧手打关键帧。
给用户研究、纪录片和举报人访谈用 —— 内容要留下,身份不能留下的那种录音。
声音处理的实现路径比较明确
音高和共振峰移位属于信号处理,和这里已经在跑的降噪是同一类活。这一点有实际意义: 它意味着走的是我们已经验证过的那条路 —— 一个跑在你自己设备上的 WebAssembly 引擎 —— 而不是一类新问题。我们不是说它做完了。我们是说我们知道它是什么。
画面处理还需要验证
在浏览器里做人脸检测是可能的,也有能做这件事的模型。我们还没有选定一个、 没有量过它、也没弄清它在手机上要花多少代价 —— 在那之前,我们给你的任何数字都是编的。 这一半决定了这个工具是先只做声音就上线,还是等两边都能用才上线。
你的文件会去哪
我们的目标是让它和降噪一样,在你自己的设备上处理:浏览器在本地打开文件,不把内容发给我们。 这也是上面那个徽章写的是打算而不是会的原因。它还没做出来,所以它没法承诺自己 跑在哪 —— 一个不存在的工具守不住任何隐私承诺,而照样声明一个,正是那种说起来容易、 但没法验证的话。
关于整个站,有一件事值得明说:降噪一直是本地跑的,从来如此。而路线图上第三个东西 配音,将来必须上传你的文件 —— 见设想中的配音是怎么做的。 所以「什么都不上传」这句话在每个工具上成立与否是分开的,不是整站一句话, 而每个工具都会说清自己是哪一种。
缺的是什么
声音处理的技术路径已经明确;画面处理还没选定检测模型,两部分都尚未实现。
没有日期。一件有一半工作还没界定过的事,我们不会给你日期, 而一个编出来的日期比这句话本身还不值钱。这一页上也刻意没有邮箱输入框: 我们的支持邮箱只收信不发信,所以放一个表单在这儿只会拿走你的地址然后什么都不做。
如果你现在就需要
用已经存在的东西。变声在好几个音频编辑器里都有,人脸打码在多数视频编辑器里都有 —— 两者都是手动步骤而不是一步到位,而那正是这个工具想要填的空。 我们宁愿把你指向一条真的能走的流程,也不想让你等我们的。