给你的人声修音

上传一首歌、从你的曲库里挑一首,或者直接在这里唱——然后点渲染。

把音频拖到这里

MP3 / WAV / FLAC / M4A · 最大 50 MB · 10 分钟

对着麦克风直接唱——最长 7 分钟,保存为干净的 WAV。

我的音频是纯人声干声
30 积分 · 约 2–3 分钟

我们会先做 AI 人声分离,只修人声,再混回原来的伴奏。

修已经分离好的人声比修完整混音更干净,也更便宜。 先去分离

强度70%
修正速度25 毫秒
30 积分

在我们的服务器上处理,处理完即删除,绝不用于训练。

结果

和原版对比一下,然后下载。

免费在线 Autotune — 整首歌都能修,不只是清唱

丢一首成品进来,我们把人声分离出来、修好音准,再混回原曲。是要听不出痕迹、仍然像人在唱的修正,还是硬核的 T-Pain 效果,你说了算。无需插件,无水印,支持 WAV 导出。
怎么用

三步搞定,不用插件

全部在我们的服务器上跑。什么都不用装,手机上体验完全一样。

1步骤 1

上传一首歌,或者一段干声

大多数人手上只有成品,所以这是默认选项。我们会做 AI 人声分离,只修人声,再直接混回原来的伴奏。如果你已经有独立的清唱,就选那一档——更快也更便宜。

上传一首歌,或者一段干声
2步骤 2

选个预设,或者自己调

默认是自然:听得出音准了,但还认得出是你。想要硬核的 T-Pain 或 Travis 效果,一点就有。下面每个滑杆随时可用——强度、修正速度、颤音、共振峰,还有一个安全限位。

选个预设,或者自己调
3步骤 3

对比,然后下载

在原版和修音版之间 A/B,切换没有空档、播放位置也不会跳,还能看音高曲线,一眼看清到底动了什么。MP3 320 任何等级都能导出,WAV 16、WAV 24 需要 Basic 及以上订阅——都无水印。

对比,然后下载
各项控制

每个设置到底在做什么

大多数在线修音工具只给你两个滑杆,什么都不解释。这里是完整的面板,用大白话讲清楚。
强度

强度

一个音会被拉向正确音高多远。100% 时每个音都精确落在格子上,硬核效果就需要这样。低于大约 60%,多数听众根本听不出发生过什么——这就是为什么很多免费工具让人觉得是坏的:它们的默认值什么也没做。我们从 70% 起步:明显在起作用,但还是唱出来的。
修正速度

修正速度

一个音起来之后,音高吸附得有多快,单位是毫秒。零是瞬间完成,给你阶梯状的机器人 T-Pain 声。二三十毫秒是工程师做「不该被察觉的修正」时用的值。超过六十,快速的说唱咬字就会漏过去,没被修到。
人性化

人性化

短音需要快速修正,但快速修正会毁掉长音——一个音被锁死在绝对平的音高上持续三秒,听起来就是合成的。人性化会按音持续的长度成比例放慢修正,让快速乐句保持紧致,长音则像真人嗓音那样继续游走。几乎没有别的在线修音工具把这个参数放出来。
容差

容差

一个以音分为单位的死区。已经在这个范围内的音会被完全放过——不是稍微修一点,是完全不碰。这正是保住刻意表达的关键。布鲁斯和爵士人声是故意做音高弯曲的;把容差提到 30–50 音分,这些弯曲能保留下来,真正跑掉的音照样被修好。
颤音保留

颤音保留

颤音是叠在音上的、大约每秒 5 次的快速抖动。不把两者分开的修正,要么把抖动压平,要么修不准这个音。我们把音高拆成缓慢的基线和骑在上面的颤音,只修基线,再按你选的比例把颤音加回去。「自然」到底自不自然,就由这一个控制项决定。
共振峰偏移

共振峰偏移

音高是一个音有多高;共振峰是让它听起来像你的嗓子的那些共鸣。粗糙的变调会把两者一起拖走,这就是廉价工具让人变花栗鼠的原因。我们默认锁住共振峰,并把它单独做成一个滑杆——负值给你更大更厚的嗓音,正值更小更亮,在任何音高上都成立。竞品要么把这个藏在付费墙后面,要么根本没有。
起手参考

三组能用的设置

预设已经很接近了。想自己细调,就从这里开始。

自然修正
01

自然修正

强度 35–60% · 修正速度 30–50 毫秒 · 人性化 10–20 音分。适合本来大致在调上、只需要把那几个跑掉的音悄悄修好的歌手。颤音保留调高。

现代说唱与旋律 trap
02

现代说唱与旋律 trap

强度 70–100% · 修正速度 5–20 毫秒 · 人性化 5–12 音分。紧致、明显能听出处理过,但还没到全机器人。容差调到零,一个都别漏。

和声层与叠音
03

和声层与叠音

强度 60–90% · 修正速度 15–30 毫秒 · 人性化 6–14 音分。伴唱层要比主唱更紧,不然会糊。叠音要比主人声修得更狠。

价格

哪些免费,哪些要积分

没有试用倒计时,也不会用到一半突然弹付费墙。

免费

听前后对比示例。上传曲子,或者在这里录一段。改所有设置,包括高级的那些。看你已经渲染出来的任何结果的音高曲线和频谱图。

15 积分

把一段干声完整渲染出来。不需要分离,所以你只为修音付费——不管选哪个预设都是这 15 积分。导出格式不影响价格;WAV 需要 Basic 及以上订阅。

30 积分

把一整首歌完整渲染出来:AI 人声分离、修音,再混回伴奏。也就是分离 15 积分加修音 15 积分——和各自单独用的价格一样。

常见问题

大家真正会问的问题

注册就有每月免费积分,所以你的头几首曲子不用自己掏钱。积分只花在渲染这一步:干声 15 积分,完整歌曲 30 积分——也就是 AI 人声分离 15 加修音 15,和它们各自单独用的价格一样。上传、录音、调所有设置、看音高曲线全都免费,渲染失败积分立刻退回。

没有。任何等级都不会往音频里加东西——MP3 320 和 WAV 一样干净。WAV 16 位和 24 位导出随 Basic 及以上订阅提供。

整首歌就行,而且这里默认就是这样。我们先做 AI 人声分离,只修独立出来的人声,再混回原封不动的伴奏。几乎所有其他在线修音工具都要求你自备清唱——这才是大家用不下去的真正原因。如果你确实已经有干声,就选那个模式:更快,价格减半。

调性保持自动识别就行。我们从有和弦的完整混音里读调,这比从独立人声里读明显更准。检测把握不大时我们会回退到半音阶——允许所有半音——并且明确告诉你,而不是瞎猜然后把你的人声拖到错的音上。你随时可以手动覆盖。

Auto-Tune 是你买来在 DAW 里跑的插件,可以逐音做图形化编辑。这个跑在浏览器里,吃的是成品歌曲而不是独立音轨,给你的是能快速出结果的关键参数,而不是一整套编辑界面。如果你在专业地混一张专辑,就买插件。如果你想两分钟内让 demo 音准,这边更快。

两个原因。第一,音高检测偶尔会把一个音读错一个八度——低沉的男声和气声演唱上尤其常见——修音工具就老老实实把整个乐句拖过去。我们会限制最大移动量,并在动手之前修复八度跳变。第二,s、t 这类清辅音根本没有音高;把它们送进变调器会产生金属味的哨音。我们会检测出来,原样放行原始波形。

除非你要它这么做。我们把缓慢的音高基线和骑在上面的颤音分开,只修基线,再按「颤音保留」设定的比例把你的颤音加回去。硬核预设是故意把它设成零的——那本来就是效果的一部分。

能。所有处理都在我们的服务器上完成,所以不用装任何东西,手机和电脑没有区别。也完全不依赖你设备的音频硬件。

在我们的服务器上处理,中间文件处理完就删除,也不会用来训练模型。你的结果会留在你自己的历史记录里,直到你删掉。

能——一点就有。机器人味并不来自把修正速度设成零,虽然大多数教程都这么说;它来自把每个音在整个时长里都稳稳按在一个固定音高上。我们的 T-Pain、Travis Scott 和 Cher 预设都是这么做的,所以听起来才像唱片里那样。

相关工具

人声链路上的其他工具

让你的人声回到调上

一整首歌大约两分钟。不用插件,没有水印。