AudioSnap
用麦克风录音,或打开一个音频文件,在波形上剪切、调平电平,导出无损 WAV 或压缩片段。一切都在这个标签页里完成。
用麦克风录音
麦克风只在录音时开启,音频不会离开这个标签页。
麦克风设置
录音乐或环境声时把三项处理全部关掉;在嘈杂环境里录人声则保持开启。
工作原理
录音或打开文件
选好麦克风,判断浏览器的噪声抑制是帮忙还是帮倒忙,然后开始录。或者拖入 MP3、WAV、M4A、OGG、FLAC,甚至视频里的声音——在你开口之前,什么都不会被解码。
在波形上剪
拖动入点和出点标记,在波形上拖动来选择,滚动滚轮放大到某一个词。播放头、选区和缩放彼此独立。
调平并核对
归一化峰值、加淡入淡出、改速度、折成单声道。每一项设置都是一个数字,而不是音频的新副本,所以撤销永远能退回去,源文件也不会越改越差。
按需要导出
要拿到别处继续编辑就用带抖动的 16 位 WAV,想保留余量就用 24 位或 32 位浮点,文件必须小就选压缩的 Opus 片段。在你决定之前就能看到预计大小。
剪得准
剪切点是解码缓冲区里的秒数,而不是媒体元素的播放位置,所以导出的开头和结尾正好落在标记处,不会多出四分之一秒。
真正掌控麦克风
选择输入设备,逐项关掉回声消除、噪声抑制和自动增益,挑单声道还是立体声,并在开始前定好录音比特率。
非破坏性编辑
增益、归一化、淡入淡出、速度和声道改动都以一小段编辑描述的形式保存,导出时才一次性应用。撤销和重做几乎不占内存。
是测出来的,不是猜的
选区的峰值与 RMS(dBFS)、渲染真正会施加的增益、由此得到的峰值,以及输出削波前的提醒。
拿得出手的导出
16 位 WAV 写入时带 TPDF 抖动,安静的淡出也保持干净;24 位和 32 位浮点保留余量;采样率由你决定。
什么都不上传
解码、绘制、渲染和编码全在这个标签页里,由浏览器自带的音频引擎完成。没有服务器,不用账号,也不会从 CDN 拉取第三方库。
录音、剪切、导出,全程不上传
AudioSnap 把麦克风录音机和波形剪辑器放在同一个页面。它用浏览器自带的音频引擎解码文件,画出可以放大的真实最小/最大包络,并在本地渲染最终成品——音频哪儿也不会去。
解码一次,按需渲染
文件只解码一次成为原始采样,之后就不再被改动。裁剪、增益、淡入淡出、速度和声道改动都以数字形式保存,导出时用一次离线渲染统一应用。这就是撤销为什么是瞬时的,也是反复修改不会叠加音质损失的原因。
录素材用它,之后的收尾也用它
录一段语音备忘,把两头的空白剪掉。从一小时的采访里抠出干净的二十秒。配音进入视频剪辑之前先把电平调平。为电话系统把立体声录音折成单声道,或者把 48 kHz 的素材降到 16 kHz 喂给语音模型。波形可以放大到单个词,所以剪切点落在你想要的位置。
按下录音时才请求麦克风权限,按下停止就立刻释放。录音、解码后的采样以及每一次导出,都只存在于这个标签页的内存里,直到你关掉它。没有上传接口,没有针对你音频的分析,也没有从第三方 CDN 取来的模型或编解码器。
常见问题
Q我可以剪已有的音频文件,还是只能剪录音?+
都可以。“打开文件”标签接受 MP3、WAV、M4A/AAC、OGG、Opus、FLAC 和 WebM,也接受视频里的音轨。拖入文件并不会立刻解码:它会一直等到你按下载入按钮,所以一段很长的录音绝不会在你不知情的时候把页面卡住。
Q录音时长有上限吗?+
工具本身没有上限,限制只来自设备内存:音频以原始采样形式保存,48 kHz 立体声大约每分钟 10 MB。在电脑上录很久没问题;在旧手机上,建议每次只录几分钟。
Q这些内容会被上传吗?+
不会。录音、解码、绘制、渲染和编码用的都是浏览器内置的 API。没有任何数据发往服务器,工作过程中也不会从 CDN 下载任何库、模型或编解码器。
Q导出该选哪种格式?+
16 位 WAV 是稳妥的默认选择,也是其他编辑软件预期的格式。如果还打算再处理这个文件,24 位和 32 位浮点能多留一点余量。压缩的 Opus 文件小得多,但浏览器没有离线音频编码器,所以要按实时速度重新编码——两分钟的片段大约需要两分钟。
Q“按住:原声”这个按钮有什么用?+
按住时它播放未经改动的原始音频——不裁剪、不加增益、不加淡入淡出——松开就回到你编辑后的版本。按住 Alt 效果相同。想判断归一化到底有没有帮上忙,这是唯一可靠的办法。
Q增益和归一化有什么区别?+
增益是你自己定的固定量,以分贝计。归一化会测量选区里最响的峰值,算出把它抬到你设定的上限所需的增益,这样在不同距离录下的两段素材最终电平一致。两者同时开启时,手动增益会叠加在归一化之后的电平上。
Q浏览器为什么要请求麦克风权限?+
采集音频始终需要你的明确同意,这个提示由浏览器自己处理。AudioSnap 只在你按下录音时才请求,一旦停止,麦克风指示灯就会熄灭。