Neatbo.

本地录音检查与修复:完整输出和明确操作

按任务选择停顿、声道、全段谱图或频段滤波,核对原帧映射、完整矩阵与量化 WAV。

选择独立任务

录音可能需要缩短停顿、找回有用声道、检查完整时频分布,或执行明确滤波链。先听原录音,再针对实际问题选择。低 RMS 电平不能识别语音,也不能证明那段音频可以丢弃。

任务与完整交付
工具操作下载集合
T269缩短符合条件的低电平停顿PCM16 WAV + 完整帧映射 JSON/CSV
T270选择/重复声道,或拆分全部声道映射 WAV 或声道 ZIP + 映射/统计 JSON/CSV
T271检查所选声道的完整录音带轴 PNG + 完整 float32 矩阵 + 设置/峰值 JSON/CSV
T272执行明确高通/低通/陷波链PCM16 WAV + 响应 SVG + 系数/极点/响应 JSON/CSV

缩短停顿和恢复声道

T269 按四舍五入的20ms 窗口计算各声道 RMS,以最大声道值与阈值作含边界比较。默认−40dBFS、最短停顿500ms、保留200ms。已核对的10秒/8kHz 示例有80,000帧;一段3秒符合条件的停顿删除22,400帧,输出57,600帧。在删除中段两侧保留停顿,完整映射记录原始/输出半开帧区间,不自动淡化拼接。1秒全静默示例保留1,600个边缘帧;未达到最短时长的静默保持原样。

T270 的映射1,1把源声道1复制到两个输出声道,不平均、不猜测意义。已核对的双声道源有16,000帧,输出两侧逐字节等于源第一声道。拆分模式在 ZIP 中交付每个原声道的单声道 WAV。RMS、峰值、DC 偏移和原索引用于比较,不判定谁在说话。

读取完整频谱

T271 选择真实源声道,FFT256–4096、步长FFT/4、周期 Hann;左侧不补零,最后窗口右侧补零。单边线性幅度除以 Hann 总和,内部频点乘2。已核对的4秒/8kHz/FFT2048 示例有60窗口 ×1,025频点,即61,500个值。小端 float32 矩阵包含全部数值,JSON记录中心时间、峰值并列数与 PNG 的精确窗口/频点范围。

PNG 覆盖完整源时长与 Nyquist 频率,像素对表示的幅度取最大值,空时间列使用最近窗口。窗口中心可进入补零尾部。相同峰值取最低频点并报告并列数,不估计语音基频或鉴定真伪。超过4,000,000矩阵单元或100,000,000 FFT工作量时整体拒绝,不偷偷只分析前缀。

执行明确频段链

T272 最多输入8行 type,frequencyHz,Q,例如 notch,60,10。支持 highpass、lowpass、notch;频率10Hz至采样率0.49倍,Q0.1–30。归一化 W3C/RBJ 节的极点严格稳定,初始状态为零;每个声道采用同一 float64 链,最后转换 float32。

已核对的8秒/8kHz样本混合60Hz嗡声与1kHz单音。该陷波使量化后的60Hz分量降低115.12dB,1kHz变化−0.000185dB。这说明确定样本上的操作,不代表任意录音都有同样效果。高 Q 会振铃或削波;不做增益归一化,完整导出系数、512个响应点与削波计数。

理解采样与浏览器边界

支持现有解码器的 WAV 位深与 MP3,1–8声道、8–192kHz。输入30MiB、解码 float32 存储80MiB、完整输出100MiB;滤波另限160,000,000采样-滤波节工作量。生成音频统一用 round(decoded×32768) 并限幅[−32768,32767]。PCM16保留/选取/拆分帧保持字节精确;float、24/32位与 MP3 明确量化,不保持源编码格式。

MP3帧与时间按浏览器实际解码 PCM。相同48kHz样本在 Chromium 为96,000帧/2.000秒,WebKit 为97,920帧/2.040秒,来自解码 priming/gapless 差异。对比输出要看报告的解码器、采样率与帧数,不承诺不同浏览器具有相同 MP3 时长。

  • 手动试听每个受控 WAV 预览,绝不自动播放;保留原录音作比较。
  • 核对完整下载的映射与设置,不把200行结果预览误认为全报告。
  • 有具体理由才降低阈值或缩短最短停顿;安静但有用的内容可能被删。
  • 修正不支持的头部、非法参数或预算超限再运行,拒绝不会伪造成功的部分分析。
  • 滤波时结合完整响应和削波报告。这些工具不做语音识别、自动人声恢复或整套去噪。

参考资料

本分类工具使用说明

展开工具,查看操作步骤、可调选项和支持范围,再直接进入工作区。

录音低电平停顿缩短按全声道RMS阈值缩短长停顿,保留源帧并导出完整删改映射。

在实际PCM中按20ms四舍五入窗检测全声道均低于阈值的连续停顿,移除符合最短长度的中部,保留两边。输出真实PCM16试听WAV、静默/删除区间及源到输出的完整半开帧映射。PCM16保留帧字节恒等,不做crossfade;这不是语音识别,安静的有用声音也可能被删。

操作步骤

  1. 选择本地WAV/MP3。
  2. 设置参数并检查实际结果、统计或帧映射。
  3. 试听/核对后下载完整产物。

可调选项

RMS阈值(dBFS)
-40
最短停顿(ms)
500
每停顿保留(ms)
200

必须≤最短停顿,左floor/右ceil分配保留帧。

能力与限制

  • 一份受支持WAV/MP3最大30MiB、实际解码PCM最大80MiB,1–8声道、8–192kHz;所有下载合计100MiB。WAV支持既有PCM8/16/24/32、float32/64解析;MP3需要浏览器实际可解码,不读取麦克风、不上传或抓远程音频。
  • MP3 priming/gapless处理因浏览器而异:同一已核对MP3在Chrome为2.000秒、WebKit为2.040秒。所有时间/帧以本浏览器实际解码PCM为准,不保证跨浏览器样本/时长恒等。PCM16输出为round(decoded*32768)并clamp[-32768,32767],不归一化;float/24/32/MP3不保证原编码字节恒等。
  • 阈值−80…−10dBFS,最短停顿100…60,000ms,保留20ms至最短停顿值,最多10,000停顿。阈值包含等号,最后不足一窗按实际样本RMS。全静默长文件保留所选两端;不足最短停顿不删,零检测也输出完整原帧副本。
打开录音低电平停顿缩短 →
录音声道恢复与拆分明确选择已有源声道,隔离、重复或拆分为可试听WAV,保留完整映射。

查看各声道RMS、峰值、DC和超满幅样本,选择1起算的源声道映射。例如1,1把左声道复制到两侧而不平均混入右侧噪声。也可一次拆出所有原声道ZIP并逐声道试听。PCM16选择/重复/拆分的样本字节恒等;不猜声道含义,也不能重建已经丢失的独立立体声。

操作步骤

  1. 选择本地WAV/MP3。
  2. 设置参数并检查实际结果、统计或帧映射。
  3. 试听/核对后下载完整产物。

可调选项

交付方式
明确映射 · 拆出全部原声道
源声道列表(1起算)
1,1

1,1=复制声道1到两侧;2,1=交换左右;1=仅声道1。拆分模式忽略。

能力与限制

  • 一份受支持WAV/MP3最大30MiB、实际解码PCM最大80MiB,1–8声道、8–192kHz;所有下载合计100MiB。WAV支持既有PCM8/16/24/32、float32/64解析;MP3需要浏览器实际可解码,不读取麦克风、不上传或抓远程音频。
  • MP3 priming/gapless处理因浏览器而异:同一已核对MP3在Chrome为2.000秒、WebKit为2.040秒。所有时间/帧以本浏览器实际解码PCM为准,不保证跨浏览器样本/时长恒等。PCM16输出为round(decoded*32768)并clamp[-32768,32767],不归一化;float/24/32/MP3不保证原编码字节恒等。
  • 映射逗号列表1–8输出声道,每个索引必须存在;拆分模式忽略映射列表。输出容量在分配前校验,不能静默减少声道。
打开录音声道恢复与拆分 →
完整录音时频图与数值导出分析实际音频全段,导出带轴PNG、完整STFT幅度矩阵和明确窗/时间/频率设置。

选择实际源声道,完整计算periodic Hann STFT。导出带t[s]、f[Hz]和dBFS色标的PNG、全部little-endian float32幅度bin,以及每窗真实中心时间、峰值和设置。显示可以max-pool以适配图像预算,但每个原窗均覆盖,完整数值仍下载;不截取录音前缀。

操作步骤

  1. 选择本地WAV/MP3。
  2. 设置参数并检查实际结果、统计或帧映射。
  3. 试听/核对后下载完整产物。

可调选项

源声道(1起算)
1
FFT窗口样本数
256 · 512 · 1024 · 2048 · 4096
显示dBFS下限
-80

能力与限制

  • 一份受支持WAV/MP3最大30MiB、实际解码PCM最大80MiB,1–8声道、8–192kHz;所有下载合计100MiB。WAV支持既有PCM8/16/24/32、float32/64解析;MP3需要浏览器实际可解码,不读取麦克风、不上传或抓远程音频。
  • MP3 priming/gapless处理因浏览器而异:同一已核对MP3在Chrome为2.000秒、WebKit为2.040秒。所有时间/帧以本浏览器实际解码PCM为准,不保证跨浏览器样本/时长恒等。PCM16输出为round(decoded*32768)并clamp[-32768,32767],不归一化;float/24/32/MP3不保证原编码字节恒等。
  • FFT须2的幂256…4096,hop=FFT/4,无左padding,尾窗补零;单侧幅度为absFFT/HannSum,除DC/Nyquist外乘2。最多4,000,000矩阵格、100,000,000 FFT工作量,计算前拒超预算。PNG全时间范围,按窗中心分配列,空列用最近窗;频率0到Nyquist。峰值仅是最大幅度bin,同值选最低bin并计同值数量,不是音高/来源鉴定。
打开完整录音时频图与数值导出 →
录音明确频段滤波按用户声明的高通、低通或陷波链处理实际样本,输出WAV、响应和裁剪计数。

每行填写type,frequencyHz,Q,如notch,60,10。相同已声明链应用于全部声道,用W3C/RBJ稳定biquad和零初始状态处理实际样本。输出真实PCM16试听WAV、全部系数/极点/响应与前后电平。没有归一化或自动降噪;高Q可能振铃并削减有用声音或产生裁剪。

操作步骤

  1. 选择本地WAV/MP3。
  2. 设置参数并检查实际结果、统计或帧映射。
  3. 试听/核对后下载完整产物。

可调选项

滤波链:每行type,Hz,Q
notch,60,10

支持highpass、lowpass、notch。最多8行,截止不得越过Nyquist。

能力与限制

  • 一份受支持WAV/MP3最大30MiB、实际解码PCM最大80MiB,1–8声道、8–192kHz;所有下载合计100MiB。WAV支持既有PCM8/16/24/32、float32/64解析;MP3需要浏览器实际可解码,不读取麦克风、不上传或抓远程音频。
  • MP3 priming/gapless处理因浏览器而异:同一已核对MP3在Chrome为2.000秒、WebKit为2.040秒。所有时间/帧以本浏览器实际解码PCM为准,不保证跨浏览器样本/时长恒等。PCM16输出为round(decoded*32768)并clamp[-32768,32767],不归一化;float/24/32/MP3不保证原编码字节恒等。
  • 最多8段、160,000,000样本×段工作量;频率10Hz至0.49sampleRate,Q0.1…30,系数/极点有限且严格稳定。段间float64,最终float32 PCM后按统一公式量化;超过±1样本计clippedSamples,WAV饱和不隐瞒。响应图范围−100…20dB,完整512频率响应在报告。不是语音识别或整套噪声修复。
打开录音明确频段滤波 →

本文相关工具

录音低电平停顿缩短 →按全声道RMS阈值缩短长停顿,保留源帧并导出完整删改映射。录音声道恢复与拆分 →明确选择已有源声道,隔离、重复或拆分为可试听WAV,保留完整映射。完整录音时频图与数值导出 →分析实际音频全段,导出带轴PNG、完整STFT幅度矩阵和明确窗/时间/频率设置。录音明确频段滤波 →按用户声明的高通、低通或陷波链处理实际样本,输出WAV、响应和裁剪计数。