城市声音地图:上传一段环境音,听出它像哪座城市
闭眼听一段录音,你能听出这是公园还是商场吗?城市声音地图在浏览器里分析你上传的环境音——低频的轰鸣、中频的人声、高频的雨点——然后告诉你,这片声音更像哪种城市氛围。
使用指南:录一段,传上来
第一步,准备音频:用手机随手录一段 10-30 秒的环境音(街边、公园、雨天窗前都可以),导出成常见音频文件。第二步,上传分析:文件在你的浏览器里被解码、切片、做傅里叶变换(FFT),全程本地完成,不上传任何服务器。第三步,看结果:页面会画出这段声音的平均频谱柱状图,并按低/中/高频能量分布与频谱特征,匹配出最接近的几种城市氛围——公园、商场、雨天街道、夜晚街道、地铁站、咖啡馆、市集、郊野——附一段为什么会这样判断的说明。
判断依据示例:低频能量占主导且整体平稳,更像雨天街道或夜晚的马路;中频人声频段突出而高频稀疏,多半是咖啡馆或市集;全频段饱满且动态起伏大,则接近地铁站或商场。
技术原理与隐私保护说明
分析链路全部基于浏览器原生的 Web Audio API:decodeAudioData 解码 → 离线音频上下文分帧 → FFT 计算频谱 → 提取低/中/高频能量占比、谱质心与动态范围等特征 → 与内置的氛围特征模板做距离匹配。没有神经网络、没有云端服务,一台普通的浏览器就能完成。
隐私方面:音频文件只在内存中处理,分析完成即释放,不持久化、不上传、不留副本。这是这个工具最重要的承诺——你的录音从头到尾没有离开过你的设备。
FAQ 常见问题解答
Q: 支持哪些音频格式?
A: 浏览器能解码的格式都支持,常见如 MP3、M4A、WAV、OGG。录制建议 10-30 秒,太短特征不稳定,太长没有必要。
Q: 我的录音会被上传吗?
A: 不会。解码与 FFT 分析全部在浏览器本地内存中完成,分析结束即释放,工具没有任何服务器。
Q: 判断结果不准怎么办?
A: 环境音往往混合多种声源,结果是「最接近的几种氛围」而非唯一答案。可以看看频谱图自己判断——那本身就是这个工具好玩的部分。
Q: 能直接用麦克风录制吗?
A: 当前版本支持上传文件,录音功能在规划中。用手机自带录音 App 录好再上传,效果是一样的。