怎么样通过编程篡改音频文件(MP3,WAV..…)

类似想法我两年前考虑过,我想做一个App,让张学友唱刘德华的歌。但我做不出来。目前为止,我没有见过市场上有类似的东西。这个想法可行,只是技术上很有难度。假如可以做出来,这个技术足以支撑起一家公司。
■网友
作为有点程序思维也懂点音乐的强答一记前面也有@黄兢成 说出了结论,如果有这项技术就能支撑一家公司了。不过现在这家公司还没出现。有了结论,我就从音乐的角度来谈一谈。首先,我们得知道需要准备什么:1. 你要替换的人声音源。可以是一个采样(一段现成录好的唱歌音频文件),也可以是个一个采样包(这个人发出的所有音节的采样,用于后期合成说话唱歌声),也可以是一些声音特征,直接合成人声。当然第一种方式在某种情况下是成本最低的。2. 要被替换人声的歌曲文件至于软硬件平台不在本次讨论范围内东西准备好了,就得知道我们究竟要干什么声音的本质就是震动的频率人耳能听到的声音是20-20 kHz,所以音乐的频率大部分也都在这个区间人声的频率是1kHz左右知道这三件事就知道我们要干什么了。识别出20-20kHz之间的1kHz左右的人声频率剔除掉,替换成需要的人声。可能有人觉得把1kHz左右的人声剔除掉很简单,下面请看一下这个文档(随便搜的) 常见乐器的频率特性https://zm6.sm-tc.cn/?src=https://www.zhihu.com/api/v4/questions/48814983/http%3A%2F%2Fwww.greatwallaudio.com%2FNews%2F2009610103411.html/u0026amp;uid=f62482cfee829929609220c658e6fa7f/u0026amp;hid=786a4b80e7876aa069e36811730ddcb2/u0026amp;pos=3/u0026amp;cid=9/u0026amp;time=1469466286588/u0026amp;from=click/u0026amp;restype=1/u0026amp;pagetype=0000004000000402/u0026amp;bu=web/u0026amp;query=%E4%B9%90%E5%99%A8+%E9%A2%91%E7%8E%87/u0026amp;mode=/u0026amp;uc_param_str=dnntnwvepffrgibijbprsvdsei这个世上乐器声音能达到1kHz左右的没有上百也有几十种,从这几十种声音里完美地找到人声并且消除,还要不影响其他的乐器声基本是不可能靠机器自动完成的,对机器来说,任何声音都是频率,任何音频文件都是对频率的切片采样。那人工操作有可能完成吗?可以,但是也不可能100%完美,成本高并且还没人愿意做。那么最完美的解决办法是去找专业的编曲师,混音师,母带师带上你朋友去棚里录好音,编个一膜一样的曲,处理完后期就能听到你朋友的完美还原伴奏版的歌曲啦~当然上面的过程太麻烦了!而且也太贵了!有没有便宜一点的办法呢?有!那就是去网上下载需要的伴奏带,然后找个淘宝混音湿拼起来。瞎扯完毕。技术上来讲,消除人声的技术是存在的,不过也不会很完美。把人声插进伴奏也是可行的,不过做不到人工后期那么精致和好听。
■网友
修改音频文件很简单 按文件格式 解码再编码即可
而题主所说 将A的歌 变成B唱的 这个B还是家人或者朋友
这个技术上很有难度 但是勉强还有实现的可能
如果自动化的效果不好 还可以手调
然而经济上几乎是完全无意义的
谁为你的家人或者朋友 建立音色库?
【怎么样通过编程篡改音频文件(MP3,WAV..…)】

■网友
想想也是蛮难的 -识别歌声已经有软件可以实现了。-最难的部分应当是音色。目前的变声软件只能把音频改成固定预备好的音色,但是要想指定谁就能按照谁的音色播放,这个难度相当大了。


    推荐阅读