有通过深度学习来提升音质的工具吗?

2022 年 2 月 8 日
 KIRAYOMATO

图片和视频处理的已经有一大堆了,提升分辨率、帧率之类的,而且效果基本上来说还行。

但是音频处理方面好像没怎么听说过

5040 次点击
所在节点    程序员
18 条回复
michaelzhou
2022 年 2 月 8 日
音频有环境声降噪、人声突出增强等等。
jr55475f112iz2tu
2022 年 2 月 8 日
无线耳机用了不少算法吧
p2pCoder
2022 年 2 月 8 日
音频肯定也有一大堆了,毕竟 cv nlp 音视频方向出论文的速度是非常快的
learningman
2022 年 2 月 8 日
NVIDIA 有一个,但是必须要 RTX 显卡
learningman
2022 年 2 月 8 日
NVIDIA RTX Voice
Chihaya0824
2022 年 2 月 8 日
没听说过不代表没有嘛~
谷歌随便搜一下第一个就有篇带 code 的 paper
https://kuleshov.github.io/audio-super-res/
Chihaya0824
2022 年 2 月 8 日
@Chihaya0824 上面的都是 5 年前的了
https://arxiv.org/abs/2111.00195
这里有份更近的
tfdetang
2022 年 2 月 8 日
有趣的问题,仔细回顾下,确实音频音质提升的算法和工具似乎不如图片与视频的多。

虽然不是音频方向的,但是从直觉上觉得提升音质与提升画面分辨率算法并不会有本质上的区别,只需要很有限的改动就能把图像超分辨率应用到音频上。

我觉得可能还是音频的超分辨率效果不如图像这么直观,所以这个方向的关注度不如图像的那么高。
kidonng
2022 年 2 月 8 日
> 我觉得可能还是音频的超分辨率效果不如图像这么直观,所以这个方向的关注度不如图像的那么高。

确实,现代录音设备已经能极大程度的避免失真,高品质音乐串流也早已流行。音频超分辨率用武之地似乎只剩下老歌,问题是听老歌不就是听那个味吗🐶
KIRAYOMATO
2022 年 2 月 8 日
@kidonng
但是很多东西你搞不到高音质的版本
比如说视频里的音频,天天被吹支持超高画质的 ytb 音频码率也只有一百多 kbps
kidonng
2022 年 2 月 8 日
@KIRAYOMATO 128 K 算业界标准吧,我一天天听 MV 的也没觉得问题多大(
看视频的主要目的还是冲着画面去的,真听歌老实用音乐服务不好吗
Thiece
2022 年 2 月 8 日
@KIRAYOMATO
如果能做到实时,电话似乎是一个不错的应用领域
F281M6Dh8DXpD1g2
2022 年 2 月 8 日
mikewang
2022 年 2 月 8 日
补充一个 Upconv: http://59414d41.cocolog-nifty.com/blog/2019/12/post-5c6522.html
用于填充丢失的高频部分将普通音质声源进行 Hi-Fi 化(不过好像不是深度学习来的)
zzxgz
2022 年 2 月 9 日
“脑放”算吗?
xuanbg
2022 年 2 月 9 日
大概是因为声音的回放就很不保真的缘故吧,所以提升音质很大程度上是个伪需求。
MaxLv
2022 年 2 月 10 日
@learningman RTX Voice 现在能非 RTX 卡用了
toaruScar
2022 年 2 月 10 日
https://www.zhihu.com/question/60497537/answer/270260628 索尼耳机的 DSEE 据说就是通过 AI 来提升音质

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://v2ex.ih06.com/t/832425

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX