国内刊号:11-5602/TP
国际刊号:1673-9418
发布日期:
作者:李雪哲,王晓晨,高丽,涂卫平,柯善发
单位:1. 武汉大学 计算机学院 软件工程国家重点实验室,武汉 4300722. 武汉大学 计算机学院 国家多媒体软件工程技术研究中心,武汉 4300723. 武汉大学 多媒体网络通信工程湖北省重点实验室,武汉 430072
关键词:多对象音频编码,空间参数,空间位置约束,动态量化
近年来,在某些交互场景中,面向对象空间音频编码能够允许用户更加灵活地对特定对象进行个性化的渲染和重组。然而,如果对象音频分别编码会导致整体码率随着对象数目的增加而同步大幅增加。MPEG组织提出的面向对象音频编码(spatial audio object coding,SAOC)可以将所有对象下混成一个单独的混合信号,同时为每个对象提取少量的边信息。但是,当其对超过32个对象音频进行编码时,边信息的码率会随着对象数目的增加而增大,甚至会远大于下混对象的码率。为了解决这个问题,提出一种在面向对象编码中基于空间位置约束的空间参数动态量化方法,以叠加定位原理为理论基础,利用虚拟声源的空间位置与产生该声源的音频对象的空间位置之间的约束关系,确定出空间约束区域以及局部空间量化码本,并针对提取出的虚拟声源的空间方位,进行空间参数的量化编码。最后给出主观实验和客观实验,表明在音质和空间方位大致相当的情况下,边信息的码率比SAOC方法降低约30%。
来源:2018年第1期
《计算机科学与探索》期刊编辑部