计算机科学与探索杂志

计算机科学与探索杂志2022年第1期

  • 基于计算的蛋白质复合物预测方法综述
    潘玉亮, 关佶红, 姚恒, 石运佳, 周水庚
    蛋白质是生命活动的物质基础,直接参与、执行生命的活动过程。大多数蛋白质通过相互作用形成复合物来实现各种生物功能,因此预测蛋白质复合物有助于了解复合物的结构及其功能,也为细胞机制的研究奠定了重要基础。目前,随着高通量实验技术的不断发展,全基因组蛋白质相互作用(PPI)数据日益增多,领域内已经出现了很多基于计算的蛋白质复合物预测方法。虽然现有方法各具特色与优势,但也存在一些不足。首先,针对现有基于计算的蛋白质复合物预测方法进行了分类和比较全面、详细的分析评述;接着,介绍了复合物预测中常用的评价指标和主要数据集,并比较和分析了几种代表性方法的预测性能;最后,对复合物预测方法进行了总结与展望,提出了今后有待解决的若干问题。希望通过对各类方法的分析与比较,为相关人员使用和研究基于计算的蛋白质复合物预测方法提供有价值的参考和方向指引。
  • 个性化学习推荐研究综述
    吴正洋, 汤庸, 刘海
    个性化学习推荐是智能学习的一个研究领域,其目标是在学习平台上给特定学习者提供有效学习资源,从而提升学习积极性与学习效果。虽然现有的推荐方法已被广泛用于教学场景,但教学活动自身的科学规律,使个性化学习推荐在个性化参数设置、推荐目标设定、评价标准设计等方面具有一定的特殊性。针对上述问题,在调研大量文献的基础上对近年来个性化学习推荐的研究进行了综述。从学习推荐通用框架、学习者建模、学习推荐对象建模、学习推荐算法、学习推荐评价五方面对个性化学习推荐的相关研究进行了系统的梳理和解读。首先提出了学习推荐系统的通用框架,其次介绍了学习者建模的思路和方法,接着讨论了学习推荐对象建模的思路和方法,然后归纳了学习推荐的算法与模型,接下来总结了学习推荐评价的设计与方法。并对这五方面现有研究的主要思想、实施方案、优势及不足进行了分析。最后还展望了个性化学习推荐未来的发展方向,为智能学习的进一步深入研究奠定了基础。
  • 深度学习中的单阶段小目标检测方法综述
    李科岑, 王晓强, 林浩, 李雷孝, 杨艳艳, 孟闯, 高静
    随着深度学习的不断发展,目标检测技术逐步从基于传统的手工检测方法向基于深度神经网络的检测方法转变。在众多基于深度学习的目标检测方法中,基于深度学习的单阶段目标检测方法因其网络结构较简单、运行速度较快以及具有更高的检测效率而被广泛运用。但现有的基于深度学习的单阶段目标检测方法由于小目标物体包含的特征信息较少、分辨率较低、背景信息较复杂、细节信息不明显以及定位精度要求较高等原因,导致在检测过程中对小目标物体的检测效果不理想,使得模型检测精度降低。针对目前基于深度学习的单阶段目标检测方法存在的问题,研究了大量基于深度学习的单阶段小目标检测技术。首先从单阶段目标检测方法的Anchor Box、网络结构、交并比函数以及损失函数等几个方面,系统地总结了针对小目标检测的优化方法;其次列举了常用的小目标检测数据集及其应用领域,并给出在各小目标检测数据集上的检测结果图;最后探讨了基于深度学习的单阶段小目标检测方法的未来研究方向。
  • 图嵌入模型综述
    袁立宁, 李欣, 王晓冬, 刘钊
    图分析用于深入挖掘图数据的内在特征,然而图作为非欧几里德数据,传统的数据分析方法普遍存在较高的计算量和空间开销。图嵌入是一种解决图分析问题的有效方法,其将原始图数据转换到低维空间并保留关键信息,从而提升节点分类、链接预测、节点聚类等下游任务的性能。与以往的研究不同,同时对静态图和动态图嵌入文献进行全面回顾,提出一种静态图嵌入和动态图嵌入通用分类方法,即基于矩阵分解的图嵌入、基于随机游走的图嵌入、基于自编码器的图嵌入、基于图神经网络(GNN)的图嵌入和基于其他方法的图嵌入。其次,对静态图和动态图方法的理论相关性进行分析,对模型核心策略、下游任务和数据集进行全面总结。最后,提出了四个图嵌入的潜在研究方向。
  • 若干新型智能优化算法对比分析研究
    张九龙, 王晓峰, 芦磊, 牛鹏飞
    智能优化算法(IOA)指的是一类以自然界的生物生存进化过程或物理现象为算法原理,用于解决最优化问题的算法,较为知名的智能优化算法有遗传算法、粒子群算法、模拟退火算法等。智能优化算法属于启发式方法,广泛应用在解决最优化问题上,传统的群智能算法为解决一些实际问题提供了新思路。随着科学技术的进步和应用场景的改变,传统的智能优化算法在收敛速度、求解精度等方面已无法满足日益复杂的优化问题,因此不断有新的更高效的智能优化算法被提出。选取了近几年国内外提出的几种新型智能优化算法:蝴蝶优化算法(BOA)、飞蛾扑火算法(MFO)、正弦余弦优化算法(SCA)、蝗虫优化算法(GOA)、哈里斯鹰优化算法(HHO)、麻雀搜索算法(SSA)。阐述了各算法的基本原理、算法步骤、相关的改进策略及存在的优缺点。为客观对比各算法性能,进一步通过3种类型共21个测试函数及6个指标评价各算法性能,最后归纳总结各算法的特点并对智能优化算法的发展前景进行展望。
  • 面向多表数据连接投影和连接顺序的优化方法
    宗枫博, 赵宇海, 王国仁, 季航旭
    多表连接运算是大数据处理中常见的运算。类似于数据库运算中常见的连接操作,多表连接运算的顺序会对计算资源和传输资源的消耗产生巨大影响。对多表连接顺序的优化是一个经典的优化问题,同时每次连接中表的投影结果大小也会影响节点间传输的数据体积,因此整体连接的顺序和每次连接的投影关系都会对连接效率产生显著的影响,而在传统的优化策略中,往往不会考虑到中间投影关系的取舍问题,以及基于中间投影关系而对最优连接策略产生的影响。针对这个问题,建立了一种连接关系索引,能够在构建优化连接策略中调整每次连接的投影关系,及时删除冗余列,减少对传输资源的消耗,同时基于投影关系的优化调整连接顺序的优化策略,从全局考量上尽可能地同时减少对传输资源和计算资源的消耗。该优化策略在Flink系统实现后进行了实验,结果表明有显著的优化效果。
  • 采用N-list结构的混合并行频繁项集挖掘算法
    刘卫明, 张弛, 毛伊敏
    针对大数据环境下并行MRPrePost频繁项集挖掘算法中存在计算节点负载不均衡,N-list合并效率低以及冗余搜索等问题,提出了基于N-list结构的混合并行频繁项集挖掘算法HP-FIMBN。首先,设计负载量估计函数(LE)来计算出频繁1项集F-list中每一项的负载量,同时提出基于贪心策略的分组方法(GM-GS)将F-list中的每一项根据其负载量进行均匀分组,既解决了数据划分中计算节点负载不均衡的问题,又降低了集群中各节点上子PPC-Tree树的规模;其次,提出预先放弃策略(EAS),该策略不仅能有效避免合并过程中的无效计算,而且不需要遍历初始N-list结构就能得到最终的N-list,极大地提高了N-list结构的合并效率;最后,采用集合枚举树作为搜索空间,并提出超集等价剪枝策略(SES)来避免挖掘过程中的冗余搜索,生成最终的挖掘结果。实验结果表明,该算法在大数据环境下进行频繁项集挖掘具有较好的效果。
  • BERT辅助金融领域人物关系图谱构建
    张纯鹏, 辜希武, 李瑞轩, 李玉华, 刘伟
    现有的人员简历信息抽取方法无法针对金融公告中非结构化人员简历进行人员属性以及事件的抽取,无法发现金融公告中跨文档的人员之间关系。针对以上问题,将非结构化的人员简历抽取成结构化的人员信息模板,提出一种金融领域人物关系图谱构建方法。通过对BERT预训练语言模型进行训练,抽取出非结构化人员简历文本中的人员属性实体,利用训练好的BERT预训练模型获取事件实例向量,对事件实例向量进行准确的分类,填充层次化的人员信息模板,准确地关联人员属性。进一步地,通过填充好的人员信息模板,提取人员关系,构建人物关系图谱。通过构建人工标注的数据集,进行实验验证。实验表明所提出的方法可以有效解决非结构化金融人员简历文本信息提取问题,有效地构建金融领域人物关系图谱。
  • 改进的二视图随机森林
    夏笑秋, 陈松灿
    随机森林(RF)是最经典的机器学习算法之一,并已获得广泛应用。然而观察发现,尽管现实中存在众多的二视图数据并已获得广泛的分析研究,但针对二视图场景的RF构建相当少,仅有的利用RF解决二视图学习问题的方法也都是先为各个视图生成各自的RF,在决策时才融合了视图间的信息。这样的方法存在一个显著不足是在其RF的构建阶段未利用两个视图间的相关性,这无疑浪费了信息资源。为了弥补这一不足,提出了一种改进的二视图随机森林(ITVRF)。具体而言,在决策树的生成过程中采用典型相关分析(CCA)进行视图融合,将视图间的信息交互融入到了决策树的构建阶段,实现了视图间互补信息在整个RF生成过程中的利用。此外,ITVRF还通过判别分析为决策树生成判别决策边界,更适合于分类。实验结果表明ITVRF比现有的二视图RF(TVRF)有着更优的准确率。
  • 基于Stackelberg博弈的边缘云资源定价机制研究
    刘荆欣, 王妍, 韩笑, 夏长清, 宋宝燕
    移动边缘计算(MEC)支持终端设备将任务或应用程序卸载到边缘云服务器处理,边缘云服务器处理外来任务会消耗本地资源,为激励边缘云提供资源服务,构建向终端设备收费以奖励边缘云的资源定价机制尤为重要。现有的定价机制依赖中间商的静态定价,费用高且终端任务处理不及时,难以实现边缘云计算资源的有效利用。针对上述问题,提出一种基于Stackelberg博弈的边缘云资源定价机制。首先,针对资源定价时终端设备因资金不足而导致的本地任务搁置问题,提出包含贷款和激励的辅助机制,实现终端设备任务的及时处理;其次,提出影响资源定价的四种价格导向因素,制定了一致性与弹性两种定价方案,提高定价的准确性和效率,并为动态定价做准备;然后,为了使终端设备与边缘云直接进行动态定价,构建基于斯坦克伯格(Stackelberg)博弈的资源定价机制模型,将资源需求与定价问题转化为边缘云收益最大与终端设备支付成本最小问题;最后,通过改进的强化学习SARSA算法得到资源需求及定价的最优策略。实验表明,提出的定价机制在边缘云收益最大化方面优于其他定价算法12%以上,同时弹性定价方案下边缘云的收益优于一致性定价方案24%。
  • 基于改进自编码网络的轴承振动异常检测
    李贝贝, 彭力
    近年来,自编码器和神经网络技术已被广泛研究并应用于轴承振动等工业数据的异常检测问题上,但仍存在着训练数据量大、网络参数初始化、训练效率较低、异常检测效果较差等问题。为解决上述问题,提出了一种结合马氏距离和自编码网络的异常检测方法。利用轴承振动数据特征之间具有一定相关性的特点,通过数据的马氏距离快速检测出部分异常数据,减少了自编码网络的训练数据量;用自编码器结合分类器构建自编码网络,解决了网络参数初始化问题并且显著提高了训练效率;将数据的马氏距离作为特征加入训练中提升了自编码网络的异常检测效果;在自编码器中加入稀疏性限制并构造先升维再编码的结构,增强了自编码器的特征学习能力和收敛性。实验结果表明,针对低维轴承振动数据,提出的方法较其他异常检测方法具有较好的检测效果且具有一定的稳定性和泛化能力。
  • 基于知识图谱卷积网络的双端推荐算法
    李想, 杨兴耀, 于炯, 钱育蓉, 郑捷
    知识图谱(KG)提供了一种数据结构来生成基于内容和协同过滤的混合推荐,但现有的基于知识图谱推荐方法对用户属性信息的考虑少于对物品属性的考虑,针对这一问题,提出了基于知识图谱卷积网络的双端推荐算法(DEKGCN)。该算法用知识图谱中每一个实体邻域的抽取样本作为其高阶接受域,用数据集中用户的相关属性作为其一阶接受域,在计算给定实体和用户的表示时分别结合各自的邻域信息,最后得到用户对物品的偏好概率。用户端和物品端的多种信息被用来学习用户和物品的向量表示,有效解决了数据稀疏和冷启动问题。在真实数据集上的实验结果表明,DEKGCN与其他基准模型相比推荐质量有较大提升。
  • 基于重构误差的同构图分类模型
    蒋光峰, 胡鹏程, 叶桦, 仰燕兰
    目前深度学习方法应用于图分类模型的重点集中在将卷积神经网络迁移到图数据领域,包括重定义卷积层和池化层。卷积操作泛化到图数据上是有效的方法,但无论是卷积还是池化都存在较大的改进空间,尤其是在提取网络拓扑结构信息方面。提出一种基于重构误差的同构图分类模型,一方面利用改进的同构图卷积网络WaveGIC增强提取拓扑结构信息能力;另一方面利用多重注意力机制表征全图,使得模型能够关注关键节点信息。由于网络加深过程,局部拓扑结构的特征表达越来越不明显。在分类损失基础上添加重构误差损失,使分类器同时考虑图的节点特征和拓扑结构。在基准数据集上的实验结果表明,提出的方法具有较高的图分类准确度。
  • 面向多分类自闭症辅助诊断的标记分布学习
    章枫叶欣, 王骏, 贾修一, 潘祥, 邓赵红, 施俊, 王士同
    自闭症谱性障碍(ASD)是一系列复杂的神经发展障碍性疾病,其包括若干与发育障碍相关的疾病,但是现有的自闭症辅助诊断方法大多是二分类方法,无法满足现实的需要。此外,ASD数据包含的标记噪声,以及高维度、数据分布不平衡等特点给传统分类方法带来了巨大的挑战。为此,提出一种新型的ASD辅助诊断方法,该方法通过引入标记分布学习(LDL)来解决标记噪声问题,引入代价敏感机制来解决样本不平衡问题,并采用基于支持向量回归(SVR)的标记分布学习方法,通过将样本映射到特征空间,解决高维特征带来的分类困难,最终实现多分类ASD的辅助诊断。实验结果表明,与已有方法比较,所提方法克服了多数类和少数类对结果的影响的不平衡性,可以有效地解决ASD诊断中的不平衡数据问题,拥有更好且稳定的分类性能,可以辅助ASD的诊断。
  • 基于贪心选择及斜率探测扩充的轨面提取方法
    曹义亲, 刘龙标, 何恬, 丁要男
    传统的钢轨表面区域提取方法不同程度存在需要预先给定轨面宽度、假定轨面在轨道图像中央和手动选取边界等前提条件,且存在自适应性差,光照敏感,无法在轨头圆角处存在尘泥等噪声时将轨面完整提取等问题。针对上述问题,提出了一种基于YUV空间的贪心算法选择及斜率探测扩充的轨面区域提取方法。首先将RGB轨道图像转化到YUV空间,提取其V分量,减弱环境光照以及噪声的干扰;其次绘制V分量的灰度投影反转曲线,利用该曲线灰度均值和中值进行候选轨面区间划分;随后利用贪心算法求出划分后曲线中的最大子序和区间,进行轨面粗提取;最后利用斜率探测扩充法进行轨面精提取,在粗提取的边界两侧进行一定距离的斜率探测,用偏转角大于设定阈值的中间位置更新轨面边界。实验结果表明,该方法可以精准快速地提取轨面区域,平均精度达0.929 6,准确率达96.67%,平均时间为25.96 ms,具有一定实用价值。
  • 协同级联网络和对抗网络的目标检测
    李志欣, 陈圣嘉, 周韬, 马慧芳
    识别多尺度目标和遮挡目标是目标检测中的重点和难点。为了检测不同大小的目标,目标检测器通常利用卷积神经网络(CNN)的多尺度特征图层次结构,然而这种自顶向下的结构由于底层特征图的卷积层较小,缺乏获取小目标特征所需的细节信息,这些目标检测器的性能受到了限制。为此,结合Faster R-CNN框架提出Collaborative R-CNN,设计了一种级联网络结构,可以融合多尺度特征图,以生成深度融合的特征信息来增强小目标所需的细节特征,从而提高检测小目标的能力。此外,由于使用RoIPooling过程中的量化会对小目标检测造成极大的限制,为进一步提高方法的鲁棒性,设计了多尺度RoIAlign来消除这种量化,并通过多尺度的池化来提高网络检测不同尺度目标的能力。最后,将对抗网络与所提出的级联网络相结合,生成包含遮挡目标的训练样本,可显著提高模型的分类能力和识别遮挡目标的鲁棒性。在PASCAL VOC 2012和PASCAL VOC 2007数据集上的实验结果表明,提出的方法优于许多先进的方法。
  • 改进YOLOv5的交通灯实时检测鲁棒算法
    钱伍, 王国中, 李国平
    交通灯检测算法作为自动驾驶任务中的一个重要环节,直接关系到智能汽车的行车安全。因为交通灯尺度小且环境复杂,给算法研究带来了困难。针对交通检测存在的痛点,提出改进YOLOv5的交通灯检测算法。首先使用可见标签比确定模型输入;然后引入ACBlock结构增加主干网络的特征提取能力,设计SoftPool减少主干网络的采样信息损失,使用DSConv卷积核减少模型参数;最后设计了记忆性特征融合网络,高效利用了高级语义信息和底层特征。对模型输入和主干网络的改进,直接提高模型在复杂环境下对特征的提取能力;对特征融合网络的改进,使模型能够充分利用特征信息,增加对目标定位和边界回归的精准度。实验结果表明,改进后的方法在BDD100K数据集上取得了74.3%的AP和111 frame/s的检测速度,比YOLOv5提高11.0个百分点的AP;在Bosch数据集上取得了84.4%的AP和126 frame/s的检测速度,比YOLOv5提高9.3个百分点的AP。鲁棒性测试结果表明,改进后的模型在各种复杂环境中对目标的检测能力都有显著提升,鲁棒性增加,做到了高精度实时检测。
  • 一致性约束的半监督多视图分类
    刘宇, 孟敏, 武继刚
    由于传统半监督模式下的多视图算法很少考虑到不同视图中数据包含信息的差异性,且忽视了不同视图间存在着空间结构的一致性,算法在含有噪声和异常点的多视图数据中性能较差。尽管有研究者已经提出了半监督多视图方法,但这些方法没有充分利用样本判别信息以及不同度量学习下的子空间结构信息,从而导致分类结果不理想。针对以上问题,提出了一致性约束的半监督多视图分类算法(SMCC)。首先,基于希尔伯特-施密特独立性准则(HSIC)加强对不同视图之间的一致性约束。然后,通过保留原始数据的空间局部流形结构进行特征投影来降低数据空间维度,并结合F范数约束提高算法的鲁棒性。进一步,对不同视图自适应地赋予相应的权重,降低在不同视图中数据含有不同特征信息与噪声污染的影响。最后,基于线性交替方向乘子法与特征分解方法对模型进行求解。在四个基准数据集上的实验结果表明,提出的算法能够捕获多视图数据中更多的有效判别信息,准确性得到了提高。
  • 融合TWD与FRS的隐性知识转移研究
    张建华, 李方方, 刘艺琳, 杨岚
    面对日益丰富的知识资源,低成本、高精度的知识转移机理能够支撑知识服务型组织为知识用户提供良好知识服务、实现知识资源有效配置及提高知识资源利用率。以隐性知识为研究对象,针对知识本身的特性,提出基于三支决策的隐性知识转移模型。该模型主要包含三部分:用户知识需求与既有知识资源的匹配;根据转移成本确定决策阈值$\left( \alpha,\beta \right)$;根据决策阈值确定隐性知识转移的划分区域“转移”“不转移”和“延迟转移”。实证结果表明,与既有方法相比,提出的基于三支决策的隐性知识转移模型通过对转移区域的细分,降低了因错误分类而产生的知识转移成本;同时,根据视图相似度确定决策区域,提高了知识转移的准确性。
计算机科学与探索封面

中文名称:计算机科学与探索

杂志社官网:http://fcst.ceaj.org/

英文名称:Journal of Frontiers of Computer Science and Technology

语言:中文

类别:自动化技术、计算机技术

主 编:周志华

创刊时间:2007

出版周期:月刊

国内刊号:11-5602/TP

国际刊号:1673-9418

出版地:北京市

咨询工作人员

联系我们

  • 地址:北京市海淀区北四环中路211号
  • 电话:(010)89056056
  • E-mail:fcst@vip.163.com