计算机辅助设计与图形学学报杂志

计算机辅助设计与图形学学报杂志2019年第12期

  • 深度跨模态环境声音合成
    程皓楠, 李思佳, 刘世光
    随着计算机图形学技术的不断发展,用户对视频及动画的声音质量提出了更高的要求.针对现有方法中存在的算法复杂度高,可扩展性不强等问题,提出一种基于CGAN和SampleRNN的深度学习的环境声音合成算法,采用VGG网络模型提取视频深度特征.并将视频深度特征通过一个时序同步网络模型,实现具有更高同步性的视频到音频的跨模态特征转换;通过音色增强网络模型对合成声音的音色进行增强,以提高网络结构的可扩展性,并得到最终与视频同步的、真实感较强的环境声.通过对音视频跨模态数据集中12类不同类别视频进行训练与测试,结果的主观与客观评价表明,文中算法所生成的结果真实感强,提高了现有算法的可扩展性.
  • 基于联合特征映射的端到端三维模型草图检索
    白静, 孔德馨, 周文惠, 王梦杰
    在草图-三维模型检索任务中,草图具有类内多样性,三维模型具有复杂性,且草图-三维模型之间存在巨大的域间的差异性,这些特点的相互作用使得基于草图的三维模型检索任务变得特别困难.针对这一问题,提出一种基于联合特征映射的端到端三维模型草图检索框架.首先将三维模型转化为一组二维视图,建立跨域数据的共享数据空间;然后通过网络权值共享,建立端到端的三元度量学习网络,实现跨域数据草图和视图的联合特征映射;最后基于联合特征分布,提出4种草图-三维模型相似评价算法来实现草图-三维模型的检索.在大型公共数据集SHREC2013和SHREC2014上的检索精度分别为81.8%和75.6%,比现有算法在7项检索指标PR曲线,NN,FT,ST,E,DCG和MAP上都有所提升,检索性能突出.
  • 多层次优化的网格曲面离散样条曲线设计方法
    宋滢, 金耀, 何利力
    为同时满足鲁棒性、高效性以及广泛适用性等要求,提出一种基于多层次优化的网格域样条曲线设计方法.该方法放松了曲线严格位于曲面的约束,仅将曲线的离散控制点置于流形空间,并采用内点法的思想,运用基于块坐标下降法的全局优化方法进行数值求解,最后借助局部参数化将曲线段映射到网格曲面.在此基础上,文中提出由粗到细的多尺度层次求解策略,不仅能够更为准确地估算离散微分算子,提高求解精度,而且能够减少挪动采样点的计算量,提升求解效率.收敛性分析实验表明,多层次优化方法能够快速收敛,并在多尺度策略下获得更为光滑的结果.和现有的投影法和光顺法相比,该方法效率更高,且在可控性、普适性和鲁棒性上均表现出一定的优势.
  • 移动视点视频的平面检测与跟踪
    刘艳丽, 李志明, 赵晓莹, 邢冠宇
    针对广泛存在的建筑物场景,提出了一种基于视频的平面检测与跟踪算法.算法分为3步,给定初始帧图像中的平面边界,第1步通过相邻2帧图像间的单应性矩阵跟踪平面边界,由于单应性矩阵跟踪会导致累积误差,首先采用RANSAC算法拟合边界线段,再使用绝对二次曲线约束和LM算法优化平面边界.第2步检测新出现的平面,根据原平面边界是由两组不同的平行线段组成提取该平面外围的第三类平行线段,由此判断是否有新的平面出现并检测新平面边界.第3步在检测到新平面边界后跟踪当前帧的所有平面到下一帧,当新出现的平面区域有增加或减少时,根据同一平面材质相似这一信息使用漫水填充和图像分割更新平面边界.最后,采用5个真实场景进行了实验,结果表明,文中算法能准确、稳定地在线检测与跟踪视频中的平面边界.
  • 面向坦克火控系统的多尺度形变目标检测方法
    戴文君, 常天庆, 张雷, 杨国振, 郭理彬
    坦克火控系统图像目标检测技术是实现坦克火控系统自主打击的重要基础.针对坦克火控系统图像目标检测任务,建立了一个包含不同目标类型、尺度、形变、光照、遮挡、气象等条件的坦克火控系统图像数据集TKHK,可以为不同目标检测方法的评价提供依据.提出一种多尺度形变目标检测方法,首先采用可形变卷积改进的ResNet-101-deformable网络以及可形变ROI池化提高对形变目标的检测能力;其次在不同分辨率的卷积特征图上提取建议区域,并在检测子网络中通过自适应特征融合机制对特征进行融合,提高对多尺度目标的检测效果;最后结合在线难例挖掘、Soft-NMS以及多尺度训练等多种设计与训练方法,文中方法在TKHK上取得较好的检测效果,能够更好地满足装备实际应用需求.
  • 结合并行特征传递深度学习网络的矿井行人检测
    卫星, 张海涛, 陆阳, 石雷
    矿井行人检测是实现机车无人驾驶的关键技术之一,传统视觉特征提取算法无法有效地应对矿井巷道环境复杂、照明恶劣等问题.为此提出了一种基于并行特征传递的矿井行人检测深度学习网络,以保证检测的高准确率与强实时性.首先阐述了网络的结构,包括并行工作的行人辨识模块和行人定位模块,以及两者之间的特征传递块;其中行人辨识模块粗略调整锚点框位置与大小且过滤负锚点,行人定位模块进一步提升回归精度并给出预测结果特征,传递块将行人辨识模块的不同层的特征转换成行人定位模块所需特征.其次采用数据集扩增、数据增强和难例挖掘等措施优化训练过程.最后给出基于安徽桃源与新集矿井采集视频的实验结果.实验数据表明,所提算法以37帧/s的实时处理速率,其平均精度仍可保持63.4%,与YOLOv1算法相比,平均精度提高9.2%,与M2Det算法相比,提高22帧/s.
  • 结合空间-光谱调制及图像分割的多光谱图像融合方法
    焦姣, 吴玲达, 王朴军
    为了进一步提高多光谱(MS)图像与全色(PAN)图像之间的融合质量,平衡空间细节的注入与光谱信息的保持,提出了一种基于局部自适应空间-光谱调制与图像协同分割的融合方法.该方法利用k-means算法、根据MS图像的光谱特性进行图像分割,得到不同的连通体组,进而基于局部连通体组构建了局部自适应光谱调制(LASpeM)系数和局部自适应空间调制(LASpaM)系数,分别对融合图像中的光谱与空间信息进行调制;其中,LASpeM系数的构建基于MS和PAN图像中的细节提取以及MS波段之间的光谱关系,LASpaM系数的构建则基于MS和低分辨率PAN图像之间光谱特性的局部差异及相关性.另外,引入融合与分割的协同思想,利用图像分割来优化融合结果,并根据融合结果的反馈信息对分割算法的参数进行调整.在Matlab环境下,采用2个卫星GeoEye-1和QuickBird数据集进行融合实验,结果表明,文中方法在主观视觉与客观评价指标方面总体上优于7种经典及流行的融合方法,能够平衡融合图像的空间信息注入和光谱信息保持,有效地减少光谱扭曲.
  • 采用条件生成式对抗网络的缺损牙全冠修复技术
    袁福来, 戴宁, 田素坤, 张贝, 孙玉春, 俞青, 刘浩
    针对传统手工修复缺损牙治疗周期长,牙科CAD系统修复缺乏个性化的问题,提出一种结合条件生成式对抗网络和高维特征损失约束的全冠咬合面个性化设计方法.首先,通过计算三维牙齿曲面深度信息,获取患牙预备体及其他条件模型的二维深度图并构建数据集;其次,以对颌牙条件数据作为咬合关系约束,同名对称牙冠数据作为形态辅助信息,利用构建的网络模型实现预备体数据向目标牙冠数据的空间映射;然后,将生成的牙冠深度图重建为三维网格模型,完成缺损牙的形态重建;最后,选取部分患牙模型进行实验测试,分析了不同约束条件对生成的牙冠咬合面形态的影响,对比了不同修复方法重建牙冠的质量.结果表明,该方法能够高效、个性化地重建全冠咬合面的解剖特征,满足缺损牙功能性修复的设计要求.
  • 低照度图像自适应颜色校正与对比度增强算法
    李庆忠, 赵峂, 牛炯
    光照变化会造成图像颜色失真和清晰度的下降,为了使计算机视觉系统具有颜色恒常感知功能,提出了一种基于极限学习机和杜鹃搜索算法的图像颜色校正与对比度增强算法.首先对于输入图像,提取该图像的17维特征向量,并利用训练好的极限学习机神经网络自适应地选择适合该图像的最佳颜色恒常算法,并进行相应的颜色校正;然后,针对图像的亮度分量,利用杜鹃搜索算法自动确定亮度增强函数的最优参数,并进行相应的对比度增强.基于Funt数据集的实验结果表明,文中算法不仅能有效地完成图像颜色校正,还能自适应地提高图像的信息量和对比度,获得图像颜色和对比度的综合最佳视觉质量.
  • 结合稀疏八叉树卷积神经网络的牙齿预备体颈缘线提取方法
    张贝, 戴宁, 田素坤, 袁福来, 俞青
    针对传统手工提取牙齿预备体颈缘线需要交互标记特征点,操作复杂,效率低的问题,提出了一种基于稀疏八叉树的卷积神经网络自动提取牙齿预备体颈缘线的方法.首先利用稀疏八叉树的空间划分,牙齿预备体模型被预处理为带有标签信息的稀疏点云,构建牙齿预备体数据集;其次利用已训练的卷积神经网络模型将牙齿预备体点云分割为2部分;然后采用密集条件随机场优化分割点云的边界,再将边界点拟合及插值获取新的边界点集;最后连接边界点在预备体模型上对应的投影点形成牙齿预备体颈缘线.在牙齿预备体数据集上的实验结果表明,卷积神经网络模型的预测准确率达到97.23%,通过对该方法提取的预备体颈缘线与专业医生提取的颈缘线之间的曲线偏差进行对比分析,验证了该方法的有效性.
  • 基于区域判别与信息反传的车辆精细定位方法
    公绪超, 李宗民, 李冠霖, 李华
    伴随智能交通图片数据爆炸式增长,交通大数据车辆精确定位管理需求增加.针对SSD(single shot multibox detector)检测算法对小目标定位不稳定与距离弥散导致的车辆定位偏差问题,提出了一种端到端的车辆及内部细节定位方法.包括引入无效目标过滤机制,以有效地抑制定位偏差;添加区域位置信息反传层,共享低卷积层局部特征,扩大小目标局部感受野,有效地进行车辆内部细节定位.采用PASCAL VOC2007数据集进行的实验结果表明,文中方法达到了良好的效果.
  • 基于动态多任务平衡方法的行人属性识别深度学习网络
    孙志勇, 叶俊勇, 汪同庆, 雷莉, 连捷, 李阳
    深度学习网络是计算机视觉和人工智能系统的研究热点之一,行人属性识别提供了结构化的行人特征,为安防计算机视觉识别中行人检索提供了重要的信息.基于深度学习网络,提出了一种端到端的多属性识别方法,在R*CNN的基础上设计了一个端到端的行人属性识别网络,使用候选区域提取网络代替Selective Search提取第二重要的区域,建立属性识别与辅助区域提取一体化的网络,提升局部及细节属性识别的准确率;其次,为增加辅助区域的作用,将人体感兴趣区域按比例划分为整体、头、肩膀到腰及腰到脚4个部分,每个部分对应了不同属性,在任务分支层分出4个分支,使用主要区域预测对应属性的同时,分别从RPN中学习到对应的第二重要区域辅助预测;最后,提出了基于损失梯度的损失权值自动更新方法,即权重与损失的梯度逆相关,防止某个任务训练的过快或过慢.通过在行人属性数据库进行实验,整体提升了属性预测的准确率,大大缩短了识别时间.
  • 仿人足球机器人快速多目标识别方法
    吴峰华, 杨哲海, 张玉萍, 王昊, 刘实, 尹竞瑶, 金鑫, 王承业, 盖宇
    针对全自主仿人足球机器人在自身动态特性显著和比赛场地复杂环境条件下快速准确识别多种目标物的要求,采用融合形态学分析的类Haar特征构造热图的方法对机器人视域内的疑似目标物进行粗略选取,形成“感兴趣区域”.再构造轻量级Tiny-DNN卷积神经网络对“感兴趣区域”进行快速分类,准确判断这些区域是否包含目标物.机器人运行过程中自动生成的大量“感兴趣区域”作为卷积神经网络的离线训练过程正负样本集,避免了在海量图片上人为标注目标物样本的大量工作与耗时及不确定性偏差.该方法应用于搭载CPU处理器的SYCU-Legendary仿人机器人,使其能够在0.03 s内对于目标物足球、球门柱和罚球点的识别率分别达到95.8%,96.2%和96.0%.目标识别过程受比赛场地异物和光线变化影响较小,夺得了2018年和2019年足球机器人世界比赛(RoboCup)中国赛区冠军.实际应用结果表明该方法具有较高的推广应用价值.
  • 基于SysML的复杂机电系统设计模型形式化扩展与验证
    曹悦, 刘玉生, 赵建军, 叶晓平, 周书华
    形式化系统验证是保证系统设计正确性的一种重要手段.如何针对复杂机电系统物理与软件相融合的特征,对系统设计的动态特征进行验证,是系统验证研究领域亟待解决的问题.针对这一问题,对系统工程标准建模语言SysML进行扩展,提出了一套形式化系统模型验证方法.首先,以计算树逻辑和基于流的功能表示为形式化基础,形成基于SysML的系统功能建模方法;然后,以混合自动机为基础,建立基于SysML的系统行为建模方法;最后,针对物理与软件子系统的不同动态特征,借助NuSMV模型校验器,以层次化方式实现系统模型的自动验证.以移动机器人系统为例,展示了复杂机电系统设计模型的自动验证过程.
  • 三维装配模型共性结构发掘方法
    乔虎, 何俊, 安嘉祥, 向颖
    为了更好地利用三维装配模型可重用的共性结构信息,减少重复性的劳动,缩短产品的开发周期,提出一种三维装配模型共性结构发掘方法.首先,以三维装配模型各零件的属性邻接图为基础,保持装配特征属性信息,简化非装配特征属性信息,形成属性化装配特征邻接图;然后,基于三维装配模型各零件之间的装配关系,将零件的属性化装配特征邻接图组合形成三维装配模型属性邻接图;其次,通过频繁子图挖掘算法提取三维装配模型的共性结构.最后,以一组夹具模型为例进行实例验证,结果表明该三维装配模型共性结构发掘方法能够准确有效地发掘产品中的共性结构信息,具有良好的应用效果.
  • 笔式交互和触摸交互的融合策略
    李岩, 杨慧敏, 辛义忠
    针对笔输入能力弱和触摸输入精度低的问题,提出笔式交互与触摸交互的融合策略,并设计了笔+触摸输入技术.首先定性考察笔输入和触摸输入的特性和优劣势,提出2种笔+触摸输入的融合策略;其次基于融合策略设计3种笔+触摸输入技术以及用于参照对比的单笔和单触摸输入技术;再通过3个实验比较这些输入技术的性能.实验结果表明,与单笔或单触摸相比,在颜色改变的直线轨迹任务中,笔+单指触摸、笔+多指触摸和笔+触摸手势的性能分别提升至少90.909%,80.165%和148.209%;在颜色和粗细均改变的圆形轨迹任务中,笔+触摸和笔+手势的任务完成时间比单笔分别减少16.552%和19.705%,而错误率不存在显著差异;在颜色和粗细均改变的绘画任务中,笔+单指触摸、笔+多指触摸和笔+触摸手势的综合指标分别为5.933,3.333和4.700.最后给出面向笔+触摸输入的交互设计建议、应用场景和改进思路,对笔和触摸的混合输入与界面设计具有指导意义.
  • 具有关键路径检测功能的脉冲触发器电路及应用
    石瑞恺, 王昊, 杨梁, 章隆兵
    由于在实际生产和工作过程中受到多种复杂因素的影响,集成电路的关键路径会发生不确定的变化.这导致时序分析结果出现较大偏差,芯片的硅前-硅后一致性难以保证.为此,提出一种具备关键路径检测功能的脉冲触发器电路.该电路复用功能模式下的冗余锁存器作为影子锁存器,并在其数据输入端插入额外的传播延迟,使2个锁存器具有不同的建立时间裕量;再通过比较2个锁存器的采样值差异实现关键路径检测功能.HSPICE仿真结果表明,该电路实现了脉冲触发器的基本功能并且能够有效地检测出关键路径;与其他几种设计相比,该电路的面积开销较小且具备显著的功耗优化手段.最后,给出该电路的集成使用流程,使之应用到物理设计中.
计算机辅助设计与图形学学报封面

中文名称:计算机辅助设计与图形学学报

杂志社官网:https://www.jcad.cn/

英文名称:Journal of Computer-Aided Design & Computer Graphics

语言:中文

类别:自动化技术、计算机技术

主 编:胡事民

创刊时间:1989

出版周期:月刊

国内刊号:11-2925/TP

国际刊号:1003-9775

出版地:北京市

咨询工作人员

联系我们

  • 地址:北京市海淀区中关村科学院南路6号
  • 电话:010-62562491
  • E-mail:jcad@ict.ac.cn