该杂志刊期列表
- 2026年
- 1期
国内刊号:11-2925/TP
国际刊号:1003-9775
发布日期:
作者:张璐瑶, 杨帅, 汪文靖, 高翔, 刘家瑛
关键词:生成式人工智能, 扩散模型, 图像生成, 视频生成
视觉生成在艺术、娱乐等创意领域, 以及医学影像和数字出版等关键领域起到越来越重要的作用, 生成式人工智能在视觉生成方面的发展有望彻底改变人们与视觉数据的交互方式. 文中首先介绍深度学习时代下经典的生成模型框架, 根据视觉生成输入条件的不同, 重点梳理了近年来几类重要的图像生成模型和方法, 包括无条件图像生成、类别生成图像、文字生成图像和图像转换方法, 并介绍了它们在图像编辑方面的应用;然后根据训练数据要求的不同, 详细总结近年来以扩散模型为代表的视频生成和编辑模型及相应的优缺点;再介绍目前经典的图像生成和视频生成数据集和常用的评价标准;最后总结现阶段视觉生成面临的数据获取、推理效率、长视频生成、视频可控生成、安全等方面的挑战, 展望未来的研究方向.
来源:2025年第3期
《计算机辅助设计与图形学学报》期刊编辑部