国内刊号:37-1391/T
国际刊号:1672-3961
发布日期:
作者:聂秀山,巩蕊,董飞,郭杰,马玉玲
单位:1.山东建筑大学计算机科学与技术学院, 山东 济南 250101;2.山东师范大学新闻与传播学院, 山东 济南 250358
关键词:视频场景,特征表示,短视频场景分类,多模态融合,深度学习,
基金:国家自然科学基金资助项目(62176141,62176139,61876098);山东省杰出青年自然科学基金资助项目(ZR2021JQ26);山东省自然科学基金资助项目(ZR2021QF119)
传统的视频场景分类方法习惯于从视觉模态中提取表现图像场景的特征,结合支持向量机等有监督学习方法,实现对某些类别的场景分类。随着各种短视频在各大平台迅速涌现,基于短视频特性的场景特征表示越来越受到研究者们的关注。由于短视频数据具有噪声、数据缺失、各模态语义强度不一致等问题,导致传统的视频场景表征方法无法学习具有丰富语义的短视频场景表征。近年来,部分短视频场景分类的研究考虑上述挑战,并提出相应的方法。本研究综述短视频场景分类的研究现状,介绍短视频场景特征表示和分类方法,对不同数据集上的场景分类方法进行分析。针对现有方法存在的问题,分析未来短视频场景分类中需要解决的挑战性问题。
来源:2024年第3期
《山东大学学报(工学版)》期刊编辑部