南京林业大学学报(自然科学版)

北大核心,CA,JST,CSCD,WJCI

国内刊号:32-1161/S

国际刊号:1000-2006

南京林业大学学报(自然科学版)杂志2025年第4期:基于改进Vision Transformer的森林火灾视频识别研究

发布日期:

作者:张敏,辛颖,黄天棋

单位:东北林业大学机电工程学院,黑龙江 哈尔滨 150040

关键词:森林火灾,深度学习,目标检测,三维卷积神经网络,Vision Transformer

基金:国家重点研发计划项目子课题(2023YFF1304001-02),中央高校基本科研业务费专项资金资助项目(2572015CB05)

【目的】针对现有森林火灾图像识别算法存在的效率不足、时序特征利用率低等问题,构建基于视频数据的森林火灾识别模型,以提升林火监测的实时性与识别准确率。【方法】提出融合三维卷积神经网络(3DCNN)与视觉Vision Transformer(ViT)的C3D-ViT算法。该模型通过3DCNN提取视频序列的时空特征,构建时空特征向量;利用ViT编码器的自注意力机制融合局部与全局特征;最终经MLP Head层输出分类结果。通过消融实验验证C3D-ViT模型的有效性,并与原模型3DCNN和ViT,以及ResNet50、LSTM、YOLOv5等深度学习模型进行对比。【结果】C3D-ViT在自建林火数据集上准确率达到96.10%,较ResNet50(89.07%)、LSTM(93.26%)和YOLOv5(91.46%)具有明显优势。模型改进有效,准确率超越3DCNN(93.91%)与ViT(90.43%)。在遮挡、远距离、低浓度烟雾等复杂场景下保持较高的平均置信度,满足实时监测需求。【结论】C3D-ViT通过时空特征联合建模,显著提升林火识别的鲁棒性与时效性,为森林防火系统提供可靠的技术支持。

来源:2025年第4期

《南京林业大学学报(自然科学版)》期刊编辑部

查看南京林业大学学报(自然科学版)杂志2025年第4期

联系我们

  • 地址:南京市龙蟠路南京林业大学
  • 电话:025-85427076;85428247
  • E-mail:xuebao@njfu.edu.cn,xuebao@njfu.com.cn

咨询工作人员