登录社区云,与社区用户共同成长
邀请您加入社区
本文介绍了如何在星图GPU平台上自动化部署ViT图像分类-中文-日常物品镜像,构建多模态目标识别系统。该系统结合了YOLOv5的目标检测与ViT的精细分类能力,可应用于智能安防、内容审核等场景,实现对图片中日常物品的精准识别与分类,显著提升识别粒度与准确性。
一套基于YOLOv11深度优化的双通道目标检测工具,专为同步处理红外(IR)与RGB图像设计。内置双流特征融合模块,支持端到端训练和单图快速推理,预置已训练多模态权重文件(multi_det.pt)。提供完整数据预处理流程,兼容自定义配对的IR+RGB数据集;附带全场景部署支持:涵盖Jetson系列(适配JetPack 4/5/6)、CPU、Conda及标准CUDA环境,所有Dockerfile均