登录社区云,与社区用户共同成长
邀请您加入社区
随着技术的发展,多模态,3D,视频生成这三个领域不断融合,由NUS PHD团队共创多模态图像知识库,涵盖多模态综述,多模态工程化工具和平台,产品生成形式,以及商业化产品。点击链接获取完整文档。
陌讯多模态算法破解智慧油站识别难题,通过可见光+红外+激光多源融合,实现全天候精准检测。其核心技术包括光照不变性变换(夜间mAP提升32.6%)、时空注意力机制和轻量化部署(模型体积仅15MB)。某沿海油站实测显示,车牌识别准确率从78%提升至99.1%,年运维成本降低120万元。相比主流框架,陌讯v3.2在低光照性能和雨雾场景下优势显著(误检率仅4.2%)。方案支持动态照明补偿和模型热切换,有效
摘要:陌讯多模态融合算法显著提升静电服识别性能,在复杂工业场景中实现误报率↓75%。针对传统系统35%的误报率、28%漏检率及100ms+延迟等痛点,该架构融合可见光与红外特征,采用GCN处理遮挡问题,实测mAP达0.913,误报率仅7.3%,推理延迟42ms。某晶圆厂部署后误报率从35.2%降至7.3%,单路功耗5.8W。支持INT8量化(精度损失<1%)和光影模拟增强,有效解决工业场景的
《高密度场景漏检率↓82.7%!陌讯多模态融合算法优化聚众识别》摘要:针对公共安防场景中人群密度检测漏报率高(峰值达35%)的痛点,陌讯提出基于时空特征聚合的多模态融合算法。通过动态权值机制(光照突变时热力特征权重提升至0.83)和三级置信度分级,在Jetson Xavier设备实现mAP@0.5达0.882、推理延迟47ms。实际部署显示,地铁场景高峰漏检率从38.2%降至6.6%,RK3588
《多模态算法革新车站安防:漏报率骤降75%》摘要:针对车站等高密度场景聚众识别难题,陌讯提出光流-姿态多模态融合方案,通过三阶处理流程实现精准检测。实测显示,该算法在Jetson Nano平台达到mAP@0.5=87.6%,漏报率从42.1%降至7.3%,延迟仅48ms。方案包含INT8量化等工业级优化,使模型体积缩减65%同时保持精度损失<1%。该技术有效解决了传统方案在高密度遮挡、行为误
【复杂场景精准识别】针对电动车头盔检测中的雨雾干扰、误报率高等痛点,陌讯视觉算法通过多模态融合架构与动态稀疏卷积技术,实现mAP@0.5达94.7%的精度突破。实测某市交警系统落地中,误报率降低82%,边缘端推理时延仅13ms。
本文解析了陌讯水文感知架构的创新方案,针对传统水位监测存在的强反射干扰(夜间误报率35%)、暴雨遮挡(漏报率28%)等痛点问题。该方案采用三阶融合处理流程,通过多模态特征聚合公式实现光照自适应补偿,核心算法在Jetson边缘设备上实现mAP0.903、功耗仅6.3W的优异表现。某流域实测显示暴雨误报率降低82.5%,水位标定精度提升82.4%。文章还提供了INT8量化(模型体积缩减73%)和水文数
陌讯多模态融合算法显著提升非机动车识别性能,在边缘计算设备上实现mAP@0.5达89.1%,较基线提升28%。该方案通过偏振特征增强、HDR补偿等技术有效解决强光/逆光等复杂场景识别难题,使小目标识别率提升46.1%,早晚高峰漏检率降低85.3%。同时提供INT8量化等边缘部署优化方案,内存占用减少60%且保持精度损失<0.5%。实测数据表明,该技术可显著提升智慧交通场景下的非机动车识别准确