目标检测与跟踪
面向复杂交通与低空无人机航拍场景的多尺度目标检测、目标跟踪与计数算法研究。
XINJIANG NORMAL UNIVERSITY · 计算机科学技术学院
教 授 · 博 士 · 硕 士 生 导 师
主要从事计算机视觉、深度学习与图像处理研究,研究方向涉及智能交通、低空无人机视觉与多语种场景理解。 近年来,重点探索多模态大模型(MLLM)驱动的文档智能化与场景解析。 迄今主持国家自然科学基金地区基金项目 3 项, 在 ACM TOMM、JVCIR、Multimedia Tools and Applications 等国际期刊发表论文十余篇。
新疆师范大学 · 昆仑校区数理楼 109 室
围绕视觉智能与多模态理解,面向智能交通、低空无人机感知、文档智能化、教育评估等真实场景, 开展从基础视觉模型到多模态大模型的研究与应用系统研发。
面向复杂交通与低空无人机航拍场景的多尺度目标检测、目标跟踪与计数算法研究。
图像与视频的细粒度解析,支撑场景理解与自动驾驶感知。
面向中文、英文、维吾尔文等自然场景的文本检测与识别,探索大模型驱动的端到端 OCR 与智能检索。
道路交叉口异常事件检测、信号灯配时、车辆计数与测速,以及无人机航拍交通监控等视觉应用系统。
面向低空经济场景的无人机航拍视觉理解:机载小目标检测与跟踪、山区公路智能巡检与行车风险预警。
图像修复、视觉表征学习、跨模态生成与稠密视频描述。
研究多模态大模型(MLLM)的场景理解、视觉问答与文档智能化技术,推动视觉—语言联合推理在真实场景落地。
大语言模型驱动的格式化文本识别、教育数据智能分析与智能体(Agent)应用系统研发。
面向图像、文本与视频的统一表征学习,支持以自然语言描述检索目标的智能检索框架。
| 计划名称 | 项目名称 | 项目来源 | 起止时间 |
|---|
已授权多项代表性软件著作权,覆盖智能交通、多语种文本识别、视频理解与教育智能分析等方向。
在 SCI / EI 收录国际期刊发表论文 13 篇,其中 JCR 一区 3 篇、JCR 二区 8 篇、JCR 四区 1 篇、EI 1 篇。
没有匹配的论文,请尝试其他筛选条件。
新疆师范大学 · 昆仑校区数理楼 109 室
计算机科学技术学院 · 计算机应用系
欢迎计算机视觉、深度学习、多模态大模型、低空无人机视觉、智能交通、多语种文档理解等方向的硕士研究生与同行学者邮件联系,探讨合作研究、研究生招生与学术访问等事宜。