XINJIANG NORMAL UNIVERSITY · 计算机科学技术学院

刘战东 Zhandong Liu, Ph.D.

教 授 · 博 士 · 硕 士 生 导 师

主要从事计算机视觉、深度学习与图像处理研究,研究方向涉及智能交通低空无人机视觉多语种场景理解。 近年来,重点探索多模态大模型(MLLM)驱动的文档智能化与场景解析。 迄今主持国家自然科学基金地区基金项目 3 项, 在 ACM TOMMJVCIRMultimedia Tools and Applications 等国际期刊发表论文十余篇。

  • 4主持项目
  • 13代表性论文
  • 8软件著作权
刘战东 头像

新疆师范大学 · 昆仑校区数理楼 109 室

研究方向 Research Interests

围绕视觉智能与多模态理解,面向智能交通、低空无人机感知、文档智能化、教育评估等真实场景, 开展从基础视觉模型到多模态大模型的研究与应用系统研发。

👁

目标检测与跟踪

面向复杂交通与低空无人机航拍场景的多尺度目标检测、目标跟踪与计数算法研究。

🧩

实例/语义分割

图像与视频的细粒度解析,支撑场景理解与自动驾驶感知。

🔤

多语种场景文字

面向中文、英文、维吾尔文等自然场景的文本检测与识别,探索大模型驱动的端到端 OCR 与智能检索。

🚦

智能交通系统

道路交叉口异常事件检测、信号灯配时、车辆计数与测速,以及无人机航拍交通监控等视觉应用系统。

🚁

低空无人机视觉

面向低空经济场景的无人机航拍视觉理解:机载小目标检测与跟踪、山区公路智能巡检与行车风险预警。

🖼

图像处理与分析

图像修复、视觉表征学习、跨模态生成与稠密视频描述。

🤖

多模态大模型

研究多模态大模型(MLLM)的场景理解、视觉问答与文档智能化技术,推动视觉—语言联合推理在真实场景落地。

💬

大模型智能体应用

大语言模型驱动的格式化文本识别、教育数据智能分析与智能体(Agent)应用系统研发。

🔎

跨模态检索

面向图像、文本与视频的统一表征学习,支持以自然语言描述检索目标的智能检索框架。

主持的科研项目 Funded Projects

计划名称 项目名称 项目来源 起止时间

软件著作权 Software Copyrights

已授权多项代表性软件著作权,覆盖智能交通、多语种文本识别、视频理解与教育智能分析等方向。

代表性论文 Selected Publications

在 SCI / EI 收录国际期刊发表论文 13 篇,其中 JCR 一区 3 篇、JCR 二区 8 篇、JCR 四区 1 篇、EI 1 篇。

    联系方式 Contact

    📮 电子邮箱

    lzd0825@163.com

    🏢 办公地址

    新疆师范大学 · 昆仑校区数理楼 109 室

    🏛 所属单位

    计算机科学技术学院 · 计算机应用系

    🌐 学院主页

    cs.xjnu.edu.cn

    欢迎计算机视觉、深度学习、多模态大模型、低空无人机视觉、智能交通、多语种文档理解等方向的硕士研究生与同行学者邮件联系,探讨合作研究、研究生招生与学术访问等事宜。