关闭

支持现代和未来社会的图像识别AI

我们正在进行研究,帮助计算机理解现实世界,重点是视频图像理解。视频是多模态信息体,不仅包括图像,还包括音频、文本,甚至场景的情况和上下文。我们正在探索让人工智能能够读取和理解这些多样化信息的含义的技术。例如,通过这项技术,可以观看体育比赛的视频,了解谁进球了以及他们踢了什么样的比赛,检查医院检查期间拍摄的图像以确定某人是否生病,或者通过查看监控录像来检查是否有任何异常。我们正在探索结合图像识别、视频分析、机器学习、深度学习、图像生成人工智能等多种技术,利用视频造福社会的新方式。

信息工程学院|教授

玉木彻(玉木彻)

玉木彻

9 让我们为产业和技术创新奠定基础

关键字

图像识别人工智能
计算机视觉
视频图像分析
图像生成人工智能
多式联运

领域/程序

研究类别

人类信息学

研究主题

  • 计算机视觉
  • 图像识别AI/视频图像分析AI
  • 图像生成人工智能/视频图像生成人工智能
  • 深度学习算法
  • 多式联运法学硕士/VLM

留言

图像识别技术(计算机视觉)利用人工智能来确定图像中的内容,用于智能手机上的面部识别和自动驾驶中的行人检测。大量的视频数据仍在社会各个领域使用,但未来结合3D数据和来自多个传感器的信息的新应用将会增加,并且需要更先进的图像识别。数学、概率和统计、信息编程中的矩阵和向量知识以及物理学中的光和传感器知识是实现此目的的必要基础。这些科学研究作为图像识别人工智能应用于事故预防、基础设施管理和医疗支持等广泛领域,有助于提高社会的安全性和便利性。