成为第一个分享这门课真实体验的人。
来自官方课程资料的结构化信息
课程代码
DSAI5209
课程名称
Visual Data Representation and Processing
开课学系
dsai
所属学院
Faculty of Engineering
学分
3 学分
级别
5
课程简介
1. 图像和视频表示 常见的视觉数据增强方法和表示格式,采样与量化,视觉数据插值和帧分辨率增强方法,失真测量,率失真理论 2. 颜色和音频表示 颜色和音频基础知识,CMY和CMYK颜色模型,RGB和HIS表示,颜色模型与处理 3. 视频压缩基础 无损预测编码,基于离散余弦变换和小波编码的有损视觉数据压缩,视频中的颜色模型与表示,压缩技术,JPEG、MPEG等标准 4. 视频处理 块基运动估计,2D对数搜索,分层搜索,视频编码标准,前向和双向预测,图像组,视频传输与显示顺序 5. 视频中的目标检测 边界框,目标检测性能指标如交并比、精确率、召回率等,常用的目标检测模型如YOLO或SOLO,以及基础模型如SAM或SE,语义分割 6. 图像和视频内容保护 用于权利保护和监控的视频水印,空间和频域技术,内容识别与安全
学习目标
1. 为学生提供视觉数据表示、编码和压缩技术的基本知识 2. 为学生提供广泛视觉数据保护和安全技术的知识 3. 训练学生应用高级AI技术处理视觉数据
先修要求
无
教学模式
课程材料将以讲座、辅导和小组项目的形式进行讲授。学生将熟悉视觉数据处理的基本概念和技术及其应用。