"系统讲解深度学习时代下计算机视觉的基础理论、关键方法及主流应用。全书分为四部分,由 11 章组成,内容包括: 自然场景文本检测,行人检测,目标跟踪,目标定位,风格迁移,图像/视频生成,文本到图像/视频生成,视觉内容生成的典型应用,深度估计,光流估计,姿态估计。书中对各应用方向均进行了深入的阐述,讲解真实应用场景下的处理方法,并给出具体案例的设计和实现。
可以作为人工智能、计算机、电子信息相关专业本科和研究生的专业课教材,也可以作为人工智能、电子信息、机器人、数字媒体等相关领域从业人员的自学参考书。
"
