前言
机器学习是一门从数据中研究算法的科学学科,它是人工智能的核心,是使计算机具有智能的根本途径,其应用遍及人工智能的各个领域。
计算机视觉是一门研究如何使机器“看”的科学,具体指用摄像机和计算机代替人眼对目标进行识别、跟踪和测量等,并用计算机处理为更适合人眼观察或传送给仪器检测的图像。
计算机视觉与图像处理、图像分析、机器人视觉和机器视觉彼此紧密关联,但也存在以下区别。
(1) 图像处理: 旨在处理原始图像以应用某种变换,目标通常是改进图像或将其作为某项特定任务的输入,典型的操作如降噪、对比度或旋转,可在像素层面执行,无须全面了解图像; 而计算机视觉的目标是描述和解释图像。
(2) 机器视觉: 主要指工业领域的视觉研究,如自主机器人的视觉、用于检测和测量的视觉。该领域通过软件和硬件,使图像感知与控制理论往往和图像处理紧密结合,以实现高效的机器人控制或各种实时操作。
为什么在众多的编程语言中选择Python编写计算机视觉与机器学习呢?原因在于:
(1) 开放性和易用性。Python语法简洁易懂,代码可读性高,降低了开发的难度和成本,即使是初学者也能快速上手。
(2) 具有跨平台特性。Python可以在不同的操作系统上运行,这为开发者提供了极大的便利,能在各种环境下自由开发和部署计算机视觉与机器学习项目。
(3) 市场需求大。近年来,计算机视觉技术已广泛渗透人们生活的方方面面,如地铁的安防摄像头、火车站和飞机场的人脸识别闸机、智能手机的人脸识别解锁与支付功能等。
(4) 创业公司和资本众多。近年来,越来越多的公司部署计算机视觉应用,用于解决业务问题或提升产品性能。
本书是一本简单、全面的,以Python为主线,解决各种机器学习与计算机视觉问题的图书,具有如下特点:
(1) 内容浅显全面。本书从各个知识点对Python进行介绍,让读者对Python有简单的认识,并能使用Python。
(2) 简单易懂。本书不会纠缠于晦涩难懂的概念,而是力求用浅显易懂的语言引出概念,用常用的方式介绍编程,用清晰的逻辑解释思路。
(3) 实用性强。书中每章都做到理论与实例相结合,内容丰富、实用,帮助读者快速领会知识要点。书中的实例与经典应用具有超强的实用性,并且书中源代码、数据集等读者都可免费、轻松获得。
本书共11章,每章的主要内容包括:
第1章 走进计算机视觉与机器学习,主要介绍计算机视觉、机器学习等内容。
第2章 掀开Python的面纱,主要介绍Python概述、Python环境搭建等内容。
第3章 Python科学计算库,主要介绍数据处理、SciPy库、Pandas库等内容。
第4章 传统图像处理,主要介绍灰度转换、滤波器应用、图像平滑与梯度、形态学变换等内容。
第5章 目标检测,主要介绍目标检测概述、锚框、区域卷积神经网络系列等内容。
第6章 图像分析与修复,主要介绍傅里叶变换、积分图、图像分割等内容。
第7章 特征点检测与匹配,主要介绍角点检测、特征点检测、特征点匹配等内容。
第8章 OpenCV与机器学习,主要介绍OpenCV与传统机器学习、OpenCV的机器学习、k均值聚类算法、肘部法则等内容。
第9章 立体视觉,主要介绍立体视觉概述、视觉测距等内容。
第10章 视频分析,主要介绍视频分析概述、背景减除法、传统视频跟踪、光流法等内容。
第11章 深度学习实现计算机视觉,主要介绍核心概念与联系、卷积神经网络、迁移学习等内容。
本书由佛山大学杨光光编著。
本书主要面向Python初学者、研究Python软件的科研者。
由于时间仓促,加之作者水平有限,疏漏之处在所难免。在此,诚恳地期望各领域的专家和广大读者批评指正。
编者
2026年6月
