前言
近年来,人工智能理论与技术无论在学术研究还是在实际应用中,都得到了广泛关注,成为当今信息科技的发展潮流。但同时,诸如自动驾驶、AIGC等人工智能应用中发生了一系列安全事件,引发了人们对人工智能应用前景的担忧。由此,人工智能安全被提上了重要议程,业界加快了人工智能安全的理论与实践研究,积极推进人工智能监管。从学科发展的角度看,人工智能和网络空间安全存在密切的联系。一方面,人工智能技术有效提升了网络空间安全攻击与防御的智能化水平,网络空间安全对抗必然升级到人工智能对抗; 另一方面,人工智能模型应用越来越多地被发现存在漏洞和安全风险,并成为网络空间安全的新问题。人工智能安全则是这两个学科方向发展和交叉的必然结果。
本书第一版在教育部阿里云产学合作协同育人项目的支持下,对人工智能安全的理论与实践技术进行了全面梳理。第二版对人工智能安全的知识体系做了进一步完善,将机器学习、深度学习、大模型、AIGC等典型场景下的人工智能安全有机融合起来,使得读者能够在统一的思维框架下理解和掌握各种人工智能安全问题和方法。
本书作为一本产学兼顾的教材,具有如下特色:
(1) 创新性地提出并构建了人工智能安全观这一重要认知框架,为识别、理解、评估及应对人工智能应用中各种安全威胁、风险、漏洞及对抗行为提供方法论,有助于读者更深刻地在网络空间应用中理解人工智能安全问题与技术。
(2) 梳理并构建了完整的人工智能安全知识体系,以攻防对抗为主线,充分体现人工智能安全的产生与演进路线。以数据驱动为辅助线索,突出数据在人工智能对抗方法中的作用,这符合数据驱动的人工智能基本范式。
(3) 秉持理论与实践并重的教学指导思想,本书强调人工智能安全的主要模型算法及其基础理论。同时,也提供了基于阿里云天池AI等平台的大量实验案例及其Python代码。
本书的知识体系划分为五部分,即人工智能安全概述、人工智能应用与对抗场景、对抗演进中针对AI模型与数据的攻击、对抗演进中针对AI的防御与治理,以及人工智能平台的安全与实验,这五部分的关系如图0.1所示。第一部分阐述了本书所提出的人工智能安全观,是理解人工智能各类攻防方法的基础。第二部分以网络安全和AIGC为典型的应用场景,讲述了人工智能安全中的对抗起点是如何产生的。第三部分和第四部分则分别从攻击和防御的角度,介绍了在人工智能对抗演进中的相关模型、算法和数据处理方法。第五部分介绍了人工智能平台的安全和实验案例。在该知识体系中,数据驱动和攻防对抗是两条重要的线索,对于读者理清不断变化的AI安全技术具有重要意义。
本书作者及其科研团队长期从事网络空间安全、人工智能和大数据技术相关研究、教学工作。在包括国家自然科学基金项目在内的各类科研项目支持下,对网络空间安全防御、互联网内容安全、机器学习模型算法及应用做了大量研究,积累了一定的基础。
图0.1本书的人工智能安全知识体系
全书由曾剑平负责内容规划和编写,第一版得到了教育部阿里云产学合作协同育人项目(2020)支持,第二版的部分案例受复旦大学专业学位研究生特色课程建设项目(2024)的资助。曾剑平课题组的多位研究生参与书中案例程序开发,清华大学出版社的编辑们为本书的出版付出了很多心血。此外,在教材编写过程中,参考和引用了许多论文、技术报告,均已在参考文献中列出。在此,一并表示衷心的感谢。
由于时间仓促以及作者的学识水平限制,并且人工智能安全技术仍在快速发展中,书中难免存在不足之处和疏忽,恳请读者不吝批评指正,以利于再版修订完善。
编者2026年6月
教学相关资源
