第 8 章 计算机视觉 从最基础的像素开始,一路走到目标检测、语义分割、图像生成乃至三维重建——本章覆盖让机器"看懂"世界的全部核心技术。你将理解图像如何在数学上被表示、卷积神经网络如何从像素中自动学到有用的特征、模型如何定位并勾勒每一个物体、生成模型如何凭空创造出逼真的图像,以及机器人如何在时间和三维空间中感知与导航。 本章简介 计算机视觉(Computer Vision)是人工智能中历史最久、应用最广的领域之一,它的目标是让机器能够从图像和视频中提取信息、理解世界。从手机里的人脸解锁,到自动驾驶汽车识别行人和车道,再到医疗影像里的病灶检测,以及当下最热门的文本生成图像模型——背后都离不开视觉技术。