计算机视觉基础|第1章 走进计算机视觉
目录
- 1.1 什么是计算机视觉
- 生活里的计算机视觉场景
- 1.2 图像在计算机眼中是什么
- 1.3 开发环境搭建
1.1 什么是计算机视觉
人类通过眼睛接收画面,大脑识别画面里的物体、位置、颜色;计算机视觉(Computer Vision,CV)就是让机器拥有 “看懂图片、视频” 的能力。
简单讲:给计算机一张图片,让计算机输出对这张图的理解。
- 输入:图片 / 视频(一堆数字像素矩阵)
- 输出:物体是什么、物体在哪、图片描述、是否异常等信息。
人类看到一张猫的照片:大脑直接认出这是猫。 |
生活里的计算机视觉场景
- 手机人脸识别解锁
- 车牌识别
- 监控摄像头人形检测
- OCR 文字识别(图片转文字)
- 自动驾驶识别行人、红绿灯
- OpenCV 做图像预处理、目标检测项目(本专栏主要实战方向)
1.2 图像在计算机眼中是什么
计算机看不懂图片,只认识数字。
一张彩色图片本质是像素矩阵:
- 灰度图:每个像素一个数值,范围 0~255,0 代表黑色,255 代表白色。
- RGB 彩色图:每个像素由 R、G、B 三个通道组成,每个通道取值 0‑255。
- 可以通过这个网站https://www.rapidtables.org/zh-CN/web/color/RGB_Color.html,查看各种颜色的rgb值
1.3 开发环境搭建
学习计算机视觉与OpenCV开发,首先需要搭建完整的Python开发环境,包含Python解释器与PyCharm开发工具,详细的环境安装、配置教程可参考:Python与PyCharm环境搭建完整教程。
本专栏所有计算机视觉实战案例,均基于OpenCV库实现,需要安装两款核心依赖库,建议直接安装最新稳定版本,适配绝大多数Python版本:
- opencv-python:OpenCV核心库,包含图像读取、预处理、基础变换等常用功能
- opencv-contrib-python:扩展功能库,包含特征检测、目标跟踪等进阶视觉算法
打开PyCharm终端或CMD命令行,输入以下一键安装指令:
pip install opencv-python opencv-contrib-python依赖库安装完成后,我们通过第一段实战代码,完成图像的读取与显示,验证环境是否配置成功,本次测试所用素材如下图:
将图片存储到计算机中,复制完整路径。在项目中,创建Demo01.py,复制一下代码,记得更改路径。
import cv2 #读取本地图片(r表示原始字符串,避免路径转义报错) img = cv2.imread(r'D:\pythoncode2\bigdata_ai40\Image\企鹅.png') #创建窗口并显示图片,窗口名称为tu cv2.imshow('tu', img)# 等待键盘输入(0表示无限等待,任意按键关闭窗口) cv2.waitKey(0) # 关闭所有OpenCV窗口,释放资源 cv2.destroyAllWindows()结果输出:
至此,本章核心内容学习与OpenCV开发环境搭建全部完成。本章系统讲解了计算机视觉的核心定义、实际应用场景,剖析了图像数字化的本质,明确了灰度图、RGB彩色图的像素取值规则,同时完成了Python、PyCharm及OpenCV核心依赖库的环境配置,并通过图像读取显示实战代码验证了环境可用性,为后续计算机视觉图像预处理、特征检测等进阶实战学习筑牢基础。
