图像处理的知识(一)
·
基础分辨率概念
~ 分辨率:单位面积像素点数,常用宽 X 高(像素px)表述;PPI:每英寸像素数,用于屏幕/打印
~图像分类:标清(SD)、高清(HD)、全高清(FHD)、2K、4K、8K
通用标准分辨率(行业通用)
实际使用的图片尺寸大小格式

特征点识别的分割下来的图片尺寸大小为:2121;4242两种。
视频/屏幕类分辨率(视觉算法主流输入)
| 标准名称 | 分辨率 (宽 × 高) | 主要应用场景 |
|---|---|---|
| QVGA | 320 × 240 | 老旧设备、嵌入式低端视觉 |
| VGA | 640 × 480 | 传统监控、入门视觉算法、工业相机 |
| WVGA | 800 × 480 | 车载屏、嵌入式终端 |
| 720P (HD) | 1280 × 720 | 监控摄像头、实时视频流、轻量 AI 算法 |
| 1080P (FHD) | 1920 × 1080 | 主流相机、直播、绝大多数视觉项目 |
| 2K | 2560 × 1440 | 高清监控、专业视觉采集 |
| 4K (UHD) | 3840 × 2160 | 高端相机、高精度检测、航拍 |
| 8K | 7680 × 4320 | 超高清专业设备,极少用于实时算法 |
移动端/图像采集常用尺寸
1.方形图:224×224、256×256、384×384、512×512(深度学习分类 / 检测常用)
2.竖屏手机:720×1280、1080×1920
3.证件/办公:413×295(一寸照)、626×413(二寸照)
深度学习视觉算法标准输入尺寸(高频)
这里使用ai查询了一些常用的模型训练/推理固定尺寸,适用大多数的CV算法:
1.分类网络
~AlexNet:227×227
~VGG/ResNet/MobileNet/EfficientNet:224×224(最通用)
~EfficientNet-L:384×384、448×448、512×512
2.目标检测
~YOLOv3/v4/v5/v7:416×416、640×640(主流),也支持 832×832
~SSD:300×300、512×512
~Faster R-CNN:不固定,常用 600×1000、800×1333
3.分割 / 关键点
~语义分割:512×512、1024×1024
~人体关键点:256×192、384×288
更多推荐




所有评论(0)