暴雨淹城,AI 却提前 3 小时告诉了我哪条街的排水口堵了 | 雨水箅子检测数据集 | 智慧城市治理之城市排水渠监测 排水设施堵塞检测 下水管道异常检测 街道雨水篦子图像识别

2026 年 7 月 17 日,重庆。刚结束一场持续 4 小时的暴雨,朋友圈里全是“看海”视频。一位管网维护的朋友凌晨三点给我发消息:“又一个井盖被顶开,车泡了,人没事。要是能提前知道哪个箅子堵了,就好了。”

城市内涝,不只是天灾,更是信息盲战。

当深圳龙岗的“AI 哨兵”能在暴雨中智能分析 24.3 万张监控图片,发出 1500 余次预警;当济南的智慧系统能提前 24 小时预测易涝点积水深度——我们缺的,往往不是算力,而是最基础的那一块砖:让 AI 认识“雨水箅子”的数据集

今天这份刚开源的**《街道雨水箅子目标检测数据集》**,就是想给每一双“城市之眼”装上看懂排水的瞳孔。


01 下水道的“准考证”:这份数据集到底长什么样?

这份数据集不炫技,专为真实场景落地而生。所有图片均拍摄于真实街道环境,未做任何增强处理,直接复现“晴天一身灰,雨天一身泥”的监控视角。

数据集核心指标 详细说明
总图片数量 1,032 张(全部为真实场景实拍)
训练集 / 测试集 885 张 / 147 张(严格划分,开箱即用)
标注格式 YOLO 格式 + VOC 格式(适配绝大多数主流检测模型)
标签实例数 训练集 1,213 个 / 测试集 214 个(单一类别“雨水箅子”,目标明确)
适用任务 排水设施堵塞检测、下水管道异常预警、街道水位关联分析

数据集的划分非常干净。训练集 885 张图里框出了 1,213 个箅子实例,测试集 147 张图里有 214 个。1:5 左右的训练验证比,足够帮你快速跑通基线模型。
在这里插入图片描述

02 训练你的“内涝之眼”:YOLOv5 实战配置

有了数据,下一步就是喂给模型。这里以最经典的 YOLOv5 为例,展示如何让模型认识这个“城市暗器”。代码里我用决策注释替代了常规语法注释,帮你理解每一步的选择逻辑。

第一步:准备数据集

数据集已为你处理成 YOLO 格式,标签文件(.txt)和图片名称一一对应。你只需要建立一个 dataset.yaml 文件,告诉模型去哪找它们:

# dataset.yaml —— 数据集路径配置文件
# 决策注释:采用相对路径,确保工程迁移时无需反复修改绝对地址
path: ../datasets/rain_grate  # 数据集根目录
train: images/train           # 训练集图片文件夹
val: images/test              # 验证集图片文件夹(此处使用给定的测试集)

# 决策注释:类别名称必须与标注文件中的数字索引严格对应
# 单一类别检测,从0开始编号
names:
  0: rain_grate

在这里插入图片描述

第二步:启动训练(把显卡转起来)

在 YOLOv5 目录下,运行 train.py。关键参数如下:

# train.py 关键参数配置
# 决策注释:使用 --cache ram 将图像缓存至内存,可大幅降低 I/O 瓶颈,但需确保内存≥32GB
# 决策注释:--weights 选用 yolov5s.pt,兼顾精度与推理速度,适合边缘端部署
python train.py --img 640 \           # 输入图像尺寸
                --batch 16 \          # 批次大小(根据显存调整,建议从8起步)
                --epochs 100 \        # 训练轮次(该数据集规模下,80轮左右即可收敛)
                --data dataset.yaml \ # 刚才配置的数据集索引文件
                --weights yolov5s.pt \# 预训练权重(迁移学习核心)
                --cache ram           # 加速策略

训练关键决策点解读:

  • 为什么用 640×640 而不是更大? 雨水箅子在监控画面中属于中小目标,640 分辨率能平衡检测精度与显存占用。更大的 1280 分辨率会显著降低训练速度,而精度提升有限。
  • 为什么选 YOLOv5s 而不是 v8/v11? v5s 在工业界部署生态最成熟,TensorRT、OpenVINO 等加速工具支持完善,适合后续落地到边缘计算设备(如济南防汛系统中布设的前端边缘 AI 终端)。

训练完成后,会在 runs/train/exp 目录下生成权重文件。best.pt 是验证集上表现最好的模型,last.pt 是最后一轮模型,建议优先使用 best.pt 做推理。
在这里插入图片描述

03 不仅仅是“识图”:AI 如何撬动千亿防汛市场?

有了这套数据集和训练好的模型,能做的远不止“识别一个箅子”。结合多地智慧城市实践,它的应用场景可以迅速铺开:

  1. 从“被动清掏”到“主动派单” :将训练好的模型部署到城市已有的 2 万余路公共视频点位。一旦 AI 识别到箅子被垃圾覆盖或积水漫过阈值,自动生成工单推送至网格员——就像衡水市的智慧排水平台,让“足不出户就能全面掌握城市排水运行状况”成为现实。
  2. 与“数字孪生”系统联动:模型输出的箅子状态(正常/堵塞/缺失),可作为水位预测模型的关键输入。淮河水利委员会已能通过数字孪生提前 3-7 天预演洪水。在城市尺度,箅子状态数据能让内涝模型从“降雨量推算”升级为“排水能力实时评估”,预测精度将大幅提升。
  3. 低成本巡检替代:传统人工巡查需要逐个、逐段打开井盖,存在中暑和有害气体中毒风险。AI 视觉巡检能替代 80% 以上的常规巡查人力,让一线人员从“烈日下开井盖”解放为“系统前看屏幕”。

在这里插入图片描述
在这里插入图片描述

写在最后

我们总在讨论大模型、通用人工智能,但真正能守护一座城市的,往往不是那个能写诗作画的“全能者”,而是那个盯着下水道、认识每一个雨水箅子的“偏科生”。

这份 1032 张图片的数据集,对于大模型来说微不足道,但对于一个内涝频发的街区,它可能就是暴雨夜提前 3 小时响起的预警铃。

城市治理的精度,不在于仰望星空的高度,而在于俯身看清脚下每一个排水口的能力。

愿这份开源的数据,能让更多城市的“血管”在暴雨来临时,喘口气。

Logo

汇聚全球AI编程工具,助力开发者即刻编程。

更多推荐