纸箱打包缺陷视觉检测系统
客户:湖北某纸箱包装企业
为湖北某纸箱包装企业配套纸箱打包视觉检测系统,解决打包带未完全打包、间距异常及纸箱合页不规则、翻边、破损等缺陷依赖人工目检的问题;交付单面静止拍摄的视觉检测软件,自动判定合格与不合格并输出开关量信号。
为上海某科技企业开发行驶证OCR识别系统,解决行驶证正页、副页及混合图片中车辆信息自动提取与结构化输出的问题;交付支持内网离线部署的识别服务,以API方式提供字典结果。
客户在业务中需要将行驶证正页、副页上的车辆信息录入系统,原有方式依赖人工,效率低且容易出错。实际图片往往不只包含单页,可能同时出现正页、副页甚至其他页面,系统需要先判断页面类型再提取对应字段。
技术难点包括:印刷体字符中“2”与“Z”、“0”与“8”、“6”与“9”、“g”与“G”等易混淆;印刷位置偏移导致小数点等符号干扰;部分文字在图片中占两行,对文本检测框的定位精度要求较高。此外,部署环境为国产麒麟操作系统,需支持内网离线运行,对兼容性和交付形态有明确要求。客户提供约600张真实照片用于训练,但训练数据量有限,需要算法具备较好的泛化能力。
敏洽交付的行驶证识别系统采用Python开发,包含图像预处理、页面分类、文本检测、文字识别、字段解析与结果输出等模块。系统接收jpg、jpeg、png等常见格式图片,自动判断是否包含正页、副页,并提取PlateNo、VehicleType、Owner、OwnerAddress、UseCharacter、VehicleBrand、VIN、EngineNo、RegisterDate、IssueDate、CardNo、FileNo、SeatNum、TotalMass、CurbWeight、LoadMass、Dimensions、FuelType共18个字段,最终以JSON字典形式输出。
针对易混淆字符,系统在识别模型基础上进行了专项微调,并利用正则表达式过滤印刷偏移产生的干扰符号;对于跨行文本,优化了检测框的合并策略,确保字段内容完整。整个系统打包为Docker镜像,可部署在麒麟高级服务器操作系统上,通过内网API提供服务,满足数据不出网的合规要求。
系统上线后,在超过20张的真实测试集上,字典级准确率超过90%,即20张图中允许错2张,达到验收标准。识别结果覆盖行驶证正页和副页的18个关键字段,能够满足车辆信息自动录入、档案电子化等业务需求。
由于采用Docker离线部署,系统在客户内网环境稳定运行,无需连接外网,降低了数据泄露风险。同时,Python代码便于后期维护和算法迭代,客户可自行补充训练数据进一步优化识别效果。相比人工录入,单张图片的信息提取时间大幅缩短,录入错误率显著下降,识别结果可直接对接业务系统,减少人工二次录入,为后续车辆管理流程的自动化奠定了基础。
版权声明:本案例的文字描述、关键指标与配图均为苏州哈特数据科技有限公司(敏洽 minqia.net)在实际交付过程中形成的原创内容,著作权归本公司所有。
欢迎转载与引用,但请完整保留本声明并注明来源为「敏洽 minqia.net」,同时附上原文链接:https://minqia.net/cases/b1b9a6ec55234b8c85ec40c58d36d3d2.html。未经书面许可,不得将本案例内容改作自有业绩对外宣传,或去除配图水印后另行使用。
为遵守与客户签订的保密约定,文中涉及的客户名称、工艺参数与产线信息已做脱敏或模糊处理,具体实现细节请通过联系我们获取。
客户:湖北某纸箱包装企业
为湖北某纸箱包装企业配套纸箱打包视觉检测系统,解决打包带未完全打包、间距异常及纸箱合页不规则、翻边、破损等缺陷依赖人工目检的问题;交付单面静止拍摄的视觉检测软件,自动判定合格与不合格并输出开关量信号。
客户:北京某生命科学仪器企业
为生命科学仪器企业的移液工作站配套视觉校验软件,解决取枪、吸液过程中枪头缺失、歪斜、气泡、漏液等异常难以自动发现的问题;交付的视觉软件嵌入上位机流程,实现静态板位识别与动态在线监控。
客户:华东某智能装备制造企业
为华东某智能装备制造企业的点胶设备配套视觉监测软件,解决点胶过程中胶路缺陷难以实时发现的问题;交付一套视觉点胶监测系统,实现点胶质量的在线检测与异常报警,随设备交付并统一验收。