天池实战-街景字符编码识别-task1赛题理解

写在前面的话

在写这篇文章的时候,我其实已经把整个项目的流程都过完了,包括Pytorch对于模型的训练等等,所以这篇题目为赛题理解但实际也会说到后面的内容,不光是题目所说的赛题理解这么简单

总之,请你按整个项目的流程去走,去了解整个项目的背景、数据和目的,以及要求的环境等等,然后再针对目标去一步步的完善代码

按照建模流程,整个过程可以分为:赛题理解,数据预处理,建立模型,模型优化,模型集成 五个部分

ok,准备开始



赛题理解

此次的赛题是针对计算机视觉的一个入门练习,对于不懂计算机视觉的小白(比如我)难度不小,但是因为建模的流程差别不大,所以整个过程是既熟悉又陌生

另外,本次比赛是通过Pytorch下实现的,所以可能也需要去稍微补一补Pytorch的内容,比如Pytorch下建模的流程,相应的神经网络相关的方法概念等等


赛题目标:

通过对训练集中图片的训练,使得模型能够尽可能多的识别测试集中的图片

所以天池的评测指标是: S c o r e = 编 码 识 别 正 确 的 数 量 测 试 集 图 片 数 量 Score=\frac {编码识别正确的数量}{测试集图片数量} Score=


赛题数据:

本次赛题提供了训练集、验证集和测试集,其中训练集数据包括3W张图片,验证集数据包括1W张图片,测试集包括4W张图片片。

所有的图片都是来自于Google街景图像中的门牌号,所以图像比较小,也没有什么规律可言,就和下图中所展示的一样:

文章首发:公众号『知秋小一』

另外,题目官方为了降低题目难度,直接给出了训练集和验证集中所有图片的字符位置框,其中包括图片中字符的如下位置信息:

FieldDescription
top左上角坐标X
height字符高度
left左上角最表Y
width字符宽度
label字符编码

针对一个具体的图像,通过它的位置信息确定字符所在的区域并截取出来一个更小的图像。具体的位置参数在图像中是这样的:

文章首发:公众号『知秋小一』

工具与平台

针对图像的加载、处理等需要安装图像处理框架,例如Pillow、Opencv等实现图像的裁剪、旋转、变换等预处理

通过Pytorch框架构建CNN模型,所以需要预先安装Pytorch

另外涉及Pytorch的相关使用,还需要了解Pytorch的相关操作,例如张量的相关操作,选择GPU或者CPU训练模型等等

# 安装opencv
pip install opencv-python

# 安装pytorch
pip install torch==1.5.0+cu101 torchvision==0.6.0+cu101 -f https://download.pytorch.org/whl/torch_stable.html

具体的Pytorch 的安装可以直接去官网:Pytorch安装

  • 0
    点赞
  • 2
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
天池是一个著名的数据科学竞平台,而datawhale是一家致力于数据科学教育和社群建设的组织。街景字符编码识别是指通过计算机视觉技术,对街道场景中的字符进行自动识别和分类。 街景字符编码识别是一项重要的研究领域,对于提高交通安全、城市管理和智能驾驶技术都具有重要意义。街道场景中的字符包括道路标志、车牌号码、店铺招牌等。通过对这些字符进行准确的识别,可以辅助交通管理人员进行交通监管、道路规划和交通流量分析。同时,在智能驾驶领域,街景字符编码识别也是一项关键技术,可以帮助自动驾驶系统准确地识别理解道路上的各种标志和标识,为自动驾驶提供可靠的环境感知能力。 天池和datawhale联合举办街景字符编码识别,旨在吸引全球数据科学和计算机视觉领域的优秀人才,集思广益,共同推动该领域的研究和发展。通过这个竞,参选手可以使用各种机器学习和深度学习算法,基于提供的街景字符数据集,设计和训练模型,实现准确的字符编码识别。这个竞不仅有助于促进算法研发和技术创新,也为各参选手提供了一个学习、交流和展示自己技能的平台。 总之,天池datawhale街景字符编码识别是一个具有挑战性和实际应用需求的竞项目,旨在推动计算机视觉和智能交通领域的技术发展,同时也为数据科学爱好者提供了一个学习和展示自己能力的机会。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值