街景字符编码识别赛题理解

街景字符编码识别赛题理解

赛题数据

赛题的数据为街景字符图片,类似于MNIST数据集,但是更加困难,每张图片分辨率都很低,图片中的字符有大有小,存在尺度不一致的问题;按照赛题的要求只要识别是每张图片包含几个字符,每个字符是什么就可以了,这样可以简单将其定义为一个图像分类问题,但是每个图片的字符个数不确定,而且位置不确定,因为每个字符的类别仅仅与相应的局部的特征有关,仅仅通过对全局的特征进行分类并不能得到很好的效果;并且通过亲自实验, 完成baseline代码的阅读和理解,并完成在训练集训练10个epoch, 效果很差
其次赛题数据不仅提供了字符类别也提供了每个字符的位置信息,所以也可以将改题定义为目标检测问题,利用同时分类和回归的多任务损失,对每个指定位置进行针对性的分类和回归,两种任务进行相互促进,彼此收益可以取得更好的效果.

问题

如果采用目标检测的思路,个人认为应该选取针对小目标的backbone作为特征提取器,要包含多尺度的特征融合的策略,检测头的话可以采用当前精度比较好的anchor free方法这样可以避免复杂的关于anchor超参的设计,同时可以支持多尺度的边界框回归

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
天池是一个著名的数据科学竞平台,而datawhale是一家致力于数据科学教育和社群建设的组织。街景字符编码识别是指通过计算机视觉技术,对街道场景中的字符进行自动识别和分类。 街景字符编码识别是一项重要的研究领域,对于提高交通安全、城市管理和智能驾驶技术都具有重要意义。街道场景中的字符包括道路标志、车牌号码、店铺招牌等。通过对这些字符进行准确的识别,可以辅助交通管理人员进行交通监管、道路规划和交通流量分析。同时,在智能驾驶领域,街景字符编码识别也是一项关键技术,可以帮助自动驾驶系统准确地识别理解道路上的各种标志和标识,为自动驾驶提供可靠的环境感知能力。 天池和datawhale联合举办街景字符编码识别,旨在吸引全球数据科学和计算机视觉领域的优秀人才,集思广益,共同推动该领域的研究和发展。通过这个竞,参选手可以使用各种机器学习和深度学习算法,基于提供的街景字符数据集,设计和训练模型,实现准确的字符编码识别。这个竞不仅有助于促进算法研发和技术创新,也为各参选手提供了一个学习、交流和展示自己技能的平台。 总之,天池datawhale街景字符编码识别是一个具有挑战性和实际应用需求的竞项目,旨在推动计算机视觉和智能交通领域的技术发展,同时也为数据科学爱好者提供了一个学习和展示自己能力的机会。

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值