Datawhale 零基础入门CV赛事-Task1 赛题理解----小白学习笔记1

学习笔记

  • JSON是什么
  • 零基础入门CV之街道字符识别--解题思路[^1]
    • 1、简单入门思路:定长字符识别
    • 2、专业字符识别思路:不定长字符识别
    • 3、专业分类思路:检测再识别
  • 学习过程中的各种安利
    • 1、pytorch60分钟入门推荐
    • 2、AI for Medicine的系列课程
    • 3、gpu环境配置教程
    • 4、github无法加载图片的解决办法

JSON是什么

JSON 是一种数据格式。它本身是一串字符串,只是它有固定格式的字符串,符合这个数据格式要求的字符串,我们称之为JSON。

JSON 常用来数据传输,因为它易于程序之前读写操作。

JSON 它其实是来自JavaScript对对象(Object)的定义。但是它作为数据格式来使用的时候,和JavaScript没有任何关系,它只是参照了JavaScript对对象定义的数据格式。

JSON 它可以服务任何语言,C、C++、Java、Objective-C、Python、Go、等,在各个语言中的字典、Map和JSON是类似的结构,所以它们之间可以相互转换。
链接: JSON.

零基础入门CV之街道字符识别–解题思路1

1、简单入门思路:定长字符识别

可以将赛题抽象为一个定长字符识别问题,在赛题数据集中大部分图像中字符个数为2-4个,最多的字符 个数为6个。

因此可以对于所有的图像都抽象为6个字符的识别问题,字符23填充为23XXXX,字符231填充为231XXX。

经过填充之后,原始的赛题可以简化了6个字符的分类问题。在每个字符的分类中会进行11个类别的分类,假如分类为填充字符,则表明该字符为空。

2、专业字符识别思路:不定长字符识别

在字符识别研究中,有特定的方法来解决此种不定长的字符识别问题,比较典型的有CRNN字符识别模型。

在本次赛题中给定的图像数据都比较规整,可以视为一个单词或者一个句子。

3、专业分类思路:检测再识别

在赛题数据中已经给出了训练集、验证集中所有图片中字符的位置,因此可以首先将字符的位置进行识别,利用物体检测的思路完成。

学习过程中的各种安利

1、pytorch60分钟入门推荐

pytorch 入门推荐官方的60分钟入门教程(虽然肯定不止1小时),讲得很全面。
链接: link.

2、AI for Medicine的系列课程

链接: link.

3、gpu环境配置教程

链接: link.

4、github无法加载图片的解决办法

链接: link.


  1. 赛题名称:零基础入门CV之街道字符识别
    赛题目标:通过这道赛题可以引导大家走入计算机视觉的世界,主要针对竞赛选手上手视觉赛题,提高对数据建模能力。
    赛题任务:赛题以计算机视觉中字符识别为背景,要求选手预测街道字符编码,这是一个典型的字符识别问题。
    为了简化赛题难度,赛题数据采用公开数据集SVHN,因此大家可以选择很多相应的paper作为思路参考。 ↩︎

你可能感兴趣的:(Datawhale 零基础入门CV赛事-Task1 赛题理解----小白学习笔记1)