街景字符编码识别-task1
街景字符编码识别-赛题理解关于参赛赛题数据评测指标解题思路街景字符编码识别-赛题理解关于参赛通过本次参赛(开始前不知道是比赛,主要是想组队学习)了解CV相关问题的解决思路,以及基础知识储备。赛题的目标是对街景图片中的字符(数字)进行识别,主要难点在于图片中的字符长度不定。
赛题数据数据集:重点关注验证集的使用。数据分为训练集,验证集与测试集,其中:训练集数据包括3W张照片,对应的json文件中包含图像名称,对应的编码,以及具体位置。验证集数据包括1W张照片,同训练集一样,有对应的json文件包含图像名称,对应的编码,以及具体位置。测试集A包括4W张照片,测试集B包括4W张照片。数据标注:只有训练集和验证集有数据标注,标注文件为json文件,文件格式如下:“000001.png”: {“height”: [23, 23, 23], “label”: [2, 1, 0], “left”: [99, 114, 121], “top”: [5, 8, 6], “width”: [14, 8, 12]}1各字段的对应描述如下:Field Descriptiontop 左上角坐标Xheight 字符高度left 左上角最表Ywidth 字符宽度label 字符编码由于该图片中有三个字符,所以对应的编码以及位置标注都是三个。
该标注对应的图片如下:000001.png评测指标选手提交结果与实际图片的编码进行对比,以编码整体识别准确率为评价指标。任何一个字符错误都为错误,最终评测指标结果越大越好,具体计算公式如下:Score=编码识别正确的数量/测试集图片数量解题思路简单入门思路:定长字符识别可以将赛题抽象为一个定长字符识别问题,在赛题数据集中大部分图像中字符个数为2-4个,最多的字符 个数为6个。因此可以对于所有的图像都抽象为6个字符的识别问题,字符23填充为23XXXX,字符231填充为231XXX。经过填充之后,原始的赛题可以简化了6个字符的分类问题。在每个字符的分类中会进行11个类别的分类,假如分类为填充字符,则表明该字符为空。专业字符识别思路:不定长字符识别在字符识别研究中,有特定的方法来解决此种不定长的字符识别问题,比较典型的有CRNN字符识别模型。在本次赛题中给定的图像数据都比较规整,可以视为一个单词或者一个句子。专业分类思路:检测再识别在赛题数据中已经给出了训练集、验证集中所有图片中字符的位置,因此可以首先将字符的位置进行识别,利用物体检测的思路完成。三种思路分别是由易到难的程度

Task01:赛题理解相关推荐

  1. 【数据挖掘】金融风控 Task01 赛题理解

    [数据挖掘]金融风控 Task01 赛题理解 1.赛题介绍 1.1赛题概况 1.2 数据概况 1.3 预测指标 1.3.1 混淆矩阵 1.3.2 准确率.精确率.召回率.F1 Score 1.3.3 ...

  2. 地表建筑物识别——Task01赛题理解

    前言:这次参加Datawhale与天池联合发起的零基础入门语义分割之地表建筑物识别挑战赛.自己在大四上(2018下半年)也简单接触过语义分割,当时是基于FCN做CT图像乳腺肿瘤的分割.现在参加这个入门 ...

  3. DataWhale天池-金融风控贷款违约预测-Task01赛题理解

    目录 一.赛题概况 二.数据集介绍 三.预测指标 理解 通过ROC曲线评估分类器 最佳阈值点选择 一.赛题概况 本次新人赛是Datawhale与天池联合发起的0基础入门系列赛事第四场 -- 零基础入门 ...

  4. 2020腾讯广告算法大赛:赛题理解与解题思路

    写在前面 期待已久的2020腾讯广告算法大赛终于开始了,本届赛题"广告受众基础属性预估".本文将给出解题思路,以及最完备的竞赛资料,助力各位取得优异成绩!!! 报名链接:https ...

  5. 贷款违约预测--赛题理解

    比赛连接https://tianchi.aliyun.com/competition/entrance/531830/introduction 赛题理解: 赛题以金融风控中的个人信贷为背景,根据贷款申 ...

  6. 【天池赛事】零基础入门语义分割-地表建筑物识别 Task1:赛题理解与 baseline

    [天池赛事]零基础入门语义分割-地表建筑物识别 Task1:赛题理解与 baseline(3 天) – 学习主题:理解赛题内容解题流程 – 学习内容:赛题理解.数据读取.比赛 baseline 构建 ...

  7. 【算法竞赛学习】金融风控之贷款违约预测-赛题理解

    Task1 赛题理解 赛题以金融风控中的个人信贷为背景,要求选手根据贷款申请人的数据信息预测其是否有违约的可能,以此判断是否通过此项贷款,这是一个典型的分类问题.通过这道赛题来引导大家了解金融风控中的 ...

  8. 【算法竞赛学习】二手车交易价格预测-Task1赛题理解

    二手车交易价格预测-Task1 赛题理解 一. 赛题理解 Tip:此部分为零基础入门数据挖掘的 Task1 赛题理解 部分,为大家入门数据挖掘比赛提供一个基本的赛题入门讲解,欢迎后续大家多多交流. 赛 ...

  9. 计算机视觉入门CV之街道字符识别—01赛题理解

    计算机视觉入门CV之街道字符识别-01赛题理解 赛题 赛题理解 1.赛题数据 2.数据标签 3.数据读取 思路分析 赛题   以计算机视觉中字符识别为背景,要求选手预测街道字符编码,这是一个典型的字符 ...

最新文章

  1. mysql 用户 多主机_MySQL单主机多实例部署
  2. python学习之掷骰子游戏
  3. 滤镜应用——制作彩虹效果
  4. 自适应中值滤波用于超声图像降噪
  5. HP服务器350g5怎么安装系统,HP ML350 G5服务器安装SCO 5.0.7流程
  6. 5位随机数重复的概率 php_PHP产生不重复随机数的5个方法总结
  7. [css] css中的baseline,你知道吗?
  8. LeetCode 1864. 构成交替字符串需要的最小交换次数
  9. PX4编译文件 Makefile 剖析
  10. 试设计递归算法dfs traverse_BFS 算法框架套路详解
  11. 剑指 Offer 07. 重建二叉树(day02)
  12. java环境变量如何配置?
  13. dz3.4后台admin.php修改,Discuz X3.4论坛管理员无法登录后台,修改管理员账号密码的各种解决方法总结...
  14. 小米手机开启开发者模式以及INSTALL_FAILED_USER_RESTRICTED报错处理
  15. mysql commit用法_sql commit用法
  16. 各类dp的总结+例题
  17. velodyne运行Loam_velodyne过程记录
  18. android socket上传视频教程,android socket视频流方案
  19. 欺骗的艺术——第二部分(7)
  20. 大数据计算 PCIe 扩展坞系统

热门文章

  1. 解决:git clone --depth=1 -q -b fix/ie-cannot-input-korean git://github.com/sohee-lee7/Squire.git
  2. RPG游戏 01-人物行走和地图图块
  3. 14个办公室减肥小妙招 快速瘦身
  4. 立创开源(基于亚特联的二路电量统计插板)
  5. 账户系统如何应对高并发、热点账户等问题
  6. 简单说说我理解的图像的腐蚀和膨胀
  7. Android Camera2相机预览画面放大缩小(数码变焦DigitalZoom)功能实现
  8. 幽门螺杆菌检测方法学习笔记
  9. 发光立方体效果 html+css
  10. linux 命令:uname 详解