当前位置:网站首页>深度学习图像数据自动标注[通俗易懂]
深度学习图像数据自动标注[通俗易懂]
2022-07-02 13:39:00 【全栈程序员站长】
大家好,又见面了,我是你们的朋友全栈君。
Tensorflow和Caffe等深度学习中,监督学习的数据标注是一件非常繁琐和耗时的工作,目前大多数公司都采用外包给标注公司进行处理,或者购买现有的数据集,使得进行深度学习研究的成本异常高。本文介绍一种以人工智能解决数据标注的思路和方法。
一、思路
步骤:
1、以一个初步模型对小批量待标注数据进行检测,这里的初步模型可以是自己用少批量数据集训练出来的,也可以用网上公布的;
2、对检测出来的结果进行人为干预纠正;
3、把纠正后的数据训练新的模型;
4、用新模型对中等批量待测数据进行检测;
5、通过1~5步骤的循环迭代,可以逐步求精;
6、虽然也需要人工参与,但可以极大减少工作量。
实现方法:
1、Anno-Mage
Anno-Mage是一个半自动标注工具,通过一个通用模型对数据集进行检测。但这个工具能标注的物品类型有限,也没有模型迭代逐步求精的过程,可以自行对其源码进行修改优化。
github代码地址:https://github.com/virajmavani/semi-auto-image-annotation-tool
2、easyDL智能标注
2.1、智能标注
百度easyDL提供了智能标注的功能,跟以上思路差不多,都是先对小批量数据进行标注学习训练,然后以学习结果去标注剩下的数据集,然后人工纠正,迭代求精。
easyDL平台网址:https://ai.baidu.com/easydl/lite
智能检测技术文档:https://ai.baidu.com/ai-doc/EASYDL/lk38n327g
2.2、数据导出
但easyDL官方不提供数据导出功能和api,这阻碍了我们把数据拿到Tensorflow和Caffe进行训练。所以我们可以通过爬虫技术来爬取训练好的数据。
工具github地址:https://github.com/kooky126/easydl2labelImg
发布者:全栈程序员栈长,转载请注明出处:https://javaforall.cn/147820.html原文链接:https://javaforall.cn
边栏推荐
- 数据安全产业系列沙龙(三)| 数据安全产业标准体系建设主题沙龙
- 曆史上的今天:支付寶推出條碼支付;分時系統之父誕生;世界上第一支電視廣告...
- Multi task prompt learning: how to train a large language model?
- Yyds dry goods inventory student attendance system based on QT design
- Global and Chinese markets for slotting milling machines 2022-2028: Research Report on technology, participants, trends, market size and share
- 【云原生】简单谈谈海量数据采集组件Flume的理解
- Mysql database mysqldump why there is no statement to create a database
- L'explosion de John utilise l'encodage d'entrée par défaut: UTF - 8 Loaded 1 password Hash (bcrypt [blowfish 32 / 64 X3])
- ⌈ 2022 ⌋ how to use webp gracefully in projects
- 云原生的 CICD 框架:Tekton
猜你喜欢

Headline | Asian control technology products are selected in the textile and clothing industry digital transformation solution key promotion directory of Textile Federation
![[fluent] dart data type number type (DART file creation | num type | int type | double type | num related API)](/img/c7/1949894e106036d2b412bcd6f70245.jpg)
[fluent] dart data type number type (DART file creation | num type | int type | double type | num related API)

PCL point cloud image transformation

自注意力机制和全连接的图卷积网络(GCN)有什么区别联系?

pwm呼吸燈

How to solve the failure of printer driver installation of computer equipment

unity Hub 登錄框變得很窄 無法登錄

Trigger: MySQL implements adding or deleting a piece of data in one table and adding another table at the same time

小鹏P7雨天出事故安全气囊没有弹出 官方回应:撞击力度未达到弹出要求

PWM breathing lamp
随机推荐
Global and Chinese market of discharge machines 2022-2028: Research Report on technology, participants, trends, market size and share
PCL 点云镜像变换
流批一体在京东的探索与实践
路由模式:hash和history模式
[error record] the connection of the flutter device shows loading (disconnect | delete the shuttle/bin/cache/lockfile file)
Recalling the college entrance examination and becoming a programmer, do you regret it?
数字IC手撕代码--投票表决器
pwm呼吸灯
Unity uses ugui to set a simple multi-level horizontal drop-down menu (no code required)
Exploration and practice of integration of streaming and wholesale in jd.com
LeetCode 6. Zigzag transformation (n-shaped transformation)
pwm呼吸燈
LeetCode 1. 两数之和
Penetration tool - intranet permission maintenance -cobalt strike
Data security industry series Salon (III) | data security industry standard system construction theme Salon
头条 | 亚控科技产品入选中纺联《纺织服装行业数字化转型解决方案重点推广名录》
Global and Chinese market of jacquard looms 2022-2028: Research Report on technology, participants, trends, market size and share
Mysql database mysqldump why there is no statement to create a database
Yyds dry inventory method of deleting expired documents in batch
Some problems about MySQL installation