深度学习图像数据自动标注[通俗易懂]

全栈程序员-站长 • 2022年6月15日上午9:46 • 未分类 • 阅读 113

深度学习图像数据自动标注[通俗易懂]Tensorflow和Caffe等深度学习中，监督学习的数据标注是一件非常繁琐和耗时的工作，目前大多数公司都采用外包给标注公司进行处理，或者购买现有的数据集，使得进行深度学习研究的成本异常高。本文介绍一种以人工智能解决数据标注的思路和方法。一、思路步骤：1、以一个初步模型对小批量待标注数据进行检测，这里的初步模型可以是自己用少批量数据集训练出来的，也可以用网上公布的；2、对检测出来的结果进行人为干预纠正；3、把纠正后的数据训练新的模型；4、用新模型对中等批量待测数据进行检测；…

大家好，又见面了，我是你们的朋友全栈君。

Tensorflow和Caffe等深度学习中，监督学习的数据标注是一件非常繁琐和耗时的工作，目前大多数公司都采用外包给标注公司进行处理，或者购买现有的数据集，使得进行深度学习研究的成本异常高。本文介绍一种以人工智能解决数据标注的思路和方法。

一、思路

步骤：

1、以一个初步模型对小批量待标注数据进行检测，这里的初步模型可以是自己用少批量数据集训练出来的，也可以用网上公布的；

2、对检测出来的结果进行人为干预纠正；

3、把纠正后的数据训练新的模型；

4、用新模型对中等批量待测数据进行检测；

5、通过1~5步骤的循环迭代，可以逐步求精；

6、虽然也需要人工参与，但可以极大减少工作量。

实现方法：

1、Anno-Mage

Anno-Mage是一个半自动标注工具，通过一个通用模型对数据集进行检测。但这个工具能标注的物品类型有限，也没有模型迭代逐步求精的过程，可以自行对其源码进行修改优化。

github代码地址：https://github.com/virajmavani/semi-auto-image-annotation-tool

深度学习图像数据自动标注[通俗易懂]

2、easyDL智能标注

2.1、智能标注

百度easyDL提供了智能标注的功能，跟以上思路差不多，都是先对小批量数据进行标注学习训练，然后以学习结果去标注剩下的数据集，然后人工纠正，迭代求精。

easyDL平台网址：https://ai.baidu.com/easydl/lite

智能检测技术文档：https://ai.baidu.com/ai-doc/EASYDL/lk38n327g

深度学习图像数据自动标注[通俗易懂]

2.2、数据导出

但easyDL官方不提供数据导出功能和api，这阻碍了我们把数据拿到Tensorflow和Caffe进行训练。所以我们可以通过爬虫技术来爬取训练好的数据。

工具github地址：https://github.com/kooky126/easydl2labelImg

版权声明：本文内容由互联网用户自发贡献，该文观点仅代表作者本人。本站仅提供信息存储空间服务，不拥有所有权，不承担相关法律责任。如发现本站有涉嫌侵权/违法违规的内容，请联系我们举报，一经查实，本站将立刻删除。

发布者：全栈程序员-站长，转载请注明出处：https://javaforall.net/147820.html原文链接：https://javaforall.net

赞 (0)

0 0

关于作者

全栈程序员-站长

133.5K 文章

3 粉丝

本网站汇聚当前互联网主流语音，持续更新，欢迎关注公众号“全栈程序员社区”

P750 内存插槽

上一篇 2022年6月15日上午9:46

国内比较好的OJ平台[通俗易懂]

下一篇 2022年6月15日上午10:00

Java程序设计教程牛晓太_Java程序设计教程

Java程序设计教程牛晓太_Java程序设计教程第1章Java概述1.1Java简介1.1.1Java的产生1.1.2Java的特点1.1.3Java三大平台1.2Java的开发和运行环境1.2.1Java虚拟机1.2.2JDK的安装1.2.3环境变量的设置1.2.4JavaAPI文档1.3Java程序开发实例1.3.1Java应用程序实例1.3.2Java小程序实例1.4Eclipse开发平台1.4.1Ecli…

全栈程序员-站长
2022年7月7日
24
gpt

电脑开机显示MissingOperatingSystem解决方法

电脑开机显示MissingOperatingSystem解决方法

Ai探索者
2026年3月14日
2
Linux日志管理工具 journalctl「建议收藏」

Linux日志管理工具 journalctl「建议收藏」日志Linux日志管理基本概念journalctl查询所有系统服务日志内容journalctlmaybeusedtoquerythecontentsofthesystemd(1)journalaswrittenbysystemd-journald.service(8).CentOS7及以后版本，利用Systemd统一管理所有Unit的启动日志。带来的好处就是，可以只用journalctl一个命令，查看所有系统日志查看内容包括内核日志

全栈程序员-站长
2022年5月23日
36
Oracle安装和dataguard

Oracle安装和dataguard1 准备工作 nbsp HostIPDB NAMEDB UNIQUE NAMEArchive Dest 主库 172 20 20 150orclpdunq data oracle archivelog 备库 172 20 20 151orclpdunq dg data oracle archivelog 保护模式默认最大性能模式 MAXIMUMPERFO 在 primary 搭建数据库软件建立 ls

全栈程序员-站长
2026年3月16日
2
nacos和eureka注册中心对比 and CAP定律理解

1.CP和AP不可能同时满足2.P代表分区容错,在整个分布式系统中某个节点服务挂掉了,并不影响整个系统的运作和使用，因为他可以在稍后或者通过切换可用节点立即恢复使用3.C:写操作之后的读操作，必须返回该值。注册中心集群中:leader的作用,所有的写操作都依赖于leader来完成,为了保证数…

全栈程序员-站长
2022年4月6日
133
Xilinx原语ODDR的使用

ODDRisXilinxHDLLanguageTemplate。ODDR：OutputDoubleDataRate（DDR）。在介绍ODDR之前，我们先简单了解一下OLOGIC。OLOGIC块在FPGA内的位置紧挨着IOB，其作用是FPGA通过IOB发送数据到器件外部的专用同步块。OLOGIC资源的类型有OLOGIC2(位于HPI/Obanks)和OLOGIC3(位于…

全栈程序员-站长
2022年4月7日
450

发表回复

关注全栈程序员社区公众号