Python如何实现xml格式转txt格式
发表于:2025-01-29 作者:千家信息网编辑
千家信息网最后更新 2025年01月29日,本篇内容介绍了"Python如何实现xml格式转txt格式"的有关知识,在实际案例的操作过程中,不少人都会遇到这样的困境,接下来就让小编带领大家学习一下如何处理这些情况吧!希望大家仔细阅读,能够学有所
千家信息网最后更新 2025年01月29日Python如何实现xml格式转txt格式
本篇内容介绍了"Python如何实现xml格式转txt格式"的有关知识,在实际案例的操作过程中,不少人都会遇到这样的困境,接下来就让小编带领大家学习一下如何处理这些情况吧!希望大家仔细阅读,能够学有所成!
1、前言
最近学习Yolo v5是遇见了个问题,找的数据集全是xml文件,VOC 的标注是 xml 格式的,而YOLO是.txt格式,那么问题就来了,手动提取肯定是不可能的,那只能借用程序解决咯。
2、分析xml、txt数据
这是xml树形结构
这是txt格式
总结:
1.提取object->name、bndbox->xmin,ymin,xmax,ymin
2.格式转化需要用公式转换
YOLO数据集txt格式:
x_center :归一化后的中心点x坐标
y_center : 归一化后的中心点y坐标
w:归一化后的目标框宽度
h: 归一化后的目标况高度
(此处归一化指的是除以图片宽和高)
VOC数据集xml格式
yolo的四个数据 | xml->txt公式 |
---|---|
x_center | ((x_min+x_max)/2-1)/w_image |
y_center | ((y_min+y_max)/2-1)/h_image |
w | (x_max-x_min)/w_image |
h | (y_max-y_min)/h_image |
3、转换过程
定义两个文件夹,train放xml数据, labels放txt数据。
代码解析:
import osimport xml.etree.ElementTree as ETimport iofind_path = './train/' #xml所在的文件savepath='./labels/' #保存文件class Voc_Yolo(object): def __init__(self, find_path): self.find_path = find_path def Make_txt(self, outfile): out = open(outfile,'w') print("创建成功:{}".format(outfile)) return out def Work(self, count): #找到文件路径 for root, dirs, files in os.walk(self.find_path): #找到文件目录中每一个xml文件 for file in files: #记录处理过的文件 count += 1 #输入、输出文件定义 input_file = find_path + file outfile = savepath+file[:-4]+'.txt' #新建txt文件,确保文件正常保存 out = self.Make_txt(outfile) #分析xml树,取出w_image、h_image tree=ET.parse(input_file) root=tree.getroot() size=root.find('size') w_image=float(size.find('width').text) h_image=float(size.find('height').text) #继续提取有效信息来计算txt中的四个数据 for obj in root.iter('object'): #将类型提取出来,不同目标类型不同,本文仅有一个类别->0 classname=obj.find('name').text cls_id = classname xmlbox=obj.find('bndbox') x_min=float(xmlbox.find('xmin').text) x_max=float(xmlbox.find('xmax').text) y_min=float(xmlbox.find('ymin').text) y_max=float(xmlbox.find('ymax').text) #计算公式 x_center=((x_min+x_max)/2-1)/w_image y_center=((y_min+y_max)/2-1)/h_image w=(x_max-x_min)/w_image h=(y_max-y_min)/h_image #文件写入 out.write(str(cls_id)+" "+str(x_center)+" "+str(y_center)+" "+str(w)+" "+str(h)+'\n') out.close() return countif __name__ == "__main__": data = Voc_Yolo(find_path) number = data.Work(0) print(number)
4、最后结果对比
创建成功
与真实数据对比误差很小
"Python如何实现xml格式转txt格式"的内容就介绍到这里了,感谢大家的阅读。如果想了解更多行业相关的知识可以关注网站,小编将为大家输出更多高质量的实用文章!
文件
格式
数据
公式
目标
不同
成功
中心点
内容
坐标
更多
知识
类型
过程
这是
问题
分析
学习
输出
实用
数据库的安全要保护哪些东西
数据库安全各自的含义是什么
生产安全数据库录入
数据库的安全性及管理
数据库安全策略包含哪些
海淀数据库安全审计系统
建立农村房屋安全信息数据库
易用的数据库客户端支持安全管理
连接数据库失败ssl安全错误
数据库的锁怎样保障安全
网络安全法的评论
网络安全主要涉及哪些问题
腾讯云服务器12元一年
文件服务器硬盘转速
阿里云队列服务器
安徽在线网络技术咨询哪家好
列式存储数据库的优点
5g网络技术的作用
对日软件开发注意事项
哪个企业把服务器放在海底
单位网络安全第一负责人
战地三服务器架设
服务器被攻击会不会崩溃
盈利的网络安全股票
数据库更换oracle
sql怎么拆解数据库
电脑邮箱无法连接服务器怎么回事
数据库根据两个字段查重
云服务器4种部署
按摩椅软件开发公司
服务器中fru什么意思
网络技术应用 浙教版
数据库审计信息安全
蓝盾网络安全软件
渭南锄禾互联网科技
河南net软件开发大概要多少钱
mt4常用服务器
网络安全和管理进入法时代
怎么合理使用数据库的字段
服务器的主要种类刀片式