将xml文件转换成YOLO系列标准读取的txt文件时出现问题

将xml文件转换成YOLO系列标准读取的txt文件时出现问题，应该是xml文件命名问题。如何修改代码能使得xml文件能读取。

xml文件命名比较混乱，和图片对应

采用代码为

# -*- coding: utf-8 -*-
# xml解析包
import xml.etree.ElementTree as ET
import pickle
import os
from os import listdir, getcwd
from os.path import join


sets = ['train', 'test', 'val']
classes = ['fall']


# 进行归一化操作
def convert(size, box): # size:(原图w,原图h) , box:(xmin,xmax,ymin,ymax)
    dw = 1./size[0]     # 1/w
    dh = 1./size[1]     # 1/h
    x = (box[0] + box[1])/2.0   # 物体在图中的中心点x坐标
    y = (box[2] + box[3])/2.0   # 物体在图中的中心点y坐标
    w = box[1] - box[0]         # 物体实际像素宽度
    h = box[3] - box[2]         # 物体实际像素高度
    x = x*dw    # 物体中心点x的坐标比(相当于 x/原图w)
    w = w*dw    # 物体宽度的宽度比(相当于 w/原图w)
    y = y*dh    # 物体中心点y的坐标比(相当于 y/原图h)
    h = h*dh    # 物体宽度的宽度比(相当于 h/原图h)
    return (x, y, w, h)    # 返回 相对于原图的物体中心点的x坐标比,y坐标比,宽度比,高度比,取值范围[0-1]


# year ='2012', 对应图片的id（文件名）
def convert_annotation(image_id):
    '''
    将对应文件名的xml文件转化为label文件，xml文件包含了对应的bunding框以及图片长款大小等信息，
    通过对其解析，然后进行归一化最终读到label文件中去，也就是说
    一张图片文件对应一个xml文件，然后通过解析和归一化，能够将对应的信息保存到唯一一个label文件中去
    labal文件中的格式：calss x y w h　　同时，一张图片对应的类别有多个，所以对应的ｂｕｎｄｉｎｇ的信息也有多个
    '''
    # 对应的通过year 找到相应的文件夹，并且打开相应image_id的xml文件，其对应bund文件
    in_file = open('data/Annotations/%s.xml' % (image_id), encoding='utf-8')
    # 准备在对应的image_id 中写入对应的label，分别为
    # <object-class> <x> <y> <width> <height>
    out_file = open('data/labels/%s.txt' % (image_id), 'w', encoding='utf-8')
    # 解析xml文件
    tree = ET.parse(in_file)
    # 获得对应的键值对
    root = tree.getroot()
    # 获得图片的尺寸大小
    size = root.find('size')
    # 如果xml内的标记为空，增加判断条件
    if size != None:
        # 获得宽
        w = int(size.find('width').text)
        # 获得高
        h = int(size.find('height').text)
        # 遍历目标obj
        for obj in root.iter('object'):
            # 获得difficult ？？
            difficult = obj.find('difficult').text
            # 获得类别 =string 类型
            cls = obj.find('name').text
            # 如果类别不是对应在我们预定好的class文件中，或difficult==1则跳过
            if cls not in classes or int(difficult) == 1:
                continue
            # 通过类别名称找到id
            cls_id = classes.index(cls)
            # 找到bndbox 对象
            xmlbox = obj.find('bndbox')
            # 获取对应的bndbox的数组 = ['xmin','xmax','ymin','ymax']
            b = (float(xmlbox.find('xmin').text), float(xmlbox.find('xmax').text), float(xmlbox.find('ymin').text),
                 float(xmlbox.find('ymax').text))
            print(image_id, cls, b)
            # 带入进行归一化操作
            # w = 宽, h = 高， b= bndbox的数组 = ['xmin','xmax','ymin','ymax']
            bb = convert((w, h), b)
            # bb 对应的是归一化后的(x,y,w,h)
            # 生成 calss x y w h 在label文件中
            out_file.write(str(cls_id) + " " + " ".join([str(a) for a in bb]) + '\n')


# 返回当前工作目录
wd = getcwd()
print(wd)


for image_set in sets:
    '''
    对所有的文件数据集进行遍历
    做了两个工作：
　　　　１．将所有图片文件都遍历一遍，并且将其所有的全路径都写在对应的txt文件中去，方便定位
　　　　２．同时对所有的图片文件进行解析和转化，将其对应的bundingbox 以及类别的信息全部解析写到label 文件中去
    　　　　　最后再通过直接读取文件，就能找到对应的label 信息
    '''
    # 先找labels文件夹如果不存在则创建
    if not os.path.exists('data/labels/'):
        os.makedirs('data/labels/')
    # 读取在ImageSets/Main 中的train、test..等文件的内容
    # 包含对应的文件名称
    image_ids = open('data/ImageSets/%s.txt' % (image_set)).read().strip().split()
    # 打开对应的2012_train.txt 文件对其进行写入准备
    list_file = open('data/%s.txt' % (image_set), 'w')
    # 将对应的文件_id以及全路径写进去并换行
    for image_id in image_ids:
        list_file.write('data/images/%s.jpg\n' % (image_id))
        # 调用  year = 年份  image_id = 对应的文件名_id
        convert_annotation(image_id)
    # 关闭文件
    list_file.close()

来自https://blog.csdn.net/weixin_45921929/article/details/128673338?ops_request_misc=%257B%2522request%255Fid%2522%253A%2522167910144716800188564203%2522%252C%2522scm%2522%253A%252220140713.130102334..%2522%257D&request_id=167910144716800188564203&biz_id=0&utm_medium=distribute.pc_search_result.none-task-blog-2~all~top_positive~default-1-128673338-null-null.142^v74^insert_down3,201^v4^add_ask,239^v2^insert_chatgpt&utm_term=yolov8&spm=1018.2226.3001.4187

写回答
好问题 0 提建议
追加酬金
关注问题
分享
邀请回答
编辑收藏删除
收藏举报

3条回答默认最新

关注

码龄粉丝数原力等级 --

被采纳

被点赞

采纳率
CSDN专家-sinJack 2023-03-21 01:20
关注
文件不存在，用的是相对路径读取，文件路径不对。
改用绝对路径吧，直接取xml所在磁盘位置。

本回答被题主选为最佳回答 , 对您是否有帮助呢?

解决无用
评论打赏
分享
举报编辑记录

评论

按下Enter换行，Ctrl+Enter发表内容

查看更多回答(2条)

报告相同问题？

关注问题

将xml文件转换成YOLO系列标准读取的txt文件时出现问题 python pytorch 有问必答深度学习
2023-03-21 00:23

回答 3 已采纳文件不存在，用的是相对路径读取，文件路径不对。改用绝对路径吧，直接取xml所在磁盘位置。
YOLO5训练时候文件已存在问题 python 机器学习目标检测
2023-04-17 11:24

回答 2 已采纳我重装以后解决了，我自己也不知道为什么
Yolo的检测结果txt生成问题 python 目标检测
2023-03-28 11:02

回答 1 已采纳这里加上一句看下
YOLO训练之标注数据转化XML matlab编程
2016-05-02 10:30

小_小_杨_的博客 YOLO训练一、数据准备数据转化数据存储的方式图片名称存在第一行接下来每一行存储一个目标框，分别为x坐标，y坐标，w宽，h高，c类别存储的方式如下： matlab代码如下：clear addpath(genpath('VOCdevkit'));%...
将yolov5 train编译成exe出问题了，执行到读取数据集时无限生成桌面 opencv python 目标检测
2022-05-23 09:39

回答 1 已采纳 train里面是多线程调用的，你看下numwork这个参数是不是和你的生成窗口一样多，你可以将这个参数设置为0看下
关于yolo文件之间的一些关系 dnn opencv python
2023-01-12 20:38

回答 1 已采纳 YOLO（You Only Look Once）目标检测算法在训练过程中需要cfg文件和weight文件。 cfg文件是配置文件，包含了网络结构的信息，如层数、每层神经元的数量等，在训练过程中用来指导
yolo训练出来的pt和pth文件怎么用于微信小程序 python 微信小程序有问必答深度学习
2022-03-17 17:08

回答 2 已采纳 pt/pth->onnx->ncnn然后部署可以用ncnn部署在安卓app上面，不过我没试过小程序和安卓的app部署，不知道这两个区别，这个得你自己去研究了，直接用app运行是可以的。你可
YOLO代码详解（一）
2023-07-14 16:25

darren_ying0000的博客 images：存放训练验证图片 labels: （可通过代码将xml格式文件进行转换）存放YOLO格式的标签其中每一个.txt对应images中一个.jpg；.txt中每一行对应一个gt框。坐标均除以原图的长宽以归一化。第一个是标签号，从0...
yolov8训练时出现AttributeError: 'YOLO' object has no attribute 'load' python pytorch 有问必答深度学习
2023-04-15 16:01

回答 2 已采纳这个错误可能是因为你的YOLO对象没有load属性，通常是因为你的代码中没有正确地实例化YOLO对象或者是没有正确地调用相关函数。有几种可能的解决方法： 1.检查YOLO类的代码，确保它具有load
yolo训练时能不能使用之前训练出来的权重文件继续在新的数据集上训练？可以提高准确率吗 tensorflow 机器学习目标检测
2022-04-21 22:20

回答 2 已采纳一般来说用之前的权重文件当作预训练模型是有助于提高一些准确率的，前提条件是你的新数据对于旧数据集来说是新的数据分布（除非新数据和旧数据差不多，不然增加数据量可以增大数据分布区间的）
在写一个印章检测的测试代码时出现问题 python 人工智能开发语言有问必答
2023-04-07 10:15

回答 4 已采纳 Infer_main中没有定义model_path属性，或者定义的不对，导致代码没有检测到。你要在init方法中把 self.model_path = yolo_model_path放在第一行，因为你
YOLO系列（v1~v3）的学习及YOLO-Fastest在海思平台的部署（中）
2021-06-21 23:00

燕卫博的博客 YOLO系列（v1~v3）的学习及YOLO-Fastest在海思平台的部署（上） YOLO系列（v1~v3）的学习及YOLO-Fastest在海思平台的部署（中） YOLO系列（v1~v3）的学习及YOLO-Fastest在海思平台的部署（下）文章目录声明2 工程...
yolov5训练自己的数据集时出现的的问题人工智能开发语言深度学习
2022-05-25 21:20

回答 1 已采纳配置文件后缀是yaml而不是pt模型
史上最详细yolov5环境配置搭建+配置所需文件
2020-07-31 00:21

想到好名再改的博客 yolov5的配置过程总体来说还算简单，但是网上大部分博客都没有仔细介绍具体步骤，本文将从最细节的层面记录yolov5环境配置的全过程使用到的工具有 1.anaconda，pycharm 2.cuda10.2+cudnn-10.2-windows10-x64-v7.6....
Java解析XML文件的四种方法
2016-07-15 10:42

L_in12的博客可扩展标志语言（XML）在实现信息标准化、信息的交流与共享上有其独特的技术优势，因此受到了广泛的重视。本文先简单的介绍了XML基本知识，然后从XML应用入手总结了四种现今最常见的XML的解析方法，介绍了这四种方法...
没有解决我的问题, 去提问

问题事件

关注

码龄粉丝数原力等级 --

被采纳

被点赞

采纳率
系统已结题 4月3日
关注

码龄粉丝数原力等级 --

被采纳

被点赞

采纳率
已采纳回答 3月26日
关注

码龄粉丝数原力等级 --

被采纳

被点赞

采纳率
创建了问题 3月21日

悬赏问题

¥170 如图所示配置eNSP
¥20 docker里部署springboot项目，访问不到扬声器
¥15 netty整合springboot之后自动重连失效
¥15 悬赏！微信开发者工具报错，求帮改
¥20 wireshark抓不到vlan
¥20 关于#stm32#的问题：需要指导自动酸碱滴定仪的原理图程序代码及仿真
¥20 设计一款异域新娘的视频相亲软件需要哪些技术支持
¥15 stata安慰剂检验作图但是真实值不出现在图上
¥15 c程序不知道为什么得不到结果
¥15 键盘指令混乱情况下的启动盘系统重装

将xml文件转换成YOLO系列标准读取的txt文件时出现问题

3条回答 默认 最新

问题事件

悬赏问题

3条回答默认最新