当前位置：首页 > news >正文

yolov8+ROS+ubuntu18.04——学习记录

news 2026/5/23 9:54:26

参考文献

1.Ubuntu配置Yolov8环境并训练自己的数据集 + ROS实时运行

2.https://juejin.cn/post/7313979467965874214

前提：

1.CUDA和Anaconda，PyTorch

2.python>=3.8

一、创建激活环境，安装依赖

1.创建虚拟环境

conda create -n yolov8 python=3.8

2.激活虚拟环境

conda activate yolov8

3.安装yolov8

pip install ultralytics

清华源安装

pip install ultralytics -i  https://pypi.tuna.tsinghua.edu.cn/simple/

安装rospkg

pip install rospkg

二、安装数据标注软件并使用

1.激活刚刚建的虚拟环境

conda activate yolov8

2.安装数据标注软件

pip install labelImg

清华源安装

pip install labelImg -i  https://pypi.tuna.tsinghua.edu.cn/simple/

3.启动标注软件

labelImg

4.标注软件的使用

(1).打开目录：选择你拍摄图片存放的文件夹，我的是yolo2/data/images

(2).改变存放目录：选择你要将标注存放的文件夹，yolo2/data/Annotations

(3).选中查看-自动保存：这样无需自己保存

(4).点击创建区块：对要识别的物体进行标注，标注框紧贴物体，请勿框大或框小，有几个框几个，勿遗漏，不要两个框一起

(5).标签模式pascalVOC可以先不改成yolo模式，因为它保存的信息比较多，如果确定只用yolo也可以选择yolo模式

三、数据集的制作

在不同背景下拍摄要识别物体的照片，放在yolo2/data/images中。data下的文件夹包括：

（1）.Annotations:数据集标注的文件（.xml）

（2）.images：数据集图片（.jpg）

（3）.ImageSets：数据集划分（.txt）

（4）.labels：数据集标注，yolo格式版（.txt）

数据集标注完成后，images、Annotations有了内容

1.数据集划分

yolo2文件夹下，创建一个文件splitDataset.py，内容如下：

import random
import ostrainval_percent = 0.9
train_percent = 0.9
xmlfilepath = 'data/Annotations'
txtsavepath = 'data/ImageSets'
total_xml = os.listdir(xmlfilepath)num = len(total_xml)
list = range(num)
tv = int(num * trainval_percent)
tr = int(tv * train_percent)
trainval = random.sample(list, tv)
train = random.sample(trainval, tr)ftrainval = open('data/ImageSets/trainval.txt', 'w')
ftest = open('data/ImageSets/test.txt', 'w')
ftrain = open('data/ImageSets/train.txt', 'w')
fval = open('data/ImageSets/val.txt', 'w')for i in list:name = total_xml[i][:-4] + '\n'if i in trainval:ftrainval.write(name)if i in train:ftrain.write(name)else:fval.write(name)else:ftest.write(name)ftrainval.close()
ftrain.close()
fval.close()
ftest.close()

运行，ImageSets中会出现

2.将xml文件转换成yolo格式的txt文件

同样位置创建一个文件XML2TXT.py，内容如下

# xml解析包
import xml.etree.ElementTree as ET
import pickle
import os
from os import listdir, getcwd
from os.path import joinsets = ['train', 'test', 'val']
classes = ['nut,bolt']# 进行归一化操作
def convert(size, box): # size:(原图w,原图h) , box:(xmin,xmax,ymin,ymax)dw = 1./size[0]     # 1/wdh = 1./size[1]     # 1/hx = (box[0] + box[1])/2.0   # 物体在图中的中心点x坐标y = (box[2] + box[3])/2.0   # 物体在图中的中心点y坐标w = box[1] - box[0]         # 物体实际像素宽度h = box[3] - box[2]         # 物体实际像素高度x = x*dw    # 物体中心点x的坐标比(相当于 x/原图w)w = w*dw    # 物体宽度的宽度比(相当于 w/原图w)y = y*dh    # 物体中心点y的坐标比(相当于 y/原图h)h = h*dh    # 物体宽度的宽度比(相当于 h/原图h)return (x, y, w, h)    # 返回 相对于原图的物体中心点的x坐标比,y坐标比,宽度比,高度比,取值范围[0-1]# year ='2012', 对应图片的id（文件名）
def convert_annotation(image_id):'''将对应文件名的xml文件转化为label文件，xml文件包含了对应的bunding框以及图片长款大小等信息，通过对其解析，然后进行归一化最终读到label文件中去，也就是说一张图片文件对应一个xml文件，然后通过解析和归一化，能够将对应的信息保存到唯一一个label文件中去labal文件中的格式：calss x y w h　　同时，一张图片对应的类别有多个，所以对应的ｂｕｎｄｉｎｇ的信息也有多个'''# 对应的通过year 找到相应的文件夹，并且打开相应image_id的xml文件，其对应bund文件in_file = open('data/Annotations/%s.xml' % (image_id), encoding='utf-8')# 准备在对应的image_id 中写入对应的label，分别为# <object-class> <x> <y> <width> <height>out_file = open('data/labels/%s.txt' % (image_id), 'w', encoding='utf-8')# 解析xml文件tree = ET.parse(in_file)# 获得对应的键值对root = tree.getroot()# 获得图片的尺寸大小size = root.find('size')# 如果xml内的标记为空，增加判断条件if size != None:# 获得宽w = int(size.find('width').text)# 获得高h = int(size.find('height').text)# 遍历目标objfor obj in root.iter('object'):# 获得difficult ？？difficult = obj.find('difficult').text# 获得类别 =string 类型cls = obj.find('name').text# 如果类别不是对应在我们预定好的class文件中，或difficult==1则跳过if cls not in classes or int(difficult) == 1:continue# 通过类别名称找到idcls_id = classes.index(cls)# 找到bndbox 对象xmlbox = obj.find('bndbox')# 获取对应的bndbox的数组 = ['xmin','xmax','ymin','ymax']b = (float(xmlbox.find('xmin').text), float(xmlbox.find('xmax').text), float(xmlbox.find('ymin').text),float(xmlbox.find('ymax').text))print(image_id, cls, b)# 带入进行归一化操作# w = 宽, h = 高， b= bndbox的数组 = ['xmin','xmax','ymin','ymax']bb = convert((w, h), b)# bb 对应的是归一化后的(x,y,w,h)# 生成 calss x y w h 在label文件中out_file.write(str(cls_id) + " " + " ".join([str(a) for a in bb]) + '\n')# 返回当前工作目录
wd = getcwd()
print(wd)for image_set in sets:'''对所有的文件数据集进行遍历做了两个工作：１．将所有图片文件都遍历一遍，并且将其所有的全路径都写在对应的txt文件中去，方便定位２．同时对所有的图片文件进行解析和转化，将其对应的bundingbox 以及类别的信息全部解析写到label 文件中去最后再通过直接读取文件，就能找到对应的label 信息'''# 先找labels文件夹如果不存在则创建if not os.path.exists('data/labels/'):os.makedirs('data/labels/')# 读取在ImageSets/Main 中的train、test..等文件的内容# 包含对应的文件名称image_ids = open('data/ImageSets/%s.txt' % (image_set)).read().strip().split()# 打开对应的2012_train.txt 文件对其进行写入准备list_file = open('data/%s.txt' % (image_set), 'w')# 将对应的文件_id以及全路径写进去并换行for image_id in image_ids:list_file.write('data/images/%s.jpg\n' % (image_id))# 调用  year = 年份  image_id = 对应的文件名_idconvert_annotation(image_id)# 关闭文件list_file.close()

这一步产生的yolo2下面的.txt文件有用，但是转xml文件没成功，不知道为什么，所以再在同样位置创建一个文件XML2TXT2.py，内容如下

# -*- coding: utf-8 -*-
#这个可以运行
import os
import xml.etree.ElementTree as ETdirpath = 'data/Annotations'  # 原来存放xml文件的目录
newdir = 'data/labels'                # 修改label后形成的txt目录if not os.path.exists(newdir):os.makedirs(newdir)dict_info = {'nut': 0, 'bolt': 1}             # 有几个 属性 填写几个label namesfor fp in os.listdir(dirpath):if fp.endswith('.xml'):root = ET.parse(os.path.join(dirpath, fp)).getroot()xmin, ymin, xmax, ymax = 0, 0, 0, 0sz = root.find('size')width = float(sz[0].text)height = float(sz[1].text)filename = root.find('filename').textfor child in root.findall('object'):  # 找到图片中的所有框sub = child.find('bndbox')  # 找到框的标注值并进行读取label = child.find('name').textlabel_ = dict_info.get(label)if label_:label_ = label_else:label_ = 0xmin = float(sub[0].text)ymin = float(sub[1].text)xmax = float(sub[2].text)ymax = float(sub[3].text)try:  # 转换成yolov3的标签格式，需要归一化到（0-1）的范围内x_center = (xmin + xmax) / (2 * width)x_center = '%.6f' % x_centery_center = (ymin + ymax) / (2 * height)y_center = '%.6f' % y_centerw = (xmax - xmin) / widthw = '%.6f' % wh = (ymax - ymin) / heighth = '%.6f' % hexcept ZeroDivisionError:print(filename, '的 width有问题')with open(os.path.join(newdir, fp.split('.xml')[0] + '.txt'), 'a+') as f:f.write(' '.join([str(label_), str(x_center), str(y_center), str(w), str(h) + '\n']))
print('ok')

运行之后，labels文件夹下会出现相关文件。

3.data下新建fall.yaml

内容

train: /home/dyj/yolo3/data/train.txt
val: /home/dyj/yolo3/data/val.txt
test: /home/dyj/yolo3/data/test.txt# number of classes
nc: 2# class names
names: ['nut','bolt']

nc：类别数量 names: ['nut','bolt']：类别名称需要修改

四、运行

yolo task=detect mode=train model=yolov8n.pt data=data/fall.yaml batch=32 epochs=100 imgsz=640 workers=16 device=0

yolov8+ROS+ubuntu18.04——学习记录

参考文献 1.Ubuntu配置Yolov8环境并训练自己的数据集 ROS实时运行 2.https://juejin.cn/post/7313979467965874214 前提： 1.CUDA和Anaconda，PyTorch 2.python>3.8 一、创建激活环境，安装依赖 1.创建虚拟环境 conda create -n yol…...

编程日记 2024/5/28 3:05:47

Java小抄(一)｜Java中的List与Set转换

文章目录 List和Set的区别线程安全的区别相互转换List->SetSet->List List和Set的区别在Java中，List和Set都是集合接口，它们之间有几个关键的区别： 重复元素： List允许重复元素，可以存储相同的元素多次。Set…...

编程日记 2024/5/28 3:04:46

【每日随笔】小人畏威不怀德 , 君子畏德不畏威 ( 先礼后兵 )

文章目录一、小人畏威不怀德1、小人畏威不怀德2、小人场景一3、小人场景二二、君子畏德不畏威三、先礼后兵一、小人畏威不怀德 1、小人畏威不怀德如果友善的对待小人 , 这种人认知低且素质差 , 小人会将你的 " 友善 " 理解为 " 屈服 " , 他会认…...

编程日记 2024/5/28 3:02:44

不一样的2024

当我们继续往前走时，发现身边的事物不再那么的陌生，也不再那边多的阻碍，不管怎么，2024将会不一样。当我们走进审批流时，全面石荒芜的，所以自己构建了一个体系。当我们转向开源时，发现开源与…...

编程日记 2024/5/28 2:59:39

linux mv操作和cp操作

mv 和 cp 是 Linux 系统中用于移动和复制文件或文件夹的两个常用命令，它们之间的主要区别在于： mv（move）：mv 命令用于移动文件或文件夹，将它们从一个位置移动到另一个位置。移动后，原始文件或文…...

编程日记 2024/5/28 2:58:38

第十二届蓝桥杯物联网试题（国赛）

不得不说国赛相比较省赛而言确实，功能变得更加复杂，更加繁琐，特别是串口LORA通信相结合的更加频繁，且对收取的字符处理要求要更加复杂，处理判别起来会更加复杂。对于收发数据本身来说，收发的数据本身是以…...

编程日记 2024/5/28 2:54:34

小而美的前端库推荐

小而美，指的是“小即是美”的事物，这是马云在 2009年 APEC 中小企业峰会上首次提出的观点 👍 前端有很多小而美的库，接入成本很低又能满足日常开发需求 🎉...

编程日记 2024/5/28 2:53:33

【LeetCode】力扣第 399 场周赛优质数对的总数 II

文章目录 1. 优质数对的总数 II 1. 优质数对的总数 II 题目链接 🍎该题涉及的小技巧：🐥 🐧①一次可以统计这个数的两个因子但是要注意 25 5 * 5，这种情况 5 只能统计一次噢🆒 解题思路: &#x1f427…...

编程日记 2024/5/28 2:51:32

YOLOv8+PyQt5面部表情检测系统完整资源集合(yolov8模型，从图像、视频和摄像头三种路径识别检测，包含登陆页面、注册页面和检测页面)

1.资源包含可视化的面部表情检测系统，基于最新的YOLOv8训练的面部表情检测模型，和基于PyQt5制作的可视化面部表情检测系统，包含登陆页面、注册页面和检测页面，该系统可自动检测和识别图片或视频当中出现的八类面部表情&#xff1a…...

编程日记 2024/5/28 2:50:30

ROS 工作空间

ROS 工作空间工作空间概念 ROS 的工作空间在 ROS 中，工作空间（通常称为 Catkin 工作空间）是一个文件夹（目录）结构，它用于组织、构建和管理 ROS 项目中的软件包。主要特点包括： 1. 目录结构…...

编程日记 2024/5/28 2:49:29

【科普】ChatGPT-4o 是什么？和之前的ChatGPT4.0有什么区别，各有什么优劣势

文章目录前言一、ChatGPT-4o 是什么？**主要特点和改进**： 二、ChatGPT-4o 和之前的ChatGPT4.0有什么区别，各有什么优劣势区别优势和劣势ChatGPT-4.0ChatGPT-4o 前言 5月13日，ChatGPT-4o发布，是人工智能的进一步发展&…...

编程日记 2024/5/28 2:48:28

django-celery-beat自动调度异步任务

Celery是一个简单、灵活且可靠的分布式系统，专门用于处理大量消息的实时任务调度。它支持使用任务队列的方式在分布的机器、进程、线程上执行任务调度。Celery不仅支持异步任务（如发送邮件、文件上传、图像处理等耗时操作），还支持…...

编程日记 2024/5/28 2:47:27

【CSharp】将ushort数组保存为1通道位深16bit的Tiff图片

【CSharp】将ushort数组保存为1通道位深16bit的Tiff图片 1.背景2.接口 1.背景 System.Drawing.Common 是一个用于图像处理和图形操作的库，它是 System.Drawing 命名空间的一部分。由于 .NET Core 和 .NET 5 的跨平台特性，许多以前内置于 .NET Framework…...

编程日记 2024/5/28 2:46:26

Bug：Linux用户拥有r权限但无法打开文件【Linux权限体系】

Bug：Linux用户拥有r权限但无法打开文件【Linux权限体系】 0 问题描述&解决问题描述： 通过go编写了一个程序，产生的/var/log/xx日志文件发现普通用户无权限打开 - 查看文件权限发现该文件所有者、所有者组、其他用户均有r权限 - 查看该日…...

编程日记 2024/5/28 2:45:26

【Redis】Widows 和 Linux 下使用 Redis

Redis 简述 1.缓存缓存就是将数据存放在距离计算最近的位置以加快处理速度。缓存是改善软件性能的第一手段，现代 CPU 越来越快的一个重要因素就是使用了更多的缓存，在复杂的软件设计中，缓存几乎无处不在。大型网站架构设计在很多方面都使用了缓存设计。 2.Redis Redis …...

编程日记 2024/5/28 2:44:24

统计计算四|蒙特卡罗方法（Monte Carlo Method）

系列文章目录统计计算一|非线性方程的求解统计计算二|EM算法（Expectation-Maximization Algorithm，期望最大化算法） 统计计算三|Cases for EM 文章目录系列文章目录一、基本概念（一）估算 π \pi π（二&…...

编程日记 2024/5/28 2:43:23

大模型时代的具身智能系列专题(三)

清华高阳团队高阳为清华叉院助理教授，本科毕业于清华大学计算机系，博士毕业于UC Berkeley。博士导师是Vision领域的大牛Trevor Darrell，读博期间和Sergey Levine合作开始强化学习方面的探索，博后跟随Pieter Abbeel做强化学习&am…...

编程日记 2024/5/28 2:41:21

使用 FileZilla 在 Windows 和 Ubuntu 之间传文件

网线一端插在板子的WAN口上，另一段插在电脑上，然后要配一下板子的IP。板侧： 使用串口链接板子与PC端； 输入指令 ifconfig eth0（具体看wan口对应哪一个） 192.168.1.99 PC端配置： 打开网络设…...

编程日记 2024/5/28 2:40:20

【C++初阶】—— 类和对象 (上）

📝个人主页🌹：EterNity_TiMe_ ⏩收录专栏⏪：C “ 登神长阶 ” 🌹🌹期待您的关注 🌹🌹 类和对象 1. 初步认识C2. 类的引入3. 类的定义声明和定义全部放在类体中声明和定义分开存放 4.…...

编程日记 2024/5/28 2:39:19

基础—SQL—图形化界面工具的DataGrip使用（2）

一、回顾与引言 （1） 上次内容，博客讲到了DDL语句的数据库操作、表操作、表字段的操作的相关语法，然而之前都是在MySQL的命令行当中去操作演示的。这种方式可以用，但是使用的话，第一，在我们日常…...

编程日记 2024/5/28 2:38:18

保姆级教程：在Gazebo中为你的ROS机器人添加激光雷达和摄像头（附完整xacro配置）

Gazebo传感器配置实战：从激光雷达到摄像头的全流程解析在机器人仿真开发中，让虚拟机器人"看得见"往往比让它"动起来"更具挑战性。许多开发者精心设计了URDF模型，却在Gazebo中遭遇传感器数据无法显示的困境——激光雷达没…...

编程新知 2026/5/23 8:07:15

企业内如何通过 Taotoken 实现 API 密钥的集中管理与访问审计

🚀 告别海外账号与网络限制！稳定直连全球优质大模型，限时半价接入中。 👉 点击领取海量免费额度企业内如何通过 Taotoken 实现 API 密钥的集中管理与访问审计在将大模型能力引入企业内部的业务流或开发流程时，一个常…...

编程新知 2026/5/23 6:36:45

在CentOS7服务器上装Win10双系统，我踩过的坑和保姆级避坑指南

在CentOS7服务器上部署Win10双系统的实战避坑指南当开发环境需要同时运行Linux服务与Windows专属应用时，双系统成为刚需。但服务器与家用PC的硬件架构差异，会让安装过程暗藏无数"深坑"。本文将分享我在生产环境中为戴尔PowerEdge R740服务器部…...

编程新知 2026/5/23 5:33:57

Triangle Splatting：可微分渲染中的三角形基元优化技术

1. Triangle Splatting：可微分渲染中的三角形基元革命在计算机图形学领域，三角形作为最基础的几何基元，长期以来一直是实时渲染管线的核心支柱。这种简单而强大的几何单元能够高效地表示复杂表面，得益于GPU硬件中专门的三角形处理…...

编程新知 2026/5/23 5:06:01

如何5分钟快速集成PinLockView到你的Android应用：终极指南 [特殊字符]

如何5分钟快速集成PinLockView到你的Android应用：终极指南 🚀 【免费下载链接】PinLockView A clean, minimal, highly customizable pin lock view for Android 项目地址: https://gitcode.com/gh_mirrors/pi/PinLockView PinLockView 是一个专为…...

编程新知 2026/5/23 4:41:57

大模型训练师的炼丹之道 (3)-更高级训练，如何把大规模知识“刻”入模型

前言在《炼丹之道》前两篇中，我们完成了从基础认知到身份重塑的入门仪式——当模型脱口而出“我是威震天”时，你已触摸到微调的魔法边缘。但那终究只是角色扮演的雏形，真正的炼丹术，在于将冰冷、精确的商业事实熔铸为模型的“肌…...

编程新知 2026/5/23 4:39:51

Python之anonymate包语法、参数和实际应用案例

一、AnonyMate 包概述 AnonyMate是 Python 第三方数据匿名化工具包，版本 0.1.5，专注结构化/非结构化数据脱敏、假名化、加密与合成数据生成，适配医疗、金融、电商等敏感数据场景，助力合规（GDPR、等保2.0）。…...

编程新知 2026/5/23 4:10:44

量子机器学习噪声挑战与HPQS混合框架解析

1. 量子机器学习中的噪声挑战与HPQS解决方案量子机器学习(QML)作为量子计算与经典机器学习的交叉领域，正在重新定义我们处理复杂模式识别问题的方式。与传统机器学习不同，QML利用量子态的叠加和纠缠特性，理论上可以在某些特定任务上实现指数级…...

编程新知 2026/5/23 4:02:40

Keil µVision TAB显示异常问题分析与解决方案

1. 问题现象与背景分析在Keil Vision集成开发环境中，部分用户遇到了编辑器界面显示异常的问题。具体表现为：当代码中包含TAB字符（制表符）时，屏幕上会出现奇怪的显示错乱，原本应该显示为空白缩进的区域&…...

编程新知 2026/5/23 4:00:39

量子纠错码与硬件定制逻辑门的优化实现

1. 量子纠错码与硬件定制逻辑门概述量子纠错码（QECC）是容错量子计算的核心组件，其核心思想是通过编码将量子信息分布在多个物理量子比特上，利用稳定子（stabilizer）测量来检测和纠正错误。在众多QECC中&…...