当前位置：首页 > article >正文

Transformers x SwanLab:可视化NLP模型训练（2025最新版）

article 2026/2/27 22:11:01

HuggingFace 的 Transformers 是目前最流行的深度学习训框架之一（100k+ Star），现在主流的大语言模型（LLaMa系列、Qwen系列、ChatGLM系列等）、自然语言处理模型（Bert系列）等，都在使用Transformers来进行预训练、微调和推理。

在这里插入图片描述

SwanLab 是一个深度学习实验管理与训练可视化工具，融合了Weights & Biases与Tensorboard的特点，能够方便地进行训练可视化、多实验对比、超参数记录、大型实验管理和团队协作，并支持用网页链接的方式分享你的实验。

你可以使用Transformers快速进行模型训练，同时使用SwanLab进行实验跟踪与可视化。

transformers>=4.50.0 的版本，已官方集成了SwanLab
如果你的版本低于4.50.0，请使用SwanLabCallback集成。

1. 一行代码完成集成

只需要在你的训练代码中，找到TrainingArguments部分，添加report_to="swanlab"参数，即可完成集成。

from transformers import TrainingArguments, Trainerargs = TrainingArguments(...,report_to="swanlab" # [!code ++]
)trainer = Trainer(..., args=args)

2. 自定义项目名

默认下，项目名会使用你运行代码的目录名。

如果你想自定义项目名，可以设置SWANLAB_PROJECT环境变量：

::: code-group

import os
os.environ["SWANLAB_PROJECT"]="qwen2-sft"

export SWANLAB_PROJECT="qwen2-sft"

set SWANLAB_PROJECT="qwen2-sft"

:::

3. 案例代码：Bert文本分类

import evaluate
import numpy as np
from datasets import load_dataset
from transformers import AutoModelForSequenceClassification, AutoTokenizer, Trainer, TrainingArgumentsdef tokenize_function(examples):return tokenizer(examples["text"], padding="max_length", truncation=True)def compute_metrics(eval_pred):logits, labels = eval_predpredictions = np.argmax(logits, axis=-1)return metric.compute(predictions=predictions, references=labels)dataset = load_dataset("yelp_review_full")tokenizer = AutoTokenizer.from_pretrained("bert-base-cased")tokenized_datasets = dataset.map(tokenize_function, batched=True)small_train_dataset = tokenized_datasets["train"].shuffle(seed=42).select(range(1000))
small_eval_dataset = tokenized_datasets["test"].shuffle(seed=42).select(range(1000))metric = evaluate.load("accuracy")model = AutoModelForSequenceClassification.from_pretrained("bert-base-cased", num_labels=5)training_args = TrainingArguments(output_dir="test_trainer",num_train_epochs=3,logging_steps=50,report_to="swanlab", # [!code ++]
)trainer = Trainer(model=model,args=training_args,train_dataset=small_train_dataset,eval_dataset=small_eval_dataset,compute_metrics=compute_metrics,
)trainer.train()

4. SwanLabCallback集成

如果你使用的是Transformers<4.50.0的版本，或者你希望更灵活地控制SwanLab的行为，则可以使用SwanLabCallback集成。

4.1 引入SwanLabCallback

from swanlab.integration.transformers import SwanLabCallback

SwanLabCallback是适配于Transformers的日志记录类。

SwanLabCallback可以定义的参数有：

project、experiment_name、description 等与 swanlab.init 效果一致的参数, 用于SwanLab项目的初始化。
你也可以在外部通过swanlab.init创建项目，集成会将实验记录到你在外部创建的项目中。

4.2 传入Trainer

from swanlab.integration.transformers import SwanLabCallback
from transformers import Trainer, TrainingArguments...# 实例化SwanLabCallback
swanlab_callback = SwanLabCallback(project="hf-visualization")trainer = Trainer(...# 传入callbacks参数callbacks=[swanlab_callback],
)trainer.train()

4.3 完整案例代码

import evaluate
import numpy as np
import swanlab
from swanlab.integration.transformers import SwanLabCallback
from datasets import load_dataset
from transformers import AutoModelForSequenceClassification, AutoTokenizer, Trainer, TrainingArgumentsdef tokenize_function(examples):return tokenizer(examples["text"], padding="max_length", truncation=True)def compute_metrics(eval_pred):logits, labels = eval_predpredictions = np.argmax(logits, axis=-1)return metric.compute(predictions=predictions, references=labels)dataset = load_dataset("yelp_review_full")tokenizer = AutoTokenizer.from_pretrained("bert-base-cased")tokenized_datasets = dataset.map(tokenize_function, batched=True)small_train_dataset = tokenized_datasets["train"].shuffle(seed=42).select(range(1000))
small_eval_dataset = tokenized_datasets["test"].shuffle(seed=42).select(range(1000))metric = evaluate.load("accuracy")model = AutoModelForSequenceClassification.from_pretrained("bert-base-cased", num_labels=5)training_args = TrainingArguments(output_dir="test_trainer",# 如果只需要用SwanLab跟踪实验，则将report_to参数设置为”none“report_to="none",num_train_epochs=3,logging_steps=50,
)# 实例化SwanLabCallback
swanlab_callback = SwanLabCallback(experiment_name="TransformersTest")trainer = Trainer(model=model,args=training_args,train_dataset=small_train_dataset,eval_dataset=small_eval_dataset,compute_metrics=compute_metrics,# 传入callbacks参数callbacks=[swanlab_callback],
)trainer.train()

4.4 GUI效果展示

超参数自动记录：

在这里插入图片描述

指标记录：

在这里插入图片描述

4.5 拓展：增加更多回调

试想一个场景，你希望在每个epoch结束时，让模型推理测试样例，并用swanlab记录推理的结果，那么你可以创建一个继承自SwanLabCallback的新类，增加或重构生命周期函数。比如：

class NLPSwanLabCallback(SwanLabCallback):    def on_epoch_end(self, args, state, control, **kwargs):test_text_list = ["example1", "example2"]log_text_list = []for text in test_text_list:result = model(text)log_text_list.append(swanlab.Text(result))swanlab.log({"Prediction": test_text_list}, step=state.global_step)

上面是一个在NLP任务下的新回调类，增加了on_epoch_end函数，它会在transformers训练的每个epoch结束时执行。

查看全部的Transformers生命周期回调函数：链接

5. 环境变量

参考：HuggingFace Docs: transformers.integrations.SwanLabCallback

Transformers x SwanLab:可视化NLP模型训练（2025最新版）

HuggingFace 的 Transformers 是目前最流行的深度学习训框架之一（100k Star），现在主流的大语言模型（LLaMa系列、Qwen系列、ChatGLM系列等）、自然语言处理模型（Bert系列）等，都在使用T…...

编程日记 2026/2/15 19:25:54

VSCode 抽风之两个conda环境同时在被激活

出现了神奇的(toolsZCH)(base) 提示符，如下图所示： 原因大概是：conda 环境的双重激活：可能是 conda 环境没有被正确清理或初始化，导致 base 和 toolsZCH 同时被激活。解决办法就是 ：conda deactivate 两次…...

编程日记 2026/2/14 20:50:58

Android项目实战搭建 MVVM架构

View层具体代码： activity: /*** description:* 普通Activity基类，不带ViewModel,显示基本加载状态* 需要获取到子类的布局id用于databinding的绑定* author YL Chen* date 2024/9/4 21:34* version 1.0*/ abstract class BaseActivity<VB : ViewD…...

编程日记 2026/2/26 23:05:56

Mybatis的基础操作——03

写mybatis代码的方法有两种： 注解xml方式本篇就介绍XML的方式使用XML来配置映射语句能够实现复杂的SQL功能，也就是将sql语句写到XML配置文件中。目录一、配置XML文件的路径，在resources/mapper 的目录下二、写持久层代码 1.添加mappe…...

编程日记 2026/2/15 12:39:36

React：React主流组件库对比

1、Material-UI | 官网 | GitHub | GitHub Star: 94.8k Material-UI 是一个实现了 Google Material Design 规范的 React 组件库。 Material UI 包含了大量预构建的 Material Design 组件，覆盖导航、滑块、下拉菜单等各种常用组件，并都提供了高度的可定制…...

编程日记 2026/2/18 18:46:20

奇迹科技：蓝牙网关赋能少儿篮球教育的创新融合案例研究

一、引言本文研究了福建奇迹运动体育科技有限公司（简称‘奇迹科技’）如何利用其创新产品体系和桂花网蓝牙网关M1500，与少儿篮球教育实现深度融合。重点分析其在提升教学效果、保障训练安全、优化个性化教学等方面的实践与成效，为…...

编程日记 2026/2/13 8:23:01

分享最近前端面试遇到的一些问题

前情提要（分享个人情况，可以直接跳过） 先说一下我的个人情况，我是2026届的，目前是在找前端实习。 3月初，从3月3日开始在Boss上投简历。分享我的个人故事，不想看可以直接滑到下面，…...

编程日记 2026/2/26 4:33:21

嵌入式基础知识学习：SPI通信协议是什么？

SPI（Serial Peripheral Interface）是串行外设接口的缩写，是一种广泛应用于嵌入式系统的高速同步串行通信协议，由摩托罗拉公司于20世纪80年代提出。以下是其核心要点： 一、SPI的核心定义与特点基本特性全双工同步通信…...

编程日记 2026/2/16 17:39:26

python每日十题(6)

】函数定义：函数是指一组语句的集合通过一个名字（函数名）封装起来，要想执行这个函数，只需要调用其函数名即可。函数能提高应用的模块性和代码的重复利用率在Python语言中，用关键字class来定义类在Python语…...

编程日记 2026/2/14 22:46:13

1.Go - Hello World

1.安装Go依赖 https://go.dev/dl/ 根据操作系统选择适合的依赖，比如windows： 2.配置环境变量右键此电脑 - 属性 - 环境变量 PS： GOROOT：Go依赖路径； GOPATH：Go项目路径； …...

编程日记 2026/2/15 9:43:56

优先队列 priority_queue详解

说到，priority_queue优先队列。必须先要了解啥是堆与运算符重载(我在下方有解释)。否则只知皮毛，极易忘记寸步难行。但在开头，还是简单的说下怎么用首先，你需要调用 #include <queue> 在main函数中，声明…...

编程日记 2026/2/27 19:38:21

《信息系统安全》（第一次上机实验报告）

实验一 ：网络协议分析工具Wireshark 一实验目的学习使用网络协议分析工具Wireshark的方法，并用它来分析一些协议。二实验原理 TCP/IP协议族中网络层、传输层、应用层相关重要协议原理。网络协议分析工具Wireshark的工作原理和基本使用规则。三实…...

编程日记 2026/2/19 7:33:16

C++实现求解24点游戏

力扣原题：679. 24 点游戏 - 力扣（LeetCode） 判断四个数字能否通过加减乘除得到24点使用回溯遍历四个数字的每一种组合，具体来说，每次从数组中选取两个数字以加减乘除四种方式得到一个新的数字，这样数组的…...

编程日记 2026/2/25 9:21:24

Java-腾讯云短信模板兼容阿里云短信模板-短信模板参数生成

最新版本更新 https://code.jiangjiesheng.cn/article/362?fromcsdn 模板腾讯云：您好！{}的${}，有{}发生{} 阿里云：您好！${orgName}的${monitorName}，有${equipName}发生${status} 原腾讯云短信发送的代码…...

编程日记 2026/2/14 12:43:34

简要分析IPPROTO_TCP参数

IPPROTO_TCP是操作系统或网络编程中定义的一个协议号常量，用于标识传输控制协议（TCP）。其核心作用是在传输层指定使用TCP协议，确保数据通过TCP的可靠传输机制进行通信。一、定义与值头文件：定义在<netinet/in.…...

编程日记 2026/2/27 9:26:25

SOFABoot-06-健康检查

前言大家好，我是老马。 sofastack 其实出来很久了，第一次应该是在 2022 年左右开始关注，但是一直没有深入研究。最近想学习一下 SOFA 对于生态的设计和思考。 sofaboot 系列 SOFABoot-00-sofaboot 概览 SOFABoot-01-蚂蚁金服开源的 s…...

编程日记 2026/2/22 23:18:43

如何理解java中Stream流？

在Java中，Stream 是 Java 8 引入的一个强大API，用于处理集合（如 List、Set、Map 等）数据的流式操作。它提供了一种声明式、函数式的编程风格，可以高效地进行过滤、映射、排序、聚合等操作。 Stream 的核心概念流&…...

编程日记 2026/2/14 1:15:45

Android使用RxHttp进行国密4加密解密

国密SM4加解密问题汇总前言国密4加解密工具类RxHttp统一加解密处理解密前言为了网络安全需要对app内请求数据接口使用SM4国密4进行加解密操作，在实施的过程中遇到了些问题也收获颇丰，特此记录在线SM4加密测试网址: 点击此进入网址. 国密4加解密工具类这里我使用的是b…...

编程日记 2026/2/15 6:43:11

【自学笔记】Linux基础知识点总览-持续更新

提示：文章写完后，目录可以自动生成，如何生成可参考右边的帮助文档文章目录 Linux 基础知识点总览目录Linux 简介文件和目录结构常用命令文件操作目录操作权限管理文本处理 Shell 脚本基础进程管理用户和组管理网络配置总结 Linux 基础知识点…...

编程日记 2026/2/26 10:45:46

JavaScript与客户端开发

1、简介简单的讲，JavaScript是一种脚本语言，为网站提供了一种在客户端运行程序的手段，通过它可以实现客户端数据验证、网页特效等功能。 JavaScript是一种基于对象和事件驱动（不懂啥意思，暂不管它）&…...

编程日记 2026/2/16 4:34:22

基于CNN的FashionMNIST数据集识别5——GoogleNet模型

源码 import torch from torch import nn from torchsummary import summaryclass Inception(nn.Module):def __init__(self, in_channels, c1, c2, c3, c4):super().__init__()self.ReLu nn.ReLU()#路径1self.p1_1 nn.Conv2d(in_channelsin_channels, out_channelsc1, kern…...

编程日记 2026/2/26 5:33:53

1. 一行代码完成集成

2. 自定义项目名

3. 案例代码：Bert文本分类

4. SwanLabCallback集成

4.1 引入SwanLabCallback

4.2 传入Trainer

4.3 完整案例代码

4.4 GUI效果展示

4.5 拓展：增加更多回调

5. 环境变量

相关文章：