当前位置：首页 > news >正文

autodl+modelscope推理stable-diffusion-3.5-large

news 2026/2/9 22:04:31

本篇介绍如何在服务器上实现SD3.5模型的加载及推理，不包含训练及微调。

磁盘扩容

autodl服务器在关机状态下，进行扩容：
在这里插入图片描述

选择要扩容的大小（比如我这里已经扩了80G，默认有50G免费的），就会有一个计费出来：
在这里插入图片描述
扩容完成后配置开机就会自动生效，类似地也可以选择“升级配置”扩卡（如果有需要的话）。

下载模型

下载模型这里，折腾了挺久，还是选择国内源最便捷。魔塔社区有点像HF的意思。
可以使用SDK，或者git clone，也可以选择使用modelscope命令下载（建议用1、3方式下载，可以断点续传）

# 安装modelscope
pip install modelscope# 下载repo到指定路径
modelscope download --model AI-ModelScope/stable-diffusion-3.5-large --local_dir ./stable-diffusion-3.5-large

默认下载到系统盘路径/root/.cache/modelscope/hub/AI-ModelScope/stable-diffusion-3.5-large，这里需要指定到数据盘路径（虽然它的日志给出了误导人的提示）。

开始推理

使用离线模型文件，修改后的推理脚本：

import torch
from diffusers import StableDiffusion3Pipelinemodel_path = "stable-diffusion-3.5-large"
pipe = StableDiffusion3Pipeline.from_pretrained(model_path, torch_dtype=torch.bfloat16
)
pipe.enable_model_cpu_offload()image = pipe(prompt="a photo of a cat holding a sign that says hello world",negative_prompt="",num_inference_steps=40,height=1024,width=1024,guidance_scale=4.5,
).images[0]image.save("sd3_hello_world-1.png")

有一个问题是官方给的代码是使用pipe.to("cuda")全让GPU干了，但是实测下来一块4090依然扛不住，所以改为代码里的pipe.enable_model_cpu_offload()让CPU也一起来分担。这样就可以完美完成推理。

系统监控（非必须）

安装监控所需要的包：

apt install net-tools
apt install vnstat
apt install sysstat

sar -n DEV 5 10：每5s执行一次，一共执行十次

root@autodl-container-da9843af01-9a6b176e:~/autodl-tmp/stable-diffusion-3.5-large# sar -n DEV 5 10
Linux 5.15.0-94-generic (autodl-container-da9843af01-9a6b176e) 	11/12/24 	_x86_64_  (192 CPU)06:43:45        IFACE   rxpck/s   txpck/s    rxkB/s    txkB/s   rxcmp/s   txcmp/s  rxmcst/s   %ifutil
06:43:50           lo      0.80      0.80      0.07      0.07      0.00      0.00      0.00      0.00
06:43:50         eth0  13095.20   5037.80  24062.36    443.36      0.00      0.00      0.00      1.9706:43:50        IFACE   rxpck/s   txpck/s    rxkB/s    txkB/s   rxcmp/s   txcmp/s  rxmcst/s   %ifutil
06:43:55           lo      0.40      0.40      0.13      0.13      0.00      0.00      0.00      0.00
06:43:55         eth0  13445.51   4715.57  24038.59    419.16      0.00      0.00      0.00      1.97

我这里只是想测一下实际下载过程中的网络情况。
当然autodl也提供了监控选项：
在这里插入图片描述

拓展资料：modelscope 的使用手册

autodl+modelscope推理stable-diffusion-3.5-large

本篇介绍如何在服务器上实现SD3.5模型的加载及推理，不包含训练及微调。磁盘扩容 autodl服务器在关机状态下，进行扩容： 选择要扩容的大小（比如我这里已经扩了80G，默认有50G免费的），就会有一…...

编程日记 2024/11/13 21:43:47

深度学习之 LSTM

1.1 LSTM的产生原因 RNN在处理长期依赖（时间序列上距离较远的节点）时会遇到巨大的困难，因为计算距离较远的节点之间的联系时会涉及雅可比矩阵的多次相乘，会造成梯度消失或者梯度膨胀的现象。为了解决该问题，研究人…...

编程日记 2024/11/13 21:42:46

LeetCode 3242.设计相邻元素求和服务：哈希表

【LetMeFly】3242.设计相邻元素求和服务：哈希表力扣题目链接：https://leetcode.cn/problems/design-neighbor-sum-service/ 给你一个 n x n 的二维数组 grid，它包含范围 [0, n2 - 1] 内的不重复元素。实现 neighborSum 类： …...

编程日记 2024/11/13 21:41:45

【AliCloud】ack + ack-secret-manager + kms 敏感数据安全存储

介绍 ack-secret-manager支持以Kubernetes Secret实例的形式向集群导入或同步KMS凭据信息，确保您集群内的应用能够安全地访问敏感信息。通过该组件，您可以实现密钥数据的自动更新，使应用负载通过文件系统挂载指定Secret实例来使用凭据信息&a…...

编程日记 2024/11/13 21:40:43

探索JavaScript的强大功能：从基础到高级应用

随着互联网技术的不断发展，JavaScript已经成为现代Web开发的基石。无论是简单的交互效果，还是复杂的前端框架，JavaScript都在其中扮演着不可或缺的角色。本文旨在对JavaScript进行深入探讨，从其基础概念到高级应用，并讨…...

编程日记 2024/11/13 21:39:42

新增支持Elasticsearch数据源，支持自定义在线地图风格，DataEase开源BI工具v2.10.2 LTS发布

2024年11月11日，人人可用的开源BI工具DataEase正式发布v2.10.2 LTS版本。这一版本的功能变动包括：数据源方面，新增了对Elasticsearch数据源的支持；图表方面，对地图类和表格类图表进行了功能增强和优化，增…...

编程日记 2024/11/13 21:38:41

Spark的容错机制

1，Spark如何保障数据的安全 1、RDD容错机制：persist持久化机制 1）cache算子 - 功能：将RDD缓存在内存中 - 语法：cache() - 本质：底层调用的还是persist（StorageLevel.MEMORY_ONLY）&…...

编程日记 2024/11/13 21:37:40

YOLOv8改进 | 利用YOLOv8进行视频划定区域目标统计计数

简介本项目旨在利用YOLOv8算法来实现视频中划定区域目标的统计计数。YOLOv8是一种目标检测算法，能够实现实时目标检测和定位。视频划定区域目标统计计数是指在一个视频中，对于指定的区域，统计出该区域内出现的目标物体数量。该项目的工作流程如下：首先，利用YOLOv8算法…...

编程日记 2024/11/13 21:36:38

基于yolov8、yolov5的番茄成熟度检测识别系统（含UI界面、训练好的模型、Python代码、数据集）

摘要：番茄成熟度检测在农业生产及质量控制中起着至关重要的作用，不仅能帮助农民及时采摘成熟的番茄，还为自动化农业监测提供了可靠的数据支撑。本文介绍了一款基于YOLOv8、YOLOv5等深度学习框架的番茄成熟度检测模型，该模型使用了…...

编程日记 2024/11/13 21:35:36

wafw00f源码详细解析

声明本人菜鸟一枚，为了完成作业，发现网上所有的关于wafw00f的源码解析都是这抄那那抄这的，没有新东西，所以这里给出一个详细的源码解析，可能有错误，如果有大佬发现错误，可以在评论区平和的指出…...

编程日记 2024/11/13 21:33:33

什么是crm？3000字详细解析

在现代商业环境中，客户关系管理（CRM）已经成为企业驱动成功的关键工具。在复杂且竞争激烈的市场中，如何有效地管理客户关系、提升客户满意度，并增加客户忠诚度，越来越成为企业迫切关心的问题。而CRM系统&…...

编程日记 2024/11/13 21:31:30

WEB3.0介绍

Web3.0是对Web2.0的改进，被视为互联网潜在的下一阶段。以下是对Web3.0的详细介绍： 一、定义与概念 Web3.0被描述为一个运行在区块链技术之上的去中心化互联网。它旨在构建一个更加自主、智能和开放的互联网环境，其中用户不必在不同中心化…...

编程日记 2024/11/13 21:30:29

【深度学习】LSTM、BiLSTM详解

文章目录 1. LSTM简介：2. LSTM结构图：3. 单层LSTM详解4. 双层LSTM详解5. BiLSTM6. Pytorch实现LSTM示例7. nn.LSTM参数详解 1. LSTM简介： LSTM是一种循环神经网络，它可以处理和预测时间序列中间隔和延迟相对较长的重要事件。LSTM通…...

编程日记 2024/11/13 21:29:21

分子对接--软件安装

分子对接相关软件安装一、软件 AutoDock，下载链接: linkMGLtools，下载链接: link 自行选择合适版本下载，这里主要叙述在win上的具体安装流程： 下载得到： 二、运行运行autodocksuite-4.2.6.i86Windows得到&#…...

编程日记 2024/11/13 21:28:18

【Python无敌】在 QGIS 中使用 Python

QGIS 中有 Python 的运行环境，可以很好地执行各种任务。这里的问题是如何在 Jupyter 中调用 QGIS 的功能。首先可以肯定的是涉及到 GUI 的一些任务是无法在 Jupyter 中访问的，这样可以用的功能主要是地处理工具。按如下方式进行了尝试。原想使用 gdal:hillshade ，但是…...

编程日记 2024/11/13 21:27:15

全面解读：低代码开发平台的必备要素——系统策划篇

在传统开发过程中，系统策划起着举足轻重的作用，它宛如一位幕后的总指挥，把控着整个软件开发项目的走向。而随着技术的不断进步，低代码开发平台逐渐崭露头角，它以快速开发、降低技术门槛等优势吸引了众多企业和开发者的…...

编程日记 2024/11/13 21:26:14

Vue开发自动生成验证码功能前端实现不使用第三方插件实现随机验证码功能，生成的验证码添加干扰因素

Vue实现不使用第三方插件，开发随机生成验证码功能效果图，其中包含了短信验证码功能,以及验证码输入是否正确功能 dom结构 <div class="VerityInputTu"><div class="labelClass">图形验证码</div><div class="tuxingInput…...

编程日记 2024/11/13 21:25:12

# filezilla连接虚拟机ubuntu系统出错“尝试连接 ECONNREFUSED - 连接被服务器拒绝，失败，无法连接服务器”解决方案

filezilla连接虚拟机ubuntu系统出错“尝试连接 ECONNREFUSED - 连接被服务器拒绝， 失败，无法连接服务器”解决方案一、问题描述： 当我们用filezilla客户端连接虚拟机ubuntu系统时，报错“尝试连接 ECONNREFUSED - 连接被服务…...

编程日记 2024/11/13 21:24:11

The new policy has drawn many critics. Data and privacy experts said the Metropolitan Transit Authority’s new initiative doesn’t address the underlying problem that causes fare evasion, which is related to poverty and access. Instead, the program tries “…...

编程日记 2024/11/13 21:22:10

autodl+modelscope推理stable-diffusion-3.5-large

磁盘扩容

下载模型

开始推理

系统监控（非必须）

相关文章：

autodl+modelscope推理stable-diffusion-3.5-large

深度学习之 LSTM

LeetCode 3242.设计相邻元素求和服务：哈希表

【AliCloud】ack + ack-secret-manager + kms 敏感数据安全存储

探索JavaScript的强大功能：从基础到高级应用

新增支持Elasticsearch数据源，支持自定义在线地图风格，DataEase开源BI工具v2.10.2 LTS发布

Spark的容错机制

YOLOv8改进 | 利用YOLOv8进行视频划定区域目标统计计数

基于yolov8、yolov5的番茄成熟度检测识别系统（含UI界面、训练好的模型、Python代码、数据集）

wafw00f源码详细解析

什么是crm？3000字详细解析

WEB3.0介绍

【深度学习】LSTM、BiLSTM详解

分子对接--软件安装

【Python无敌】在 QGIS 中使用 Python

全面解读：低代码开发平台的必备要素——系统策划篇

Vue开发自动生成验证码功能前端实现不使用第三方插件实现随机验证码功能，生成的验证码添加干扰因素

# filezilla连接虚拟机ubuntu系统出错“尝试连接 ECONNREFUSED - 连接被服务器拒绝，失败，无法连接服务器”解决方案

2024/11/13 英语每日一段

【全栈开发平台】全面解析 StackBlitz 最新力作 Bolt.new：AI 驱动的全栈开发平台

Linux应用开发之网络套接字编程(实例篇)

【Python】 -- 趣味代码 - 小恐龙游戏

3.3.1_1 检错编码（奇偶校验码）

【位运算】消失的两个数字（hard）

【快手拥抱开源】通过快手团队开源的 KwaiCoder-AutoThink-preview 解锁大语言模型的潜力

【git】把本地更改提交远程新分支feature_g

什么是EULA和DPA

项目部署到Linux上时遇到的错误（Redis，MySQL，无法正确连接，地址占用问题）

视觉slam十四讲实践部分记录——ch2、ch3

Razor编程中@Html的方法使用大全