当前位置：首页 > news >正文

【LLM】二、python调用本地的ollama部署的大模型

news 2026/2/11 3:09:25

系列文章目录

往期文章：

【LLM】一、利用ollama本地部署大模型

文章目录

前言

一、ollama库调用

二、langchain调用

三、requests调用

四、相关参数说明：

总结

前言

本地部署了大模型，下一步任务便是如何调用的问题，实际场景中个人感觉用http请求的方式较为合理，本篇文章也将通过http请求的方式来调用我们本地部署的大模型，正文开始。

一、ollama库调用

参考文档：ollama的python库调用

注意，这里的ollama不是我们第一篇安装的那个Ollama！！！！不要搞混

1、环境准备：

pip install ollama

2、调用示例：

如果你都是按照默认设置安装的Ollama，即host和port等均未设置，那执行以下代码即可

import ollama
res=ollama.chat(model="phi3",stream=False,messages=[{"role": "user","content": "你是谁"}],options={"temperature":0})
print(res)

返回结果如：

如果你更改了Ollama的配置，比如更改了监听端口，则执行下边代码：

import ollamahost="xxx"
port="xxx"
client= ollama.Client(host=f"http://{host}:{port}")
res=client.chat(model="qwen2:1.5b",messages=[{"role": "user","content": "你是谁"}],options={"temperature":0})print(res)

返回结果如：

其中，host和port改为你自己的即可

二、langchain调用

参考链接：langchain调用ollama

1、安装依赖：

pip install langchain
pip install langchain_community

2、调用示例

from langchain_community.llms import Ollama
host="xxx"
port="xxx" #默认的端口号为11434
llm=Ollama(base_url=f"http://{host}:{port}", model="qwen2:1.5b",temperature=0)
res=llm.invoke("你是谁")
print(res)

其中，host和port改为你自己的即可

结果如：

三、requests调用

1、安装依赖

pip install requests

2、调用示例

host="xxx"
port="xxx"
url = f"http://{host}:{port}/api/chat"
model = "qwen2:1.5b"
headers = {"Content-Type": "application/json"}
data = {"model": model, #模型选择"options": {"temperature": 0.  #为0表示不让模型自由发挥，输出结果相对较固定，>0的话，输出的结果会比较放飞自我},"stream": False, #流式输出"messages": [{"role": "system","content":"你是谁？"}] #对话列表}
response=requests.post(url,json=data,headers=headers,timeout=60)
res=response.json()
print(res)

其中，host和port改为你自己的即可，结果同上

四、相关参数说明：

上述几个调用方式中所涉及到的比较重要的参数介绍如下：

temperature：用于调整生成结果的创造性程度，设置越高，生成的文本越新颖、越独特，设置越低，结果更集中
stream：默认false,是否流式传输回部分进度。
format: 转录输出的格式，可选项包括json、str等。

总结

以上就是本篇的全部内容，如有问题，环境评论区交流，或+企鹅群：995760755交流；如觉得有用，欢迎三连

【LLM】二、python调用本地的ollama部署的大模型

系列文章目录往期文章： 【LLM】一、利用ollama本地部署大模型目录文章目录前言一、ollama库调用二、langchain调用三、requests调用四、相关参数说明： 总结前言本地部署了大模型，下一步任务便是如何调用的问题&#xff0c…...

编程日记 2024/7/9 4:35:43

20240708 每日AI必读资讯

🤖破解ChatGPT惊人耗电！DeepMind新算法训练提效13倍，能耗暴降10倍 - 谷歌DeepMind研究团队提出了一种加快AI训练的新方法——多模态对比学习与联合示例选择（JEST），大大减少了所需的计算资源和时间。 - JE…...

编程日记 2024/7/9 4:34:42

为什么KV Cache只需缓存K矩阵和V矩阵，无需缓存Q矩阵？

大家都知道大模型是通过语言序列预测下一个词的概率。假定{ x 1 x_1 x1， x 2 x_2 x2， x 3 x_3 x3，…， x n − 1 x_{n-1} xn−1}为已知序列，其中 x 1 x_1 x1， x 2 x_2 x2， x 3 x_3 x…...

编程日记 2024/7/9 4:33:40

VS code修改底部的行号的状态栏颜色

VSCode截图相信很多小伙伴被底部的蓝色状态栏困扰很久了处理的方式有两种： 1、隐藏状态栏 2、修改其背景颜色第一种方法大伙都会，今天就使用第二种方法。 1、点击齿轮进入setting 2、我现在用的新版本，设置不是以前那种json格式展示&…...

编程日记 2024/7/9 4:32:39

【鸿蒙学习笔记】MVVM模式

官方文档：MVVM模式 [Q&A] 什么是MVVM ArkUI采取MVVM Model View ViewModel模式。 Model层：存储数据和相关逻辑的模型。View层：在ArkUI中通常是Component装饰组件渲染的UI。ViewModel层：在ArkUI中，ViewModel是…...

编程日记 2024/7/9 4:30:36

端、边、云三级算力网络

目录端、边、云三级算力网络 NPU Arm架构 OpenStack kubernetes k3s轻量级Kubernetes kubernetes和docker区别 DCI(Data Center Interconnect) SD/WAN TF 端、边、云三级算力网络算力网络从传统云网融合的角度出发，结合边缘计算、网络云化以及智能控制的优势，通…...

编程日记 2024/7/9 4:27:30

java —— JSP 技术

一、JSP （一）前言 1、.jsp 与 .html 一样属于前端内容，创建在 WebContent 之下； 2、嵌套的 java 语句放置在<% %>里面； 3、嵌套 java 语句的三种语法： ① 脚本：<% java 代码 %>…...

编程日记 2024/7/9 4:26:29

【Python学习笔记】菜鸟教程Scrapy案例 + B站amazon案例视频

背景前摇（省流可以跳过这部分） 实习的时候厚脸皮请教了一位办公室负责做爬虫这块的老师，给我推荐了Scrapy框架。我之前学过一些爬虫基础，但是用的是比较常见的BeautifulSoup和Request，于是得到Scrapy这个关键词后&am…...

编程日记 2024/7/9 4:24:24

Pycharm的终端（Terminal）中切换到当前项目所在的虚拟环境

1.在Pycharm最下端点击终端/Terminal, 2.点击终端窗口最上端最右边的∨， 3.点击Command Prompt，切换环境， 可以看到现在环境已经由默认的PS(Window PowerShell)切换为项目所使用的虚拟环境。 4.更近一步，如果想让Pycharm默认显示…...

编程日记 2024/7/9 4:23:23

Nginx 高效加速策略：动静分离与缓存详解

在现代Web开发中，网站性能是衡量用户体验的关键指标之一。Nginx，以其出色的性能和灵活性，成为众多网站架构中不可或缺的一部分。本文将深度解析如何利用Nginx实现动静分离与缓存，从而大幅提升网站加载速度和响应效率。理解动静分…...

编程日记 2024/7/9 4:22:20

Unity3D 游戏摇杆的制作与实现详解

在Unity3D游戏开发中，摇杆是一种非常常见的输入方式，特别适用于移动设备的游戏控制。本文将详细介绍如何在Unity3D中制作和实现一个虚拟摇杆，包括技术详解和代码实现。对惹，这里有一个游戏开发交流小组，大家可以点击…...

编程日记 2024/7/9 4:18:14

从nginx返回404来看http1.0和http1.1的区别

序言什么样的人可以称之为有智慧的人呢？如果下一个定义，你会如何来定义？ 所谓智慧，就是能区分自己能改变的部分，自己无法改变的部分，努力去做自己能改变的，而不要天天想着那些无法改变的东西&a…...

编程日记 2024/7/9 4:14:09

MySQL 代理层：ProxySQL

文章目录说明安装部署1.1 yum 安装1.2 启停管理1.3 查询版本1.4 Admin 管理接口入门体验功能介绍3.1 多层次配置系统读写分离将实例接入到代理服务定义主机组之间的复制关系配置路由规则事务读的配置延迟阈值和请求转发 ProxySQL 核心表mysql_usersmysql_serversmysql_repli…...

编程日记 2024/7/9 4:13:07

异步主从复制

主从复制的概念主从复制是一种在数据库系统中常用的数据备份和读取扩展技术，通过将一个数据库服务器（主服务器）上的数据变更自动同步到一个或多个数据库服务器（从服务器）上，以此来实现数据的冗余备份、读…...

编程日记 2024/7/9 4:12:06

论文解析——Full Stack Optimization of Transformer Inference: a Survey

作者及发刊详情摘要正文主要工作贡献这篇文章的贡献主要有两部分： 分析Transformer的特征，调查高效transformer推理的方法通过应用方法学展现一个DNN加速器生成器Gemmini的case研究 1）分析和解析Transformer架构的运行时特性和瓶颈…...

编程日记 2024/7/9 4:11:05

selenium处理cookie问题实战

1. cookie获取不完整需要进入的资损平台(web)首页，才会出现有效的ctoken等信息 1.1. 原因说明未进入指定页面而获取的 cookie 与进入页面后获取的 cookie 可能会有一些差异，这取决于网站的具体实现和 cookie 的设置方式。通常情况下，一些…...

编程日记 2024/7/9 4:06:59

(十五)GLM库对矩阵操作

GLM简单使用 glm是一个开源的对矩阵运算的库，下载地址： https://github.com/g-truc/glm/releases 直接包含其头文件即可使用： #include <glad/glad.h>//glad必须在glfw头文件之前包含 #include <GLFW/glfw3.h> #include <io…...

编程日记 2024/7/9 4:05:58

android中activity与fragment之间的各种跳转

我们以音乐播放、视频播放、用户注册与登录为例【Musicfragment（音乐列表页）、Videofragment（视频列表页）、MusicAvtivity（音乐详情页）、VideoFragment（视频详情页）、LoginActivity&…...

编程日记 2024/7/9 4:04:56

动态规划算法-以中学排课管理系统为例

1.动态规划算法介绍 1.算法思路动态规划算法通常用于求解具有某种最优性质的问题。在这类问题中，可能会有许多可行解。每一个解都对应于一个值，我们希望找到具有最优值的解。动态规划算法与分治法类似，其基本思想也是将待求解问题分解成若…...

编程日记 2024/7/9 4:03:55

本安防爆手机：危险环境下的安全通信解决方案

在石油化工、煤矿、天然气等危险环境中，通信安全是保障工作人员生命安全和生产顺利进行的关键。防爆智能手机作为专为这些环境设计的通信工具，提供了全方位的安全通信解决方案。防爆设计与材料： 防爆智能手机采用特殊的防爆结构和材料&…...

编程日记 2024/7/9 4:02:54

挑战杯推荐项目

“人工智能”创意赛 - 智能艺术创作助手：借助大模型技术，开发能根据用户输入的主题、风格等要求，生成绘画、音乐、文学作品等多种形式艺术创作灵感或初稿的应用，帮助艺术家和创意爱好者激发创意、提高创作效率。 - 个性化梦境…...

编程新知 2025/11/6 5:46:16

业务系统对接大模型的基础方案：架构设计与关键步骤

业务系统对接大模型：架构设计与关键步骤在当今数字化转型的浪潮中，大语言模型（LLM）已成为企业提升业务效率和创新能力的关键技术之一。将大模型集成到业务系统中，不仅可以优化用户体验，还能为业务决策提供…...

编程新知 2026/2/10 19:58:46

C++实现分布式网络通信框架RPC(3)--rpc调用端

目录一、前言二、UserServiceRpc_Stub 三、 CallMethod方法的重写头文件实现四、rpc调用端的调用实现五、 google::protobuf::RpcController *controller 头文件实现六、总结一、前言在前边的文章中，我们已经大致实现了rpc服务端的各项功能代…...

编程新知 2026/2/8 20:42:58

简易版抽奖活动的设计技术方案

1.前言本技术方案旨在设计一套完整且可靠的抽奖活动逻辑，确保抽奖活动能够公平、公正、公开地进行，同时满足高并发访问、数据安全存储与高效处理等需求，为用户提供流畅的抽奖体验，助力业务顺利开展。本方案将涵盖抽奖活动的整体架构设计、核心流程逻辑、关键功能实现以及…...

编程新知 2026/2/7 17:41:40

高等数学（下）题型笔记（八）空间解析几何与向量代数

目录 0 前言 1 向量的点乘 1.1 基本公式 1.2 例题 2 向量的叉乘 2.1 基础知识 2.2 例题 3 空间平面方程 3.1 基础知识 3.2 例题 4 空间直线方程 4.1 基础知识 4.2 例题 5 旋转曲面及其方程 5.1 基础知识 5.2 例题 6 空间曲面的法线与切平面 6.1 基础知识 6.2…...

编程新知 2026/1/28 9:04:29

AspectJ 在 Android 中的完整使用指南

一、环境配置（Gradle 7.0 适配） 1. 项目级 build.gradle // 注意：沪江插件已停更，推荐官方兼容方案 buildscript {dependencies {classpath org.aspectj:aspectjtools:1.9.9.1 // AspectJ 工具} } 2. 模块级 build.gradle plu…...

编程新知 2025/7/7 22:33:57

html-＜abbr＞缩写或首字母缩略词

定义与作用 <abbr> 标签用于表示缩写或首字母缩略词，它可以帮助用户更好地理解缩写的含义，尤其是对于那些不熟悉该缩写的用户。 title 属性的内容提供了缩写的详细说明。当用户将鼠标悬停在缩写上时，会显示一个提示框。示例&#x…...

编程新知 2026/1/24 19:22:03

LRU 缓存机制详解与实现（Java版） + 力扣解决

📌 LRU 缓存机制详解与实现（Java版） 一、📖 问题背景在日常开发中，我们经常会使用缓存（Cache） 来提升性能。但由于内存有限，缓存不可能无限增长，于是需要策略决定&am…...

编程新知 2025/11/28 20:47:33

作为测试我们应该关注redis哪些方面

1、功能测试数据结构操作：验证字符串、列表、哈希、集合和有序的基本操作是否正确持久化：测试aof和aof持久化机制，确保数据在开启后正确恢复。事务：检查事务的原子性和回滚机制。发布订阅：确保消息正确传递。 2、性…...

编程新知 2025/11/1 2:00:51

通过 Ansible 在 Windows 2022 上安装 IIS Web 服务器

拓扑结构这是一个用于通过 Ansible 部署 IIS Web 服务器的实验室拓扑。前提条件： 在被管理的节点上安装WinRm 准备一张自签名的证书开放防火墙入站tcp 5985 5986端口准备自签名证书 PS C:\Users\azureuser> $cert New-SelfSignedCertificate -DnsName &…...

编程新知 2026/2/10 0:52:03

系列文章目录

前言

一、ollama库调用

二、langchain调用

三、requests调用

四、相关参数说明：

总结

相关文章：