使用ollama工具本地部署Qwen32B模型
·

使用ollama工具本地部署Qwen32B模型
安装ollama


** ollama 只是一个大模型部署的工具,类似docker 拉去镜像模式**
ollama pull qwen2.5:7b 拉取模型
ollama list 查看环境


启动Qwen7b,启动时找到对应的NAME 执行即可,有docker基础的伙伴上手比较快
ollama run qwen2.5:7b

目前只是在终端问答,我们可以引入web 页面,原理其实就是绑定ollama 链接,进行转发,github上有很多种,上文讲解了基于docker 部署的软件,MaxKB 感觉过于复杂,今天讲解一下上手较快的:chatbox 以及 LM Studio
chatbox
支持各种版本以及网页端

选择设置按钮进行配置,选择ollama软件会自动匹配下载的大模型



LM Studio
也提供了很多版本支持,提供了大量的模型文件适配

无脑安装

完成后直接运行
右上角记得跳过

设置中文显示

支持市面上常见的大模型

推荐一个国内的模型库魔塔社区
国外的Hugging Face 网络有时候不太稳定
推荐一个比较好用的模型: 通义千问2.5-72B-Instruct,比较吃电脑内存


注意层级:/models/Publisher/Repository/
这种层级存放文件,官方默认
Qwen/Qwen1.5-72B-Chat-GGUF
下载完后加载不了!!!!哇哇哇哇,资源不足,准备下载32B的了

工欲善其事必先利其器
成功加载…

成功运行…

完结撒花!!!!!!!!!!!!!
下期出内网服务器基于A100显卡如何离线部署安装千亿级大模型!!!!
更多推荐



所有评论(0)