一、本地部署
- 部署步骤
- 文件下载,官方地址:https://ollama.com/ (因下载地址为github,下载速度较慢,可以使用迅雷等加速工具)
- 安装
- 执行可执行文件,安装后会自动运行
- 使用ollama -v验证是否安装成功,或通过http://localhost:11434/查看
- 服务启动
ollama serve
- 模型下载https://ollama.com/library
- 默认下载7B版本
ollama run deepseek-r1
- 默认下载7B版本
DeepSeek-R1-Distill-Qwen-1.5B
ollama run deepseek-r1:1.5b
DeepSeek-R1-Distill-Qwen-7B
ollama run deepseek-r1:7b
DeepSeek-R1-Distill-Llama-8B
ollama run deepseek-r1:8b
DeepSeek-R1-Distill-Qwen-14B
ollama run deepseek-r1:14b
DeepSeek-R1-Distill-Qwen-32B
ollama run deepseek-r1:32b
DeepSeek-R1-Distill-Llama-70B
ollama run deepseek-r1:70b
-
模型验证
![[图片]](/https://i-blog.csdnimg.cn/direct/42d3d9d8e6b8451f8eacb0869645bf48.png)
-
UI界面
- docker方式安装open web ui docker run -d -p 3000:8080 --name open-webui
–restart always ghcr.io/open-webui/open-webui:main - 浏览器访问http://localhost:3000
- 常用命令
启动Ollama服务: ollama serve
从模型文件创建模型: ollama create
显示模型信息: ollama show
运行模型: ollama run 模型名称
从注册表中拉去模型: ollama pull 模型名称
将模型推送到注册表: ollama push
列出模型: ollama list
复制模型: ollama cp
删除模型: ollama rm 模型名称
获取有关Ollama任何命令的帮助信息: ollama
- 部署成本

- 腾讯云服务器价格

二、知识库搭建
-
下载 Cherry Studio:一款支持多个大语言模型(LLM)服务商的桌面客户端,开源产品。
-
下载知识库模型:
ollama pull bge-m3 -
创建知识库

-
本地文件上传
-
搜索验证
-
问题:
1. 搜索返回结果不准确
原因:数据量比较小,没有形成向量知识库,模型使用的1.5B模型,准确性较差
三. 参考文档
- deepseek官网
- 小白也能看懂的DeepSeek-R1本地部署指南
- DeepSeek API 文档
- deepseek-r1的1.5b、7b、8b、14b、32b、70b和671b有啥区别?
- 快速使用 DeepSeek-R1 模型
- CherryStudio项目简介
- DeepSeek-R1 官方提示词和参数配置:部署开源671B与DeepSeek官方表现一致
- 利用DeepSeek-R1构建本地知识库【附完整教程】

1257

被折叠的 条评论
为什么被折叠?



