DeepseekR1+ollama+dify1.0.0搭建企业/个人知识库(入门避坑版)
ztj100 2025-09-19 06:32 2 浏览 0 评论
找了网上的视频和相关文档看了之后,可能由于版本不对或文档格式不对,很容易走弯路,看完这一章,可以让你少踩三天的坑。
步骤和注意事项我一一列出来:
1,前提条件是在你的电脑上已配置好ollama,dify1.0已安装好能正常运行。
2,下载DeepseekR1的模型,如果没有显卡,可以用1.5b的版本(
ollama run deepseek-r1:1.5b
),电脑内存最少在16GB,太少了建议先去加内存。
我的RTX4060的8GB的,基本上跑8b的没有问题,14b的大部分情况会在对话时挂掉,但明显14b的结果要优于8b的。
8b的模型下载
ollama run deepseek-r1:8b
3,再下载 Embedding 模型,建议使用 nomic-embed-text:latest,用来分词。
ollama pull nomic-embed-text
用命令行查看一下
4,进入dify,在界面右上角你的用户头像上点击,进入设置菜单。
找到模型供应商,我的ollama已安装了,可以在安装模型供应商列表中找到他,鼠标放上去之后就有安装按钮,安装完后,就会如下界面。
5,添加第3步下载的模型,最终效果如下:
添加模型时要避几个坑:
坑一:模型名称必须是用ollama list中查出来的名称,必须要一致。
坑二:ollama的基础URL,最好不要用http://localhost:11434或http://127.0.0.1:11434,我之前有写个如何用本地IP去配置ollama,如果这一步配置不对,则无法保存。下面放上我的两个模型的配置图。
6,完成最后一步系统模型设置:
7,现在可以开始使用了,我举三个例子:
案例A:直接用聊天助手来体验本地DeepseekR1(体验整个配置的流程)。
A1,切换到工作室,点创建空白应用。
A2,选择聊天助手,应用名称最好不要太长,我是做HR软件的,就特意输入了HR,再点创建。
A3,如果提示模型出错,则也可以在这里配置:
A4,在底部管理中可以配置下一步问题建议和标注回复(这个有点不太稳定)
A5,点发布与更新,把你的配置保存下来。
A6,再点上图中的运行即可体验。
我的问题是:提供一份vuejs,springboot,mybatis,redis,mysql的框架源码,能单点登录,有用户管理,菜单管理,组织管理功能。
在线上的DeepSeek中回答的更准确,基本上按他提供的代码就能跑起来,在我本地的8b版本中,提供的代码和步骤是有缺失的。
案例B:问学生成绩的功能。(体验知识库的搭建步骤)
B1,准备一份word文档,命名为学生成绩单.docx,可以参考一下以下内容:
B2,从首页中点知识库,创建知识库。
B3,添加学习成绩单的word文件:
B4,进入文本分段与清洗,如果Embedding 模型没有提示出错,先什么都不用改,直接保存并处理。
B5,文档状态是可用,就表示能问他里面的问题了。
B6,还有最后一步,再切换到工作室,你可以再建一个聊天助手或者是在上面建的聊天助手中关联文档。
B7,测试效果如下:
案例C:如何把企业内部的文档加入到知识库中。
AB两个案例应该是最基本的,不过我看了很多资料和走了很多弯路才摸清,主要是版本不一样,还有就是他们的步骤不清楚。导致我花了较长时间才顺利走通。
坑三:最好是按我的步骤走,先不要碰其它的设置,否则可能B出不来结果。
坑四:我一开始也是把公司的HR产品安装说明书放到知识库中,结果在B4的步骤中就提示文件过大,不能超过15M。(当然这是可以去调参数,建议我们先用15M以下的测试)
坑五:我把文档改成15M以下了,结果里面有图片,问的问题基本上没有回答出来,我想着去换ollama的高版本,然后并没有用。
最后放个大招,历史的文档中,图片还需要再找解决方案,后续我再写。解决回答不精确的,如何轻松解决:
解决方案一:分段设置不要用默认的通用,要用父子分段。
解决方案二:分段标识符默认是\n\n,表示是连续两个换行,所以目前最简的办法就是把文档快速分区做两个换行。
有其它的解决办法,对入门或者要快速解决,这是最快的办法。
解决方案三:检索设置改成混合检索。
解决方案四:在聊天助手与文档关联时,编排中的生成功能先不要用,我是看了一个视频说点击后会自动生成,其实是最大的误区,只要我们在解决方案二中把文档做好分段,基本上就能查出来。
最大的坑:网上那些说要改某个配置,但是没有案例的,都可能会把你带到坑里。
最后我上一张我们内部的知识库问答结果:
相关推荐
- 离谱!写了5年Vue,还不会自动化测试?
-
前言大家好,我是倔强青铜三。是一名热情的软件工程师,我热衷于分享和传播IT技术,致力于通过我的知识和技能推动技术交流与创新,欢迎关注我,微信公众号:倔强青铜三。Playwright是一个功能强大的端到...
- package.json 与 package-lock.json 的关系
-
模块化开发在前端越来越流行,使用node和npm可以很方便的下载管理项目所需的依赖模块。package.json用来描述项目及项目所依赖的模块信息。那package-lock.json和...
- Github 标星35k 的 SpringBoot整合acvtiviti开源分享,看完献上膝盖
-
前言activiti是目前比较流行的工作流框架,但是activiti学起来还是费劲,还是有点难度的,如何整合在线编辑器,如何和业务表单绑定,如何和系统权限绑定,这些问题都是要考虑到的,不是说纯粹的把a...
- Vue3 + TypeScript 前端研发模板仓库
-
我们把这个Vue3+TypeScript前端研发模板仓库的初始化脚本一次性补全到可直接运行的状态,包括:完整的目录结构所有配置文件研发规范文档示例功能模块(ExampleFeature)...
- Vue 2迁移Vue 3:从响应式到性能优化
-
小伙伴们注意啦!Vue2已经在2023年底正式停止维护,再不升级就要面临安全漏洞没人管的风险啦!而且Vue3带来的性能提升可不是一点点——渲染速度快40%,内存占用少一半,更新速度直接翻倍!还在...
- VUE学习笔记:声明式渲染详解,对比WEB与VUE
-
声明式渲染是指使用简洁的模板语法,声明式的方式将数据渲染进DOM系统。声明式是相对于编程式而言,声明式是面向对象的,告诉框架做什么,具体操作由框架完成。编程式是面向过程思想,需要手动编写代码完成具...
- 苏州web前端培训班, 苏州哪里有web前端工程师培训
-
前端+HTML5德学习内容:第一阶段:前端页面重构:PC端网站布局、HTML5+CSS3基础项目、WebAPP页面布局;第二阶段:高级程序设计:原生交互功能开发、面向对象开发与ES5/ES6、工具库...
- 跟我一起开发微信小程序——扩展组件的代码提示补全
-
用户自定义代码块步骤:1.HBuilderX中工具栏:工具-代码块设置-vue代码块2.通过“1”步骤打开设置文件...
- JimuReport 积木报表 v1.9.3发布,免费可视化报表
-
项目介绍积木报表JimuReport,是一款免费的数据可视化报表,含报表、大屏和仪表盘,像搭建积木一样完全在线设计!功能涵盖:数据报表、打印设计、图表报表、门户设计、大屏设计等!...
- 软开企服开源的无忧企业文档(V2.1.3)产品说明书
-
目录1....
- 一款面向 AI 的下一代富文本编辑器,已开源
-
简介AiEditor是一个面向AI的下一代富文本编辑器。开箱即用、支持所有前端框架、支持Markdown书写模式什么是AiEditor?AiEditor是一个面向AI的下一代富文本编辑...
- 玩转Markdown(2)——抽象语法树的提取与操纵
-
上一篇玩转Markdown——数据的分离存储与组件的原生渲染发布,转眼已经鸽了大半年了。最近在操纵mdast生成md文件的时候,心血来潮,把玩转Markdown(2)给补上了。...
- DeepseekR1+ollama+dify1.0.0搭建企业/个人知识库(入门避坑版)
-
找了网上的视频和相关文档看了之后,可能由于版本不对或文档格式不对,很容易走弯路,看完这一章,可以让你少踩三天的坑。步骤和注意事项我一一列出来:1,前提条件是在你的电脑上已配置好ollama,dify1...
- 升级JDK17的理由,核心是降低GC时间
-
升级前后对比升级方法...
- 一个vsCode格式化插件_vscode格式化插件缩进量
-
ESlint...
你 发表评论:
欢迎- 一周热门
-
-
MySQL中这14个小玩意,让人眼前一亮!
-
旗舰机新标杆 OPPO Find X2系列正式发布 售价5499元起
-
【VueTorrent】一款吊炸天的qBittorrent主题,人人都可用
-
面试官:使用int类型做加减操作,是线程安全吗
-
C++编程知识:ToString()字符串转换你用正确了吗?
-
【Spring Boot】WebSocket 的 6 种集成方式
-
PyTorch 深度学习实战(26):多目标强化学习Multi-Objective RL
-
pytorch中的 scatter_()函数使用和详解
-
与 Java 17 相比,Java 21 究竟有多快?
-
基于TensorRT_LLM的大模型推理加速与OpenAI兼容服务优化
-
- 最近发表
- 标签列表
-
- idea eval reset (50)
- vue dispatch (70)
- update canceled (42)
- order by asc (53)
- spring gateway (67)
- 简单代码编程 贪吃蛇 (40)
- transforms.resize (33)
- redisson trylock (35)
- 卸载node (35)
- np.reshape (33)
- torch.arange (34)
- npm 源 (35)
- vue3 deep (35)
- win10 ssh (35)
- vue foreach (34)
- idea设置编码为utf8 (35)
- vue 数组添加元素 (34)
- std find (34)
- tablefield注解用途 (35)
- python str转json (34)
- java websocket客户端 (34)
- tensor.view (34)
- java jackson (34)
- vmware17pro最新密钥 (34)
- mysql单表最大数据量 (35)