百度360必应搜狗淘宝本站头条
当前位置:网站首页 > 技术分类 > 正文

DeepseekR1+ollama+dify1.0.0搭建企业/个人知识库(入门避坑版)

ztj100 2025-09-19 06:32 2 浏览 0 评论


找了网上的视频和相关文档看了之后,可能由于版本不对或文档格式不对,很容易走弯路,看完这一章,可以让你少踩三天的坑。

步骤和注意事项我一一列出来:

1,前提条件是在你的电脑上已配置好ollama,dify1.0已安装好能正常运行。


2,下载DeepseekR1的模型,如果没有显卡,可以用1.5b的版本(

ollama run deepseek-r1:1.5b

),电脑内存最少在16GB,太少了建议先去加内存。

我的RTX4060的8GB的,基本上跑8b的没有问题,14b的大部分情况会在对话时挂掉,但明显14b的结果要优于8b的。

8b的模型下载

ollama run deepseek-r1:8b

3,再下载 Embedding 模型,建议使用 nomic-embed-text:latest,用来分词。

ollama pull nomic-embed-text

用命令行查看一下


4,进入dify,在界面右上角你的用户头像上点击,进入设置菜单。


找到模型供应商,我的ollama已安装了,可以在安装模型供应商列表中找到他,鼠标放上去之后就有安装按钮,安装完后,就会如下界面。

5,添加第3步下载的模型,最终效果如下:


添加模型时要避几个坑:

坑一:模型名称必须是用ollama list中查出来的名称,必须要一致。

坑二:ollama的基础URL,最好不要用http://localhost:11434或http://127.0.0.1:11434,我之前有写个如何用本地IP去配置ollama,如果这一步配置不对,则无法保存。下面放上我的两个模型的配置图。


6,完成最后一步系统模型设置:



7,现在可以开始使用了,我举三个例子:

案例A:直接用聊天助手来体验本地DeepseekR1(体验整个配置的流程)。

A1,切换到工作室,点创建空白应用。


A2,选择聊天助手,应用名称最好不要太长,我是做HR软件的,就特意输入了HR,再点创建。


A3,如果提示模型出错,则也可以在这里配置:


A4,在底部管理中可以配置下一步问题建议和标注回复(这个有点不太稳定)



A5,点发布与更新,把你的配置保存下来。



A6,再点上图中的运行即可体验。



我的问题是:提供一份vuejs,springboot,mybatis,redis,mysql的框架源码,能单点登录,有用户管理,菜单管理,组织管理功能。

在线上的DeepSeek中回答的更准确,基本上按他提供的代码就能跑起来,在我本地的8b版本中,提供的代码和步骤是有缺失的。


案例B:问学生成绩的功能。(体验知识库的搭建步骤)

B1,准备一份word文档,命名为学生成绩单.docx,可以参考一下以下内容:


B2,从首页中点知识库,创建知识库。



B3,添加学习成绩单的word文件:


B4,进入文本分段与清洗,如果Embedding 模型没有提示出错,先什么都不用改,直接保存并处理。



B5,文档状态是可用,就表示能问他里面的问题了。


B6,还有最后一步,再切换到工作室,你可以再建一个聊天助手或者是在上面建的聊天助手中关联文档。



B7,测试效果如下:


案例C:如何把企业内部的文档加入到知识库中。

AB两个案例应该是最基本的,不过我看了很多资料和走了很多弯路才摸清,主要是版本不一样,还有就是他们的步骤不清楚。导致我花了较长时间才顺利走通。

坑三:最好是按我的步骤走,先不要碰其它的设置,否则可能B出不来结果。

坑四:我一开始也是把公司的HR产品安装说明书放到知识库中,结果在B4的步骤中就提示文件过大,不能超过15M。(当然这是可以去调参数,建议我们先用15M以下的测试)

坑五:我把文档改成15M以下了,结果里面有图片,问的问题基本上没有回答出来,我想着去换ollama的高版本,然后并没有用。

最后放个大招,历史的文档中,图片还需要再找解决方案,后续我再写。解决回答不精确的,如何轻松解决:

解决方案一:分段设置不要用默认的通用,要用父子分段。


解决方案二:分段标识符默认是\n\n,表示是连续两个换行,所以目前最简的办法就是把文档快速分区做两个换行。

有其它的解决办法,对入门或者要快速解决,这是最快的办法。


解决方案三:检索设置改成混合检索。


解决方案四:在聊天助手与文档关联时,编排中的生成功能先不要用,我是看了一个视频说点击后会自动生成,其实是最大的误区,只要我们在解决方案二中把文档做好分段,基本上就能查出来。

最大的坑:网上那些说要改某个配置,但是没有案例的,都可能会把你带到坑里。


最后我上一张我们内部的知识库问答结果:


相关推荐

离谱!写了5年Vue,还不会自动化测试?

前言大家好,我是倔强青铜三。是一名热情的软件工程师,我热衷于分享和传播IT技术,致力于通过我的知识和技能推动技术交流与创新,欢迎关注我,微信公众号:倔强青铜三。Playwright是一个功能强大的端到...

package.json 与 package-lock.json 的关系

模块化开发在前端越来越流行,使用node和npm可以很方便的下载管理项目所需的依赖模块。package.json用来描述项目及项目所依赖的模块信息。那package-lock.json和...

Github 标星35k 的 SpringBoot整合acvtiviti开源分享,看完献上膝盖

前言activiti是目前比较流行的工作流框架,但是activiti学起来还是费劲,还是有点难度的,如何整合在线编辑器,如何和业务表单绑定,如何和系统权限绑定,这些问题都是要考虑到的,不是说纯粹的把a...

Vue3 + TypeScript 前端研发模板仓库

我们把这个Vue3+TypeScript前端研发模板仓库的初始化脚本一次性补全到可直接运行的状态,包括:完整的目录结构所有配置文件研发规范文档示例功能模块(ExampleFeature)...

Vue 2迁移Vue 3:从响应式到性能优化

小伙伴们注意啦!Vue2已经在2023年底正式停止维护,再不升级就要面临安全漏洞没人管的风险啦!而且Vue3带来的性能提升可不是一点点——渲染速度快40%,内存占用少一半,更新速度直接翻倍!还在...

VUE学习笔记:声明式渲染详解,对比WEB与VUE

声明式渲染是指使用简洁的模板语法,声明式的方式将数据渲染进DOM系统。声明式是相对于编程式而言,声明式是面向对象的,告诉框架做什么,具体操作由框架完成。编程式是面向过程思想,需要手动编写代码完成具...

苏州web前端培训班, 苏州哪里有web前端工程师培训

前端+HTML5德学习内容:第一阶段:前端页面重构:PC端网站布局、HTML5+CSS3基础项目、WebAPP页面布局;第二阶段:高级程序设计:原生交互功能开发、面向对象开发与ES5/ES6、工具库...

跟我一起开发微信小程序——扩展组件的代码提示补全

用户自定义代码块步骤:1.HBuilderX中工具栏:工具-代码块设置-vue代码块2.通过“1”步骤打开设置文件...

JimuReport 积木报表 v1.9.3发布,免费可视化报表

项目介绍积木报表JimuReport,是一款免费的数据可视化报表,含报表、大屏和仪表盘,像搭建积木一样完全在线设计!功能涵盖:数据报表、打印设计、图表报表、门户设计、大屏设计等!...

软开企服开源的无忧企业文档(V2.1.3)产品说明书

目录1....

一款面向 AI 的下一代富文本编辑器,已开源

简介AiEditor是一个面向AI的下一代富文本编辑器。开箱即用、支持所有前端框架、支持Markdown书写模式什么是AiEditor?AiEditor是一个面向AI的下一代富文本编辑...

玩转Markdown(2)——抽象语法树的提取与操纵

上一篇玩转Markdown——数据的分离存储与组件的原生渲染发布,转眼已经鸽了大半年了。最近在操纵mdast生成md文件的时候,心血来潮,把玩转Markdown(2)给补上了。...

DeepseekR1+ollama+dify1.0.0搭建企业/个人知识库(入门避坑版)

找了网上的视频和相关文档看了之后,可能由于版本不对或文档格式不对,很容易走弯路,看完这一章,可以让你少踩三天的坑。步骤和注意事项我一一列出来:1,前提条件是在你的电脑上已配置好ollama,dify1...

升级JDK17的理由,核心是降低GC时间

升级前后对比升级方法...

一个vsCode格式化插件_vscode格式化插件缩进量

ESlint...

取消回复欢迎 发表评论: