news 2026/8/6 22:29:27

【AI开发必备】Dify接入本地大模型实战指南,小白也能5分钟搞定!告别API收费,手把手教你搭建私有知识库!

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
【AI开发必备】Dify接入本地大模型实战指南,小白也能5分钟搞定!告别API收费,手把手教你搭建私有知识库!

基于此,本文对上一篇内容做个补充,主要介绍Dify如何接入本地模型。

对于先前已经搭建好的知识库,需要简单调整。

一、Dify接入本地大模型

如何用Dify接入本地大模型?

需要查看本地是否用Ollama成功部署大模型。

1、 如果你已经在本地部署了大模型。

可以直接在主页->设置->模型供应商中全局配置

配置成功后可看到Ollama

2、如果本地还没有安装模型,

核心步骤如下:

1、下载安装Ollama

官网地址:https://ollama.com/download/windows

点击下载windows 版本,其它版本网上自行检索

2、双击运行

点下一步,无脑安装。

3、检测是否安装成功

windows+R ,输入命令

C:\Users\admin>ollama -v

出现相应的版本号即为安装成功

4、本地部署大模型

考虑到本地机器性能,以接入deepseek-r1为例,用Ollama部署

选取模型规格及参数

接入deepseek-r1:14b,看到发送消息这个对话提示就是安装成了

5、Dify接入本地大模型(重要!!!)

好了,现在用Ollama部署了本地大模型。

这里不在赘述。

到此,我们具备了以下条件:

  • Ollama本地部署deepseek大模型成功.
  • Docker 部署Dify成功

接下来正式操作如何接入本地模型?

关键点:这里需要填写以下内容

  • 基础 URL (Base URL):ollama部署的地址。
  • 模型名称:(必须与本地部署的大模型名字完全一致,个人使用的是deepseek-r1:14b,就配置)
  • 模型类型:对话 (Chat)上下文
  • 长度:4096 (根据显存情况调整)

踩坑!!!:如果你的 Ollama 跑在宿主机上,Dify 跑在 Docker 里,Base URL 千万别填 localhost!

正确姿势:

Mac/Win:http://host.docker.internal:11434Linux: http://172.17.0.1:11434 (Docker 网关 IP)

设置中可视化配置如下:

好了,到这里基本完成Dify本地接入大模型。

知识库配置本地模型

最后,回到知识库本地化模型配置。

详细配置修改如下:

1、点击进入已经建好的知识库

2、点击模型设置,选择本地模型

可以看到已显示本地部署的模型

3、测试验证

那么,如何系统的去学习大模型LLM?

作为一名深耕行业的资深大模型算法工程师,我经常会收到一些评论和私信,我是小白,学习大模型该从哪里入手呢?我自学没有方向怎么办?这个地方我不会啊。如果你也有类似的经历,一定要继续看下去!这些问题啊,也不是三言两语啊就能讲明白的。

所以我综合了大模型的所有知识点,给大家带来一套全网最全最细的大模型零基础教程。在做这套教程之前呢,我就曾放空大脑,以一个大模型小白的角度去重新解析它,采用基础知识和实战项目相结合的教学方式,历时3个月,终于完成了这样的课程,让你真正体会到什么是每一秒都在疯狂输出知识点。

由于篇幅有限,⚡️ 朋友们如果有需要全套 《2025全新制作的大模型全套资料》,扫码获取~

👉大模型学习指南+路线汇总👈

我们这套大模型资料呢,会从基础篇、进阶篇和项目实战篇等三大方面来讲解。

👉①.基础篇👈

基础篇里面包括了Python快速入门、AI开发环境搭建及提示词工程,带你学习大模型核心原理、prompt使用技巧、Transformer架构和预训练、SFT、RLHF等一些基础概念,用最易懂的方式带你入门大模型。

👉②.进阶篇👈

接下来是进阶篇,你将掌握RAG、Agent、Langchain、大模型微调和私有化部署,学习如何构建外挂知识库并和自己的企业相结合,学习如何使用langchain框架提高开发效率和代码质量、学习如何选择合适的基座模型并进行数据集的收集预处理以及具体的模型微调等等。

👉③.实战篇👈

实战篇会手把手带着大家练习企业级的落地项目(已脱敏),比如RAG医疗问答系统、Agent智能电商客服系统、数字人项目实战、教育行业智能助教等等,从而帮助大家更好的应对大模型时代的挑战。

👉④.福利篇👈

最后呢,会给大家一个小福利,课程视频中的所有素材,有搭建AI开发环境资料包,还有学习计划表,几十上百G素材、电子书和课件等等,只要你能想到的素材,我这里几乎都有。我已经全部上传到CSDN,朋友们如果需要可以微信扫描下方CSDN官方认证二维码免费领取【保证100%免费】

相信我,这套大模型系统教程将会是全网最齐全 最易懂的小白专用课!!

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/8/6 15:29:42

Open-AutoGLM模型下载太慢?:5种极速下载方案让你效率提升200%

第一章:Open-AutoGLM模型下载加速在部署大型语言模型时,Open-AutoGLM 的下载速度直接影响开发与实验效率。由于模型文件通常体积庞大,直接通过默认源下载常面临带宽限制或连接不稳定的问题。为提升下载效率,推荐采用镜像加速、分段…

作者头像 李华
网站建设 2026/8/5 8:14:12

掌握这4种退避算法,让你的Open-AutoGLM重试效率提升3倍

第一章:Open-AutoGLM 失败重试机制优化在分布式推理系统中,Open-AutoGLM 面临网络波动、资源竞争和模型加载延迟等问题,导致请求失败。为提升系统的稳定性与容错能力,对失败重试机制进行深度优化至关重要。重试策略设计原则 合理的…

作者头像 李华
网站建设 2026/8/5 11:16:31

Open-AutoGLM坐标修正迫在眉睫,错过这波升级将落后三年

第一章:Open-AutoGLM坐标定位误差修正在高精度地图与自动驾驶系统中,Open-AutoGLM作为基于大语言模型的空间语义解析引擎,其输出的地理坐标常因参考系偏差、传感器噪声或语义理解模糊而产生定位误差。为提升定位可靠性,需引入多源…

作者头像 李华
网站建设 2026/8/5 13:46:26

【Open-AutoGLM非root配置全攻略】:零权限部署AI模型的5大核心技巧

第一章:Open-AutoGLM非root配置的核心挑战在无 root 权限的设备上部署 Open-AutoGLM 模型推理环境,面临一系列系统级限制与安全策略约束。由于无法访问底层系统目录和关键服务,传统依赖全局环境变量或系统级服务注册的部署方式不再适用。开发…

作者头像 李华
网站建设 2026/8/5 16:02:30

【Open-AutoGLM安卓13适配全攻略】:从零到一掌握系统级配置优化秘籍

第一章:Open-AutoGLM安卓13适配概述 Open-AutoGLM 作为一款基于 AutoGLM 架构的开源自动化工具,旨在实现跨平台智能任务调度。随着 Android 13 的发布,系统在权限管理、隐私保护和运行时行为上进行了多项调整,对第三方应用的底层调…

作者头像 李华
网站建设 2026/8/6 2:46:57

还在为弹窗识别慢发愁?Open-AutoGLM最新优化方案已上线,速看!

第一章:Open-AutoGLM 弹窗识别速度提升在自动化测试与智能交互场景中,弹窗识别的效率直接影响系统的响应速度和用户体验。Open-AutoGLM 通过优化底层视觉推理模型与调度机制,显著提升了弹窗识别的速度与准确率。模型轻量化设计 为减少推理延迟…

作者头像 李华