🏷️ 本地部署
共 15 个相关内容
🧭 导航
Gemma
Google 开源轻量级大语言模型家族,以较小的模型尺寸提供出色的性能表现。
GPT4All
GPT4All 是开源的本地大模型桌面运行工具,无需 GPU 即可在个人电脑上运行多种开源 LLM,保护隐私离线使用。
NVIDIA ChatRTX
NVIDIA 本地 RAG 聊天助手,在 RTX 显卡上离线运行大模型,解析本地文件实现私密文档问答。
NVIDIA Nemotron
NVIDIA 开源推理大模型系列,以精准的推理、数学与编程能力见长,支持本地或云端部署。
📝 文章
本地部署大模型教程:Ollama 完整指南
Ollama 开源本地大模型部署工具完整教程,涵盖安装、模型下载、API 调用、WebUI 搭建等核心内容。
2026/4/252026年本地大模型部署实战指南:从 Ollama 到 vLLM 的完整教程
手把手教你搭建本地大模型环境,涵盖 Ollama、llama.cpp、vLLM 三种部署方案,给出硬件配置建议和性能调优参数。
2026/7/31手把手教程:2026年在家部署本地大模型,告别API费用!Ollama + Open WebUI 完整指南
从零开始教学如何在本地部署DeepSeek V4、Qwen 3等开源大模型,使用Ollama + Open WebUI搭建自己的AI助手,免费且隐私安全。
2026/5/20手把手教你搭建个人AI语音助手:2026年完整实战指南
从硬件选型到模型部署,从唤醒词定制到技能开发,一篇完整的个人AI语音助手搭建指南。涵盖Home Assistant、Whisper、LLM本地部署全流程。
2026/4/262026年开源大模型本地部署终极指南:Ollama + Docker一步到位
一份从零开始的本地大模型部署手册,用 Ollama + Docker 搭建私有 AI 服务,覆盖模型选型、GPU 加速、API 暴露和性能调优,自建成本低至每月50元电费。
2026/6/6Ollama + Open WebUI + AnythingLLM:搭建私有AI知识库完整指南
手把手教你用Ollama、Open WebUI和AnythingLLM三步搭建企业级私有知识库,支持本地大模型+RAG检索,告别数据隐私担忧。
2026/6/72026年本地部署大模型完全指南:Ollama、LM Studio、llama.cpp三款工具谁是最佳选择?
从部署难度、推理速度、模型兼容性、UI体验四大维度实测对比Ollama、LM Studio和llama.cpp,并给出不同硬件配置下的推荐部署方案。
2026/7/92026年本地部署大模型完全指南:Ollama + Open WebUI + Llama 3 实战
从硬件选型到模型下载再到Web界面搭建,手把手教你用消费级硬件在本地部署Llama 3等开源大模型。
2026/7/25本地跑大模型终极指南:2026年最强开源LLM部署方案与硬件推荐
从硬件选型(Mac Studio M4 Ultra vs RTX 5090 vs AMD)到模型选择(Llama 4 DeepSeek V4 Qwen 3),从量化方案到推理引擎对比,一篇搞定本地部署AI大模型的全流程。
2026/7/272026年本地部署大模型完全指南:Ollama与LM Studio到底怎么选
深度对比Ollama与LM Studio两大主流本地LLM工具,从安装、模型管理、API兼容性到资源占用,给出2026年最实用的本地部署选型方案。
2026/8/1本地跑模型还是调云API?2026年算小账后我劝你别拍脑袋
本地部署和云API之争,口号喊得多、算账算得少。本文用2026年的真实价格、显存成本和延迟数据,给出一个按场景决策的算账框架,帮你在隐私、成本、延迟和运维四本账之间做对选择。
2026/8/18