🏷️ LLM

共 15 个相关内容

🧭 导航

📝 文章

2026年本地大模型部署实战指南:从 Ollama 到 vLLM 的完整教程

手把手教你搭建本地大模型环境,涵盖 Ollama、llama.cpp、vLLM 三种部署方案,给出硬件配置建议和性能调优参数。

2026/7/31

AI大模型微调入门指南:从数据准备到模型部署的完整实战

手把手教你完成一次完整的大模型微调项目,涵盖LoRA/QLoRA原理、数据集构建、训练参数调优、评估与部署,基于Llama 3和ChatGLM的实际操作案例。

2026/5/17

Prompt Injection攻击与防御:2026年AI应用安全实战手册

深入了解Prompt Injection攻击原理、10种常见攻击手法和对应的防御策略,包含代码示例和防护框架选型建议,帮助开发者在AI应用上线前筑牢安全防线。

2026/4/26

RAG 高级检索增强技术实战:从Naive RAG到Graph RAG和Agentic RAG

深入剖析RAG技术的演进路线,包含多路召回、Merged Reranking、Graph RAG、Agentic RAG等高级技术详解与代码实现。

2026/5/23

2026年五大LLM API定价与服务全面对比:DeepSeek V4 / GPT-5 / Claude 4 / Gemini 2.5 Pro / Qwen3

从单位成本、上下文窗口、多模态能力、速率限制、延迟和可用性等维度,全面对比2026年五大主流大模型API的定价策略和服务质量,帮你做出最经济的模型选择。

2026/7/12

GPT-5 vs Claude 4 vs Gemini 3 vs DeepSeek V4:2026上半年大模型终极横评

覆盖编程、写作、推理、多模态、中文理解、API成本六大维度,实测数据对比GPT-5、Claude 4、Gemini 3、DeepSeek V4四大旗舰模型。

2026/6/6

2026年开源大模型本地部署终极指南:Ollama + Docker一步到位

一份从零开始的本地大模型部署手册,用 Ollama + Docker 搭建私有 AI 服务,覆盖模型选型、GPU 加速、API 暴露和性能调优,自建成本低至每月50元电费。

2026/6/6

从零搭建AI知识库:LLM+RAG完整实战教程(2026版)

手把手教你用LangChain + 向量数据库搭建企业级AI知识库,包含数据清洗、向量化、检索优化、Prompt设计全流程。

2026/7/4

GPT-5 vs Claude 4 vs Gemini 3 vs DeepSeek V4:2026下半年大模型能力终局之战

四大旗舰大模型在推理、编程、创意写作、多模态和价格上的全面对比,基于最新基准测试和真实使用体验。

2026/7/22

2026年本地部署大模型完全指南:Ollama、LM Studio、llama.cpp三款工具谁是最佳选择?

从部署难度、推理速度、模型兼容性、UI体验四大维度实测对比Ollama、LM Studio和llama.cpp,并给出不同硬件配置下的推荐部署方案。

2026/7/9

AI模型微调必须避开的10个数据质量陷阱:2026实战检查清单

基于100+微调项目复盘,总结LLM微调中因数据质量问题导致模型降级的十大陷阱,附可落地的数据质量评估指标和自动化质检工具推荐。

2026/7/20

2026年最值得关注的10个AI开源项目(2026年7月版)

精选2026年7月最值得关注和使用的AI开源项目,涵盖LLM、Agent框架、RAG工具、AI编程、多模态等热门领域,附快速上手指南。

2026/7/26