包含该标签的所有文章 "技术实践".
本篇回答一个工程问题:两个Embedding模型都能运行,怎样判断谁更适合当前真实知识库?重点评测Retriever,不把LLM的语言风格和随机性混进实验。
本篇把第一篇的名词映射到真实代码。阅读目标不是背Python,而是能够沿数据流解释:“这一行接收什么、产生什么、为什么下一步需要它”。
面向第一次接触RAG的读者。本篇先建立“它为什么存在、每个名词是什么意思、数据到底怎样流动”的整体概念,不要求你预先了解向量数据库或大模型框架。
把上一篇的最小 RAG 变成一个带鉴权的网页服务并挂到博客上:FastAPI + 用户名密码白名单 + HMAC 签名会话 Cookie + systemd 常驻 + Nginx 反向代理到 https://slblog.online/rag/,同时分析静态博客为什么不能直接跑 RAG、子路径部署的坑(相对 URL、Secure Cookie、HTTP 重定向到 HTTPS)。