基于 LlamaIndex 的 RAG 文档问答实现
文章给出基于 LlamaIndex 构建本地 Markdown 文档问答的最小可行系统,分初始化设置、文档加载、向量索引构建、查询引擎创建和查询验证五步。初始化通过 Settings 全局配置 LLM 与嵌入模型,嵌入模型适合中文检索且可在 CPU 运行;文档加载精确读取 Markdown;索引构建自动完成切分、嵌入和内存存储;查询引擎封装检索与响应合成,可查看提示词;最后调用查询打印结果,验证端到端流程。读者可快速搭建可调试的 RAG 原型,并按需替换切分器、向量存储或嵌入模型。