RAG Agent
agent-rag


演示地址:rag-demo.canoeagent.com Key:(为防止 Key 滥用,请在履历页面或联系站长获取) 提示:刷新或重开页面页面均需要输入 Key 建议:PC 或平板电脑等宽屏设备访问效果最佳 操作指南.txt
技术栈 & 外部 API
Agent RAG 是一个基于 LLM + Milvus + ES 混合检索的 医学知识库问答系统,支持文档上传、向量语义检索与关键词全文检索的 RRF 融合、知识库管理,通过深度搜索驱动实现 精准的、可溯源的专业领域问答。
后端技术栈
| 技术 | 说明 |
|---|---|
| Go 1.25 | 编程语言 |
| net/http | HTTP 服务端(标准库 ServeMux) |
| CORS 中间件 | 跨域请求处理 |
| Auth 中间件 | 聊天接口 Bearer Token 认证 |
| cobra | CLI 框架(serve / ingest 子命令) |
| yaml.v3 | 配置解析 |
| resty/v2 | HTTP 客户端(调用 LLM API) |
| uuid | 文档唯一 ID 生成 |
前端技术栈
| 技术 | 说明 |
|---|---|
| 纯 HTML + CSS + JavaScript | 无任何前端框架,单页应用(SPA) |
| CSS 自定义属性(:root) | 主题色管理 |
| Flexbox 布局 | 侧边栏 + 主聊天区分栏 |
| Fetch API | 所有后端接口调用 |
| FormData(multipart) | 文件上传 |
| DOM API | 动态渲染文档列表 |
| 事件委托 | 删除按钮点击处理 |
外部服务
| 服务 | 用途 | 说明 |
|---|---|---|
| DeepSeek API | LLM 对话 | deepseek-chat 模型,Function Calling |
| 智谱 GLM Embedding API | 文本向量化 | embedding-3 模型,1024 维 |
| Milvus 2.6 | 向量数据库 | 语义检索,medical_docs collection |
| Elasticsearch 9.x | 全文搜索引擎 | 关键词检索,medical_docs index |
存储
| 存储 | 类型 |
|---|---|
| Milvus | 向量 + 标量字段(chunk_id, doc_id, title, content, category, embedding) |
| ES | 全文索引(chunk_id, doc_id, title, content, category) |