Commit Graph

13 Commits

Author SHA1 Message Date
Wenjie Zhang
b6240a1b4f style: code format 2026-05-31 13:40:15 +08:00
Wenjie Zhang
b488e48d8e refactor: Benchmark 弹窗重构 + 测试适配 + 文档更新
- 重构 BenchmarkGenerateModal/BenchmarkUploadModal 组件
- 更新测试文件适配架构变更(apikey、sandbox、用户环境)
- 更新 roadmap.md 记录本次修改
2026-05-26 17:40:17 +08:00
Wenjie Zhang
b6a8ea9343 feat: 前端重构 - Agent 配置 UI 优化、命名统一与 Mention 配置抽取
- AgentConfigSidebar: 重构配置选项渲染,支持 label/value 分离,简化模板
- useAgentMentionConfig: 抽取资源映射工厂函数,支持按 kind 过滤
- agentConfigUtils: 新增 getConfigOptions/getOptionLabel/getOptionValue 工具函数
- stores/components: dbId → kbId 命名统一
- 多项小组件优化与清理
2026-05-26 17:40:17 +08:00
Wenjie Zhang
1026b1d871 refactor: 评估系统重构 - 支持图检索; 重构 Benchmark 生成与 QuerySection 组件
- 后端: milvus_graph_service 增加图检索能力; benchmark_generation 重构为基于 service 的模式
- 后端: evaluation_service.py 迁移至 knowledge/eval/service.py
- 后端: 简化 milvus.py 实现, 抽离图逻辑到 graph service
- 前端: QuerySection.vue 大幅重构, 支持图检索模式与多视图切换
- 前端: BenchmarkGenerateModal 增加图检索配置选项
- 测试: 新增 service_generation 测试, 更新 benchmark_generation 测试
2026-05-26 17:40:17 +08:00
Wenjie Zhang
a7f894691e refactor: 评估系统重构 - 前端 API 及评估组件适配
- API 层方法名和路径统一为 dataset/run 语义
- RAGEvaluationTab 重写为全屏面板、支持列宽拖拽
- EvaluationBenchmarks 重写为数据集管理视图
- 生成模态框增加并发数配置;上传模态框适配新接口
2026-05-26 17:40:17 +08:00
supreme0597
d0c60d9d82 feat(mention): 优化@提及搜索排序与高亮展示,修复唤醒交互及路径硬编码问题 2026-05-25 21:11:20 +08:00
Wenjie Zhang
ab513e2619 feat: 优化评估基准生成,支持仅使用 commonrag/Milvus 知识库,调整参数配置 2026-05-06 22:12:09 +08:00
Wenjie Zhang
f7ad327ef2 fix: update repository references from Yuxi-Know to Yuxi across documentation and codebase 2026-03-27 02:00:22 +08:00
Wenjie Zhang
995c6041aa lint(web): [大量改动] 格式化前端代码 2026-01-15 06:01:34 +08:00
Wenjie Zhang
0875e9769c feat(eval): 添加评估基准分页和错误结果过滤功能
实现评估基准和结果的分页查询,支持按错误过滤结果
优化评估结果表格展示,增加文档链接和说明
提升文件上传验证逻辑和错误处理
2025-12-14 18:13:46 +08:00
Wenjie Zhang
d435b49c97 feat(eval): 添加知识库评估功能及相关文档
新增知识库评估功能,支持对 Milvus 类型知识库进行 RAG 系统评估
- 添加评估基准管理功能,支持手动上传和自动生成基准
- 实现评估指标计算和结果展示
- 更新文档添加评估功能说明
- 优化界面交互,增加类型不支持时的提示
2025-12-11 01:34:49 +08:00
Wenjie Zhang
ade5445cae feat(evaluation): 重构评估服务以支持知识库基准集中管理
重构评估服务接口和实现,统一通过知识库ID管理评估基准和结果:
1. 新增带db_id的评估基准和结果查询/删除接口
2. 将基准元数据集中存储到知识库metadata中
3. 实现自动生成评估基准功能
4. 优化评估结果表格展示生成答案列
5. 简化基准生成弹窗配置项

移除旧接口并标记为废弃,所有前端调用迁移至新接口
2025-12-10 22:48:53 +08:00
Wenjie Zhang
83e0caae7d feat(evaluation): 新增RAG评估功能模块
实现RAG评估系统,包括基准管理、评估指标计算和结果展示功能

- 添加评估路由和API接口
- 实现评估指标计算工具类
- 新增基准上传和自动生成功能
- 添加评估结果展示组件
- 完善相关文档和测试用例
2025-12-09 16:21:18 +08:00