Wenjie Zhang
|
b6240a1b4f
|
style: code format
|
2026-05-31 13:40:15 +08:00 |
|
Wenjie Zhang
|
b488e48d8e
|
refactor: Benchmark 弹窗重构 + 测试适配 + 文档更新
- 重构 BenchmarkGenerateModal/BenchmarkUploadModal 组件
- 更新测试文件适配架构变更(apikey、sandbox、用户环境)
- 更新 roadmap.md 记录本次修改
|
2026-05-26 17:40:17 +08:00 |
|
Wenjie Zhang
|
b6a8ea9343
|
feat: 前端重构 - Agent 配置 UI 优化、命名统一与 Mention 配置抽取
- AgentConfigSidebar: 重构配置选项渲染,支持 label/value 分离,简化模板
- useAgentMentionConfig: 抽取资源映射工厂函数,支持按 kind 过滤
- agentConfigUtils: 新增 getConfigOptions/getOptionLabel/getOptionValue 工具函数
- stores/components: dbId → kbId 命名统一
- 多项小组件优化与清理
|
2026-05-26 17:40:17 +08:00 |
|
Wenjie Zhang
|
1026b1d871
|
refactor: 评估系统重构 - 支持图检索; 重构 Benchmark 生成与 QuerySection 组件
- 后端: milvus_graph_service 增加图检索能力; benchmark_generation 重构为基于 service 的模式
- 后端: evaluation_service.py 迁移至 knowledge/eval/service.py
- 后端: 简化 milvus.py 实现, 抽离图逻辑到 graph service
- 前端: QuerySection.vue 大幅重构, 支持图检索模式与多视图切换
- 前端: BenchmarkGenerateModal 增加图检索配置选项
- 测试: 新增 service_generation 测试, 更新 benchmark_generation 测试
|
2026-05-26 17:40:17 +08:00 |
|
Wenjie Zhang
|
a7f894691e
|
refactor: 评估系统重构 - 前端 API 及评估组件适配
- API 层方法名和路径统一为 dataset/run 语义
- RAGEvaluationTab 重写为全屏面板、支持列宽拖拽
- EvaluationBenchmarks 重写为数据集管理视图
- 生成模态框增加并发数配置;上传模态框适配新接口
|
2026-05-26 17:40:17 +08:00 |
|
supreme0597
|
d0c60d9d82
|
feat(mention): 优化@提及搜索排序与高亮展示,修复唤醒交互及路径硬编码问题
|
2026-05-25 21:11:20 +08:00 |
|
Wenjie Zhang
|
ab513e2619
|
feat: 优化评估基准生成,支持仅使用 commonrag/Milvus 知识库,调整参数配置
|
2026-05-06 22:12:09 +08:00 |
|
Wenjie Zhang
|
f7ad327ef2
|
fix: update repository references from Yuxi-Know to Yuxi across documentation and codebase
|
2026-03-27 02:00:22 +08:00 |
|
Wenjie Zhang
|
995c6041aa
|
lint(web): [大量改动] 格式化前端代码
|
2026-01-15 06:01:34 +08:00 |
|
Wenjie Zhang
|
0875e9769c
|
feat(eval): 添加评估基准分页和错误结果过滤功能
实现评估基准和结果的分页查询,支持按错误过滤结果
优化评估结果表格展示,增加文档链接和说明
提升文件上传验证逻辑和错误处理
|
2025-12-14 18:13:46 +08:00 |
|
Wenjie Zhang
|
d435b49c97
|
feat(eval): 添加知识库评估功能及相关文档
新增知识库评估功能,支持对 Milvus 类型知识库进行 RAG 系统评估
- 添加评估基准管理功能,支持手动上传和自动生成基准
- 实现评估指标计算和结果展示
- 更新文档添加评估功能说明
- 优化界面交互,增加类型不支持时的提示
|
2025-12-11 01:34:49 +08:00 |
|
Wenjie Zhang
|
ade5445cae
|
feat(evaluation): 重构评估服务以支持知识库基准集中管理
重构评估服务接口和实现,统一通过知识库ID管理评估基准和结果:
1. 新增带db_id的评估基准和结果查询/删除接口
2. 将基准元数据集中存储到知识库metadata中
3. 实现自动生成评估基准功能
4. 优化评估结果表格展示生成答案列
5. 简化基准生成弹窗配置项
移除旧接口并标记为废弃,所有前端调用迁移至新接口
|
2025-12-10 22:48:53 +08:00 |
|
Wenjie Zhang
|
83e0caae7d
|
feat(evaluation): 新增RAG评估功能模块
实现RAG评估系统,包括基准管理、评估指标计算和结果展示功能
- 添加评估路由和API接口
- 实现评估指标计算工具类
- 新增基准上传和自动生成功能
- 添加评估结果展示组件
- 完善相关文档和测试用例
|
2025-12-09 16:21:18 +08:00 |
|