Commit Graph

14 Commits

Author SHA1 Message Date
Wenjie Zhang
f1c843addc refactor: 清理未使用的导入和优化代码格式 2025-09-02 01:08:42 +08:00
Wenjie Zhang
7641ab3699 stylle: 使用更加严格的风格检查以及代码格式化方法 2025-09-01 22:37:03 +08:00
Wenjie Zhang
6810f1f84e feat: 在依赖组中添加 ruff 依赖,并优化代码中的类型提示和异常处理,提升代码可读性和稳定性 2025-07-02 02:38:36 +08:00
Wenjie Zhang
a91d57f274 fix: 更新嵌入模型配置,修复相关信息获取逻辑
- 修改数据路由器中的嵌入模型信息获取方式,确保使用正确的配置项。
- 在 LightRagBasedKB 类中,增强 LLM 和嵌入函数的获取逻辑,支持动态配置。
- 更新嵌入模型和重排序模型的 URL 获取方式,统一为 base_url。
- 前端数据库视图中,调整嵌入模型选择的样式和信息展示,提升用户体验。
2025-06-27 12:22:35 +08:00
Wenjie Zhang
4afbb42f96 feat: 添加自动索引功能,优化文件处理流程
- 在知识库中新增自动索引参数,支持在文件处理后自动触发索引。
- 更新前端界面,允许用户配置自动索引选项,并在处理结果中反馈索引状态。
- 调整定时器刷新间隔,提高数据库信息更新的实时性。
2025-06-25 02:45:57 +08:00
Wenjie Zhang
5000afc3ca feat: 更新模型服务脚本和配置,支持 Qwen3 系列模型
- 修改 run.sh 脚本,新增对 Qwen3-32B、Qwen3-Embedding-0.6B 和 Qwen3-Reranker-0.6B 模型的支持。
- 更新 rerank_model.py,优化 API URL 获取逻辑,使用 get_docker_safe_url 函数。
- 在 models.yaml 中添加 Qwen3 系列模型的配置信息,包括名称、维度和 API 密钥。
2025-06-25 02:12:19 +08:00
Wenjie Zhang
a6857c3e21 style: fix ruff check 2025-05-24 11:29:45 +08:00
Wenjie Zhang
82974d9550 fix typo found by copilot 2025-04-06 20:47:45 +08:00
Wenjie Zhang
1d40da7460 添加自动获取模型列表,目前仅支持适配了 OpenAI格式的供应商,更多供应商支持中…… 2025-04-06 20:33:15 +08:00
Wenjie Zhang
d26fda4053 更新了很多
- 添加了系统提示词
- 添加了知识库的加载方式
2025-03-20 19:51:46 +08:00
Wenjie Zhang
15f52bfc8f 修复 embedding 和 reranker 无法本地调用 gpu 的问题,需要安装 nvidia-container-toolkit 2025-03-07 01:05:50 +08:00
Wenjie Zhang
fb15e258db 支持 ollma embedding 2025-03-04 13:49:00 +08:00
Wenjie Zhang
e04add5bc2 update logger 2025-02-27 19:35:25 +08:00
Wenjie Zhang
b2dbc17fec 修改并适配硅基流动模型 2025-02-23 16:38:56 +08:00