ai-saas / saas-search

09 Mar, 2026

2 commits

bc089b43 refactor(reranker): 对齐 Qwen3-Reranker 官方实现 ... Browse Dir »

config/config.yaml:
- qwen3_vllm: enable_prefix_caching true（启用前缀缓存）
- qwen3_vllm: enforce_eager false（允许 CUDA graph 加速）

reranker/backends/qwen3_vllm.py:
- TokensPrompt 导入改为 vllm.inputs.data（官方路径，兼容性更好）
- 缺失 token 时使用 logprob=-10，与官方一致（原为 1e-10）
- 使用批量 apply_chat_template 替代逐条调用，提升效率
- logprobs 访问改为官方模式：token not in last 时 -10，否则 last[token].logprob

其他: docs、embeddings、README 等文档更新

Made-with: Cursor

2026-03-09 23:48:19 +0800

07cf5a93 START_EMBEDDING=1 START_TRANSLATOR=1 START_RERANKER=1 START_TEI=1 ... Browse Dir »
```
CNCLIP_DEVICE=cuda TEI_USE_GPU=1 ./scripts/service_ctl.sh start
搜索后端+indexer+测试前段+4个微服务 跑通
```
tangwang
2026-03-09 23:29:07 +0800

08 Mar, 2026

2 commits

0e66a315 docs Browse Dir »

tangwang
2026-03-08 23:02:25 +0800
701ae503 docs Browse Dir »

tangwang
2026-03-08 14:30:07 +0800

07 Mar, 2026

2 commits

42e3aea6 tidy Browse Dir »

tangwang
2026-03-07 19:44:25 +0800
d1d356f8 脚本优化 Browse Dir »

tangwang
2026-03-07 11:48:59 +0800

06 Mar, 2026

1 commit

a7920e17 项目名称和部署路径修改 Browse Dir »

tangwang
2026-03-06 17:32:37 +0800

05 Feb, 2026

1 commit

ff32d894 rerank Browse Dir »

tangwang
2026-02-05 16:13:46 +0800

04 Feb, 2026

1 commit

d90e7428 补充重排 Browse Dir »

tangwang
2026-02-04 19:48:05 +0800