feat: 升级 Ollama 本地模型 qwen2.5:1.5b → qwen3:1.7b
- config.py / .env.example / docker-compose.yml:默认模型改为 qwen3:1.7b(备选 qwen3:4b),compose 同步拉取 - 经 runtime_settings 注入 summarize/query/classify 三用途,改默认值即全局生效 - README / CLAUDE.md / 前端 Settings.vue 占位符同步更新
This commit is contained in:
@@ -22,7 +22,7 @@
|
||||
| 向量数据库 | Qdrant(Docker) |
|
||||
| 缓存 | Redis(Docker) |
|
||||
| 嵌入模型 | OpenAI / Ollama 本地模型(可切换) |
|
||||
| 本地推理 | Ollama + qwen2.5:1.5b(文档总结) |
|
||||
| 本地推理 | Ollama + qwen3:1.7b(文档总结) |
|
||||
| OCR | rapidocr-onnxruntime + pypdfium2(扫描件 PDF) |
|
||||
| 部署 | Docker Compose on NAS |
|
||||
|
||||
@@ -123,7 +123,7 @@ docker compose up -d
|
||||
### 4. 拉取 Ollama 模型(首次启动后)
|
||||
|
||||
```bash
|
||||
docker exec qmdsearch-ollama ollama pull qwen2.5:1.5b
|
||||
docker exec qmdsearch-ollama ollama pull qwen3:1.7b
|
||||
```
|
||||
|
||||
### 5. 验证服务
|
||||
@@ -232,7 +232,7 @@ curl -X POST http://localhost:8000/api/v1/documents/upload \
|
||||
| `EMBEDDING_PROVIDER` | 嵌入模型提供商(openai / local) | `openai` |
|
||||
| `OPENAI_API_KEY` | OpenAI API Key | - |
|
||||
| `EMBEDDING_MODEL` | 嵌入模型名称 | `text-embedding-3-small` |
|
||||
| `OLLAMA_MODEL` | Ollama 本地模型 | `qwen2.5:1.5b` |
|
||||
| `OLLAMA_MODEL` | Ollama 本地模型 | `qwen3:1.7b` |
|
||||
| `RETRIEVAL_TOP_K` | 检索召回数 | `20` |
|
||||
| `RETRIEVAL_FINAL_K` | 最终返回数 | `5` |
|
||||
| `INGEST_MAX_CONCURRENCY` | 入库并发上限 | `2` |
|
||||
|
||||
Reference in New Issue
Block a user