feat: 升级 Ollama 本地模型 qwen2.5:1.5b → qwen3:1.7b
- config.py / .env.example / docker-compose.yml:默认模型改为 qwen3:1.7b(备选 qwen3:4b),compose 同步拉取 - 经 runtime_settings 注入 summarize/query/classify 三用途,改默认值即全局生效 - README / CLAUDE.md / 前端 Settings.vue 占位符同步更新
This commit is contained in:
+2
-2
@@ -96,7 +96,7 @@ services:
|
||||
- OLLAMA_MAX_LOADED_MODELS=3
|
||||
- OLLAMA_NUM_THREADS=16
|
||||
- OLLAMA_KV_CACHE_TYPE=q8_0
|
||||
# 首次启动自动拉取所需模型(qwen2.5:1.5b 总结 + bge-m3 嵌入 + qwen3-reranker 重排),
|
||||
# 首次启动自动拉取所需模型(qwen3:1.7b 总结 + bge-m3 嵌入 + qwen3-reranker 重排),
|
||||
# 下载完成后转交常驻 ollama serve。已存在时仅做健康检查。
|
||||
entrypoint: /bin/bash
|
||||
command:
|
||||
@@ -105,7 +105,7 @@ services:
|
||||
ollama serve &
|
||||
SERVE_PID=$$!
|
||||
sleep 6
|
||||
ollama pull qwen2.5:1.5b
|
||||
ollama pull qwen3:1.7b
|
||||
ollama pull bge-m3
|
||||
ollama pull qwen3-reranker:0.6b
|
||||
wait $$SERVE_PID
|
||||
|
||||
Reference in New Issue
Block a user