fix(distill): max_tokens 600→800 — Agnes推理模型JSON不再截断

engine.go: max_tokens 600→800
consolidate.go: max_tokens 300→800
根因: Agnes 2.0-flash是推理模型,max_tokens=600里大量是推理token,
正文只剩~300→JSON截断→parse error→蒸馏退化。
800确保推理+正文都够用。
This commit is contained in:
xiaowei 2026-08-20 00:10:51 +08:00
parent 38701748d1
commit ea4b5a4dfe
2 changed files with 2 additions and 2 deletions

View File

@ -184,7 +184,7 @@ func (e *Engine) ConsolidateMemory(target MemoryCandidate, candidates []MemoryCa
"model": e.LLMModel,
"messages": []map[string]string{{"role": "user", "content": prompt}},
"temperature": 0.1,
"max_tokens": 300,
"max_tokens": 800,
}
jsonBody, err := json.Marshal(body)
if err != nil {

View File

@ -339,7 +339,7 @@ func (e *Engine) callLLM5D(content string) (LLMResponse, error) {
{"role": "user", "content": prompt},
},
"temperature": 0.2,
"max_tokens": 600,
"max_tokens": 800,
}
jsonBody, err := json.Marshal(body)