default config: zhipu provider + fallback(llama-local 后)

This commit is contained in:
小唯 A06 2026-09-09 01:10:53 +08:00
parent 82e230986f
commit 431ea47da1
2 changed files with 71 additions and 13 deletions

View File

@ -6,6 +6,8 @@ model:
context_length: 1048576
fallback_providers:
- gmi-cloud
- llama-local
- zhipu
providers:
agnes:
base_url: https://apihub.agnes-ai.com/v1
@ -41,7 +43,7 @@ providers:
api_key: 0ExNiLblJvIWBDpkS50fwOBw4MmqLyKdHJK5iQtlw9dOMWBP
base_url: http://127.0.0.1:3000/v1
cost_factor: 0.0
default_model: nvidia/nemotron-3-super-120b-a12b
default_model: agnes-2.0-flash
models:
- nvidia/nemotron-mini-4b-instruct
- openai/gpt-oss-120b
@ -97,9 +99,9 @@ providers:
api_key: local-key
base_url: http://127.0.0.1:8080/v1
cost_factor: 0.0
default_model: qwen35-4b
default_model: minicpm5-2b
models:
- qwen35-4b
- minicpm5-2b
rate_limit: 100
timeout: 300
context_length: 8192
@ -276,7 +278,7 @@ auxiliary:
timeout: 30
approval:
provider: llama-local
model: qwen35-4b
model: minicpm5-2b
base_url: ''
api_key: ''
timeout: 30
@ -288,13 +290,13 @@ auxiliary:
timeout: 30
title_generation:
provider: llama-local
model: qwen35-4b
model: minicpm5-2b
base_url: ''
api_key: ''
timeout: 30
triage_specifier:
provider: llama-local
model: qwen35-4b
model: minicpm5-2b
base_url: ''
api_key: ''
timeout: 120
@ -306,7 +308,7 @@ auxiliary:
timeout: 180
profile_describer:
provider: llama-local
model: qwen35-4b
model: minicpm5-2b
base_url: ''
api_key: ''
timeout: 60

View File

@ -1,10 +1,47 @@
model:
default: glm-5.2
provider: sensenova
api_key_env: SENSENOVA_API_KEY
base_url: https://token.sensenova.cn/v1
fallback_providers: '["newapi-local"]'
default: agnes-2.0-flash
provider: agnes
api_key_env: AGNES_API_KEY
base_url: https://apihub.agnes-ai.com/v1
fallback_providers: '["sensenova", "llama-local", "zhipu", "gmi-cloud", "newapi-local"]'
providers:
llama-local:
api_key: local-key
base_url: http://127.0.0.1:8080/v1
cost_factor: 0.0
default_model: minicpm5-2b
models:
- minicpm5-2b
rate_limit: 100
timeout: 300
context_length: 8192
zhipu:
base_url: https://open.bigmodel.cn/api/paas/v4
cost_factor: 0.0
default_model: glm-4-flash
key_env: ZHIPU_API_KEY
models:
- glm-4-flash
rate_limit: 100
timeout: 60
deepseek:
key_env: DEEPSEEK_API_KEY
base_url: https://api.deepseek.com
cost_factor: 0.0
default_model: deepseek-v4-flash
models:
- deepseek-v4-flash
rate_limit: 1000
timeout: 30
gmi-cloud:
key_env: GMI_API_KEY
base_url: https://api.gmi-serving.com/v1
cost_factor: 0.0
default_model: MiniMaxAI/MiniMax-M3
models:
- MiniMaxAI/MiniMax-M3
rate_limit: 100
timeout: 60
sensenova:
key_env: SENSENOVA_API_KEY
base_url: https://token.sensenova.cn/v1
@ -18,13 +55,32 @@ providers:
- sensenova-u1-fast
rate_limit: 100
timeout: 60
agnes:
api_key_env: AGNES_API_KEY
base_url: https://apihub.agnes-ai.com/v1
cost_factor: 0.0
default_model: agnes-2.0-flash
models:
- agnes-2.0-flash
- agnes-2.5-flash
rate_limit: 100
timeout: 60
newapi-local:
api_key: 0ExNiLblJvIWBDpkS50fwOBw4MmqLyKdHJK5iQtlw9dOMWBP
base_url: http://127.0.0.1:3000/v1
cost_factor: 0.0
default_model: deepseek-v4-flash
default_model: minimaxai/minimax-m3
models:
- minimaxai/minimax-m3
- google/gemma-4-31b-it
- openai/gpt-oss-120b
- deepseek-v4-flash
- glm-5.2
rate_limit: 1000
timeout: 30
onboarding:
seen:
tool_progress_prompt: true
busy_input_prompt: true
approvals:
destructive_slash_confirm: false