default config: zhipu provider + fallback(llama-local 后)
This commit is contained in:
parent
82e230986f
commit
431ea47da1
16
config.yaml
16
config.yaml
|
|
@ -6,6 +6,8 @@ model:
|
|||
context_length: 1048576
|
||||
fallback_providers:
|
||||
- gmi-cloud
|
||||
- llama-local
|
||||
- zhipu
|
||||
providers:
|
||||
agnes:
|
||||
base_url: https://apihub.agnes-ai.com/v1
|
||||
|
|
@ -41,7 +43,7 @@ providers:
|
|||
api_key: 0ExNiLblJvIWBDpkS50fwOBw4MmqLyKdHJK5iQtlw9dOMWBP
|
||||
base_url: http://127.0.0.1:3000/v1
|
||||
cost_factor: 0.0
|
||||
default_model: nvidia/nemotron-3-super-120b-a12b
|
||||
default_model: agnes-2.0-flash
|
||||
models:
|
||||
- nvidia/nemotron-mini-4b-instruct
|
||||
- openai/gpt-oss-120b
|
||||
|
|
@ -97,9 +99,9 @@ providers:
|
|||
api_key: local-key
|
||||
base_url: http://127.0.0.1:8080/v1
|
||||
cost_factor: 0.0
|
||||
default_model: qwen35-4b
|
||||
default_model: minicpm5-2b
|
||||
models:
|
||||
- qwen35-4b
|
||||
- minicpm5-2b
|
||||
rate_limit: 100
|
||||
timeout: 300
|
||||
context_length: 8192
|
||||
|
|
@ -276,7 +278,7 @@ auxiliary:
|
|||
timeout: 30
|
||||
approval:
|
||||
provider: llama-local
|
||||
model: qwen35-4b
|
||||
model: minicpm5-2b
|
||||
base_url: ''
|
||||
api_key: ''
|
||||
timeout: 30
|
||||
|
|
@ -288,13 +290,13 @@ auxiliary:
|
|||
timeout: 30
|
||||
title_generation:
|
||||
provider: llama-local
|
||||
model: qwen35-4b
|
||||
model: minicpm5-2b
|
||||
base_url: ''
|
||||
api_key: ''
|
||||
timeout: 30
|
||||
triage_specifier:
|
||||
provider: llama-local
|
||||
model: qwen35-4b
|
||||
model: minicpm5-2b
|
||||
base_url: ''
|
||||
api_key: ''
|
||||
timeout: 120
|
||||
|
|
@ -306,7 +308,7 @@ auxiliary:
|
|||
timeout: 180
|
||||
profile_describer:
|
||||
provider: llama-local
|
||||
model: qwen35-4b
|
||||
model: minicpm5-2b
|
||||
base_url: ''
|
||||
api_key: ''
|
||||
timeout: 60
|
||||
|
|
|
|||
|
|
@ -1,10 +1,47 @@
|
|||
model:
|
||||
default: glm-5.2
|
||||
provider: sensenova
|
||||
api_key_env: SENSENOVA_API_KEY
|
||||
base_url: https://token.sensenova.cn/v1
|
||||
fallback_providers: '["newapi-local"]'
|
||||
default: agnes-2.0-flash
|
||||
provider: agnes
|
||||
api_key_env: AGNES_API_KEY
|
||||
base_url: https://apihub.agnes-ai.com/v1
|
||||
fallback_providers: '["sensenova", "llama-local", "zhipu", "gmi-cloud", "newapi-local"]'
|
||||
providers:
|
||||
llama-local:
|
||||
api_key: local-key
|
||||
base_url: http://127.0.0.1:8080/v1
|
||||
cost_factor: 0.0
|
||||
default_model: minicpm5-2b
|
||||
models:
|
||||
- minicpm5-2b
|
||||
rate_limit: 100
|
||||
timeout: 300
|
||||
context_length: 8192
|
||||
zhipu:
|
||||
base_url: https://open.bigmodel.cn/api/paas/v4
|
||||
cost_factor: 0.0
|
||||
default_model: glm-4-flash
|
||||
key_env: ZHIPU_API_KEY
|
||||
models:
|
||||
- glm-4-flash
|
||||
rate_limit: 100
|
||||
timeout: 60
|
||||
deepseek:
|
||||
key_env: DEEPSEEK_API_KEY
|
||||
base_url: https://api.deepseek.com
|
||||
cost_factor: 0.0
|
||||
default_model: deepseek-v4-flash
|
||||
models:
|
||||
- deepseek-v4-flash
|
||||
rate_limit: 1000
|
||||
timeout: 30
|
||||
gmi-cloud:
|
||||
key_env: GMI_API_KEY
|
||||
base_url: https://api.gmi-serving.com/v1
|
||||
cost_factor: 0.0
|
||||
default_model: MiniMaxAI/MiniMax-M3
|
||||
models:
|
||||
- MiniMaxAI/MiniMax-M3
|
||||
rate_limit: 100
|
||||
timeout: 60
|
||||
sensenova:
|
||||
key_env: SENSENOVA_API_KEY
|
||||
base_url: https://token.sensenova.cn/v1
|
||||
|
|
@ -18,13 +55,32 @@ providers:
|
|||
- sensenova-u1-fast
|
||||
rate_limit: 100
|
||||
timeout: 60
|
||||
agnes:
|
||||
api_key_env: AGNES_API_KEY
|
||||
base_url: https://apihub.agnes-ai.com/v1
|
||||
cost_factor: 0.0
|
||||
default_model: agnes-2.0-flash
|
||||
models:
|
||||
- agnes-2.0-flash
|
||||
- agnes-2.5-flash
|
||||
rate_limit: 100
|
||||
timeout: 60
|
||||
newapi-local:
|
||||
api_key: 0ExNiLblJvIWBDpkS50fwOBw4MmqLyKdHJK5iQtlw9dOMWBP
|
||||
base_url: http://127.0.0.1:3000/v1
|
||||
cost_factor: 0.0
|
||||
default_model: deepseek-v4-flash
|
||||
default_model: minimaxai/minimax-m3
|
||||
models:
|
||||
- minimaxai/minimax-m3
|
||||
- google/gemma-4-31b-it
|
||||
- openai/gpt-oss-120b
|
||||
- deepseek-v4-flash
|
||||
- glm-5.2
|
||||
rate_limit: 1000
|
||||
timeout: 30
|
||||
onboarding:
|
||||
seen:
|
||||
tool_progress_prompt: true
|
||||
busy_input_prompt: true
|
||||
approvals:
|
||||
destructive_slash_confirm: false
|
||||
|
|
|
|||
Loading…
Reference in New Issue