From 431ea47da19b8eec2c42ff1ef507aa09f5f0c679 Mon Sep 17 00:00:00 2001 From: =?UTF-8?q?=E5=B0=8F=E5=94=AF=20A06?= Date: Wed, 9 Sep 2026 01:10:53 +0800 Subject: [PATCH] =?UTF-8?q?default=20config:=20zhipu=20provider=20+=20fall?= =?UTF-8?q?back(llama-local=20=E5=90=8E)?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit --- config.yaml | 16 +++++---- profiles/prof-b/config.yaml | 68 +++++++++++++++++++++++++++++++++---- 2 files changed, 71 insertions(+), 13 deletions(-) diff --git a/config.yaml b/config.yaml index 4406c2c3..bb3b317d 100644 --- a/config.yaml +++ b/config.yaml @@ -6,6 +6,8 @@ model: context_length: 1048576 fallback_providers: - gmi-cloud + - llama-local + - zhipu providers: agnes: base_url: https://apihub.agnes-ai.com/v1 @@ -41,7 +43,7 @@ providers: api_key: 0ExNiLblJvIWBDpkS50fwOBw4MmqLyKdHJK5iQtlw9dOMWBP base_url: http://127.0.0.1:3000/v1 cost_factor: 0.0 - default_model: nvidia/nemotron-3-super-120b-a12b + default_model: agnes-2.0-flash models: - nvidia/nemotron-mini-4b-instruct - openai/gpt-oss-120b @@ -97,9 +99,9 @@ providers: api_key: local-key base_url: http://127.0.0.1:8080/v1 cost_factor: 0.0 - default_model: qwen35-4b + default_model: minicpm5-2b models: - - qwen35-4b + - minicpm5-2b rate_limit: 100 timeout: 300 context_length: 8192 @@ -276,7 +278,7 @@ auxiliary: timeout: 30 approval: provider: llama-local - model: qwen35-4b + model: minicpm5-2b base_url: '' api_key: '' timeout: 30 @@ -288,13 +290,13 @@ auxiliary: timeout: 30 title_generation: provider: llama-local - model: qwen35-4b + model: minicpm5-2b base_url: '' api_key: '' timeout: 30 triage_specifier: provider: llama-local - model: qwen35-4b + model: minicpm5-2b base_url: '' api_key: '' timeout: 120 @@ -306,7 +308,7 @@ auxiliary: timeout: 180 profile_describer: provider: llama-local - model: qwen35-4b + model: minicpm5-2b base_url: '' api_key: '' timeout: 60 diff --git a/profiles/prof-b/config.yaml b/profiles/prof-b/config.yaml index 6d413c45..c18747c3 100644 --- a/profiles/prof-b/config.yaml +++ b/profiles/prof-b/config.yaml @@ -1,10 +1,47 @@ model: - default: glm-5.2 - provider: sensenova - api_key_env: SENSENOVA_API_KEY - base_url: https://token.sensenova.cn/v1 -fallback_providers: '["newapi-local"]' + default: agnes-2.0-flash + provider: agnes + api_key_env: AGNES_API_KEY + base_url: https://apihub.agnes-ai.com/v1 +fallback_providers: '["sensenova", "llama-local", "zhipu", "gmi-cloud", "newapi-local"]' providers: + llama-local: + api_key: local-key + base_url: http://127.0.0.1:8080/v1 + cost_factor: 0.0 + default_model: minicpm5-2b + models: + - minicpm5-2b + rate_limit: 100 + timeout: 300 + context_length: 8192 + zhipu: + base_url: https://open.bigmodel.cn/api/paas/v4 + cost_factor: 0.0 + default_model: glm-4-flash + key_env: ZHIPU_API_KEY + models: + - glm-4-flash + rate_limit: 100 + timeout: 60 + deepseek: + key_env: DEEPSEEK_API_KEY + base_url: https://api.deepseek.com + cost_factor: 0.0 + default_model: deepseek-v4-flash + models: + - deepseek-v4-flash + rate_limit: 1000 + timeout: 30 + gmi-cloud: + key_env: GMI_API_KEY + base_url: https://api.gmi-serving.com/v1 + cost_factor: 0.0 + default_model: MiniMaxAI/MiniMax-M3 + models: + - MiniMaxAI/MiniMax-M3 + rate_limit: 100 + timeout: 60 sensenova: key_env: SENSENOVA_API_KEY base_url: https://token.sensenova.cn/v1 @@ -18,13 +55,32 @@ providers: - sensenova-u1-fast rate_limit: 100 timeout: 60 + agnes: + api_key_env: AGNES_API_KEY + base_url: https://apihub.agnes-ai.com/v1 + cost_factor: 0.0 + default_model: agnes-2.0-flash + models: + - agnes-2.0-flash + - agnes-2.5-flash + rate_limit: 100 + timeout: 60 newapi-local: api_key: 0ExNiLblJvIWBDpkS50fwOBw4MmqLyKdHJK5iQtlw9dOMWBP base_url: http://127.0.0.1:3000/v1 cost_factor: 0.0 - default_model: deepseek-v4-flash + default_model: minimaxai/minimax-m3 models: + - minimaxai/minimax-m3 + - google/gemma-4-31b-it + - openai/gpt-oss-120b - deepseek-v4-flash - glm-5.2 rate_limit: 1000 timeout: 30 +onboarding: + seen: + tool_progress_prompt: true + busy_input_prompt: true +approvals: + destructive_slash_confirm: false