From a594f11c725ea0ac9119ba6475a4ed7d38ab15a2 Mon Sep 17 00:00:00 2001 From: erin2722 <16248113+erin2722@users.noreply.github.com> Date: Mon, 21 Sep 2026 10:22:55 +0000 Subject: [PATCH] chore: update model catalog from bot issues --- packages/proxy/schema/index.ts | 3 ++ packages/proxy/schema/model_list.json | 60 +++++++++++++++++++++------ 2 files changed, 50 insertions(+), 13 deletions(-) diff --git a/packages/proxy/schema/index.ts b/packages/proxy/schema/index.ts index c3e2d570..d8a82390 100644 --- a/packages/proxy/schema/index.ts +++ b/packages/proxy/schema/index.ts @@ -1438,6 +1438,9 @@ export const AvailableEndpointTypes: { [name: string]: ModelEndpointType[] } = { "mistral.voxtral-mini-3b-2507": ["bedrock"], "mistral.voxtral-small-24b-2507": ["bedrock"], "global.anthropic.claude-mythos-5": ["bedrock"], + "databricks-gpt-6-astra": ["databricks"], + "databricks-glm-5-3": ["databricks"], + "databricks-deepseek-v4-1-flash": ["databricks"], }; const modelEndpointAvailableModels = getAvailableModels(); diff --git a/packages/proxy/schema/model_list.json b/packages/proxy/schema/model_list.json index 55e9b67c..acf5ffa6 100644 --- a/packages/proxy/schema/model_list.json +++ b/packages/proxy/schema/model_list.json @@ -6399,19 +6399,6 @@ "openrouter" ] }, - "qwen/qwen3.6-27b": { - "format": "openai", - "flavor": "chat", - "input_cost_per_mil_tokens": 0.6, - "output_cost_per_mil_tokens": 3, - "displayName": "Qwen 3.6 27B", - "experimental": true, - "max_input_tokens": 131072, - "max_output_tokens": 16384, - "available_providers": [ - "openrouter" - ] - }, "groq/compound": { "format": "openai", "flavor": "chat", @@ -13383,6 +13370,40 @@ "openrouter" ] }, + "databricks-deepseek-v4-1-flash": { + "format": "openai", + "flavor": "chat", + "multimodal": true, + "displayName": "DeepSeek V4.1 Flash", + "reasoning": true, + "max_input_tokens": 1048576, + "available_providers": [ + "databricks" + ] + }, + "databricks-glm-5-3": { + "format": "openai", + "flavor": "chat", + "displayName": "GLM 5.3", + "reasoning": true, + "max_input_tokens": 1048576, + "max_output_tokens": 65536, + "available_providers": [ + "databricks" + ] + }, + "databricks-gpt-6-astra": { + "format": "openai", + "flavor": "chat", + "multimodal": true, + "displayName": "GPT-6 Astra", + "reasoning": true, + "max_input_tokens": 922000, + "max_output_tokens": 128000, + "available_providers": [ + "databricks" + ] + }, "databricks-gemini-3-8-flash": { "format": "openai", "flavor": "chat", @@ -14192,6 +14213,19 @@ "typesafe" ] }, + "qwen/qwen3.6-27b": { + "format": "openai", + "flavor": "chat", + "input_cost_per_mil_tokens": 0.6, + "output_cost_per_mil_tokens": 3, + "displayName": "Qwen 3.6 27B", + "experimental": true, + "max_input_tokens": 131072, + "max_output_tokens": 16384, + "available_providers": [ + "openrouter" + ] + }, "unbiased/pareto": { "format": "openai", "flavor": "chat",