diff --git a/packages/proxy/schema/index.ts b/packages/proxy/schema/index.ts index 83192474..ff54b3c9 100644 --- a/packages/proxy/schema/index.ts +++ b/packages/proxy/schema/index.ts @@ -914,7 +914,7 @@ export const AvailableEndpointTypes: { [name: string]: ModelEndpointType[] } = { "zai-org/GLM-5.1": ["together"], "zai-org/GLM-5.2": ["baseten", "together"], "zai-org/GLM-5.2-Fast": ["baseten"], - "zai-org/GLM-5.3-Flash": ["baseten"], + "zai-org/GLM-5.3-Flash": ["baseten", "together"], "MiniMaxAI/MiniMax-M2.7": ["together"], "MiniMaxAI/MiniMax-M3": ["together"], "mistral-medium-2508": ["mistral"], @@ -1384,6 +1384,7 @@ export const AvailableEndpointTypes: { [name: string]: ModelEndpointType[] } = { "gemini-2.5-flash-lite": ["google", "openrouter"], "gemini-2.5-pro": ["google", "openrouter"], "databricks-deepseek-v4-pro-0813": ["databricks"], + "databricks-grok-4-6": ["databricks"], }; const modelEndpointAvailableModels = getAvailableModels(); diff --git a/packages/proxy/schema/model_list.json b/packages/proxy/schema/model_list.json index 1c13a175..6d7370b9 100644 --- a/packages/proxy/schema/model_list.json +++ b/packages/proxy/schema/model_list.json @@ -10912,7 +10912,8 @@ "max_input_tokens": 1048576, "max_output_tokens": 131072, "available_providers": [ - "baseten" + "baseten", + "together" ] }, "zai-org/GLM-5.2": { @@ -11082,6 +11083,7 @@ "multimodal": true, "input_cost_per_mil_tokens": 0.5, "output_cost_per_mil_tokens": 1.5, + "input_cache_read_cost_per_mil_tokens": 0.05, "displayName": "Mistral Large", "max_input_tokens": 262144, "max_output_tokens": 262144, @@ -11109,6 +11111,7 @@ "multimodal": true, "input_cost_per_mil_tokens": 1.5, "output_cost_per_mil_tokens": 7.5, + "input_cache_read_cost_per_mil_tokens": 0.15, "displayName": "Mistral Medium 3.5", "reasoning": true, "reasoning_budget": true, @@ -11207,6 +11210,8 @@ "input_cost_per_mil_tokens": 2, "output_cost_per_mil_tokens": 5, "displayName": "Magistral Medium Latest", + "deprecated": true, + "deprecation_date": "2026-07-31", "max_input_tokens": 128000, "max_output_tokens": 40000, "available_providers": [ @@ -11317,6 +11322,7 @@ "multimodal": true, "input_cost_per_mil_tokens": 0.15, "output_cost_per_mil_tokens": 0.6, + "input_cache_read_cost_per_mil_tokens": 0.015, "displayName": "Mistral Small", "reasoning": true, "reasoning_budget": true, @@ -11348,6 +11354,8 @@ "input_cost_per_mil_tokens": 0.5, "output_cost_per_mil_tokens": 1.5, "displayName": "Magistral Small Latest", + "deprecated": true, + "deprecation_date": "2026-07-31", "max_input_tokens": 128000, "max_output_tokens": 40000, "available_providers": [ @@ -12612,6 +12620,16 @@ "openrouter" ] }, + "databricks-grok-4-6": { + "format": "openai", + "flavor": "chat", + "displayName": "Grok 4.6", + "reasoning": true, + "max_input_tokens": 500000, + "available_providers": [ + "databricks" + ] + }, "databricks-deepseek-v4-pro-0813": { "format": "openai", "flavor": "chat", @@ -13325,6 +13343,22 @@ "databricks" ] }, + "qwen/qwen3.8-27b": { + "format": "openai", + "flavor": "chat", + "multimodal": true, + "input_cost_per_mil_tokens": 0.8, + "output_cost_per_mil_tokens": 4, + "input_cache_read_cost_per_mil_tokens": 0.4, + "displayName": "Qwen: Qwen3.8 27B", + "reasoning": true, + "max_input_tokens": 131042, + "max_output_tokens": 16384, + "available_providers": [ + "groq", + "openrouter" + ] + }, "stealth/ox-alpha": { "format": "openai", "flavor": "chat", @@ -15678,22 +15712,6 @@ "openrouter" ] }, - "qwen/qwen3.8-27b": { - "format": "openai", - "flavor": "chat", - "multimodal": true, - "input_cost_per_mil_tokens": 0.8, - "output_cost_per_mil_tokens": 4, - "input_cache_read_cost_per_mil_tokens": 0.4, - "displayName": "Qwen: Qwen3.8 27B", - "reasoning": true, - "max_input_tokens": 131042, - "max_output_tokens": 16384, - "available_providers": [ - "groq", - "openrouter" - ] - }, "qwen/qwen3.8-2.4t-a95b": { "format": "openai", "flavor": "chat",