Skip to content
Open
Show file tree
Hide file tree
Changes from all commits
Commits
File filter

Filter by extension

Filter by extension

Conversations
Failed to load comments.
Loading
Jump to
Jump to file
Failed to load files.
Loading
Diff view
Diff view
9 changes: 9 additions & 0 deletions packages/proxy/schema/index.ts
Original file line number Diff line number Diff line change
Expand Up @@ -1114,6 +1114,15 @@ export const AvailableEndpointTypes: { [name: string]: ModelEndpointType[] } = {
"command-r-plus-08-2024": ["cohere", "openrouter"],
"command-r-08-2024": ["cohere", "openrouter"],
"command-r7b-12-2024": ["cohere", "openrouter"],
"databricks-gemini-3-6-flash": ["databricks"],
"databricks-glm-5-2": ["databricks"],
"databricks-inkling": ["databricks"],
"google.gemma-3-12b-it": ["bedrock"],
"google.gemma-3-4b-it": ["bedrock"],
"nvidia.nemotron-nano-9b-v2": ["bedrock"],
"openai.gpt-5.6-sol": ["bedrock"],
"openai.gpt-5.6-terra": ["bedrock"],
"openai.gpt-5.6-luna": ["bedrock"],
};

const modelEndpointAvailableModels = getAvailableModels();
Expand Down
147 changes: 141 additions & 6 deletions packages/proxy/schema/model_list.json
Original file line number Diff line number Diff line change
Expand Up @@ -27,6 +27,9 @@
"input_cache_write_cost_per_mil_tokens": 1.25,
"displayName": "GPT-5.6 Luna",
"reasoning": true,
"fallback_models": [
"openai.gpt-5.6-luna"
],
"max_input_tokens": 1050000,
"max_output_tokens": 128000,
"available_providers": [
Expand All @@ -45,6 +48,9 @@
"input_cache_write_cost_per_mil_tokens": 6.25,
"displayName": "GPT-5.6 Sol",
"reasoning": true,
"fallback_models": [
"openai.gpt-5.6-sol"
],
"max_input_tokens": 1050000,
"max_output_tokens": 128000,
"available_providers": [
Expand All @@ -63,6 +69,9 @@
"input_cache_write_cost_per_mil_tokens": 3.125,
"displayName": "GPT-5.6 Terra",
"reasoning": true,
"fallback_models": [
"openai.gpt-5.6-terra"
],
"max_input_tokens": 1050000,
"max_output_tokens": 128000,
"available_providers": [
Expand Down Expand Up @@ -7898,7 +7907,11 @@
"flavor": "chat",
"input_cost_per_mil_tokens": 0.1,
"output_cost_per_mil_tokens": 0.3,
"parent": "mistral-small-latest"
"deprecation_date": "2025-11-30",
"parent": "mistral-small-latest",
"available_providers": [
"mistral"
]
},
"ministral-8b-2410": {
"format": "openai",
Expand All @@ -7919,14 +7932,22 @@
"flavor": "chat",
"input_cost_per_mil_tokens": 0.2,
"output_cost_per_mil_tokens": 0.6,
"displayName": "Mistral Saba"
"displayName": "Mistral Saba",
"deprecation_date": "2025-09-30",
"available_providers": [
"mistral"
]
},
"mistral-saba-2502": {
"format": "openai",
"flavor": "chat",
"input_cost_per_mil_tokens": 0.2,
"output_cost_per_mil_tokens": 0.6,
"parent": "mistral-saba-latest"
"deprecation_date": "2025-09-30",
"parent": "mistral-saba-latest",
"available_providers": [
"mistral"
]
},
"llama3-3-70b": {
"format": "openai",
Expand Down Expand Up @@ -8128,11 +8149,10 @@
"reasoning_budget": true,
"fallback_models": [
"anthropic.claude-opus-5",
"eu.anthropic.claude-opus-5",
"global.anthropic.claude-opus-5",
"publishers/anthropic/models/claude-opus-5",
"us.anthropic.claude-opus-5",
"eu.anthropic.claude-opus-5",
"au.anthropic.claude-opus-5"
"us.anthropic.claude-opus-5"

Copy link
Copy Markdown

Choose a reason for hiding this comment

The reason will be displayed to describe this comment to others. Learn more.

P2 Badge Preserve the AU Opus fallback

For callers that use fallback_models to enumerate provider-specific equivalents of claude-opus-5, this regeneration silently drops au.anthropic.claude-opus-5, even though that model remains in the catalog and is still mapped to Bedrock in schema/index.ts. The sync logic currently omits au from ANTHROPIC_BEDROCK_SCOPES, so future regenerations will continue removing this valid equivalence; retain the AU fallback and teach the generator to recognize that scope.

Useful? React with 👍 / 👎.

],
"max_input_tokens": 1000000,
"max_output_tokens": 128000,
Expand Down Expand Up @@ -8858,6 +8878,32 @@
"bedrock"
]
},
"google.gemma-3-12b-it": {
"format": "openai",
"flavor": "chat",
"multimodal": true,
"input_cost_per_mil_tokens": 0.09,
"output_cost_per_mil_tokens": 0.29,
"displayName": "Gemma 3 12B IT",
"max_input_tokens": 128000,
"max_output_tokens": 8000,
"available_providers": [
"bedrock"
]
},
"google.gemma-3-4b-it": {
"format": "openai",
"flavor": "chat",
"multimodal": true,
"input_cost_per_mil_tokens": 0.04,
"output_cost_per_mil_tokens": 0.08,
"displayName": "Gemma 3 4B IT",
"max_input_tokens": 128000,
"max_output_tokens": 8000,
"available_providers": [
"bedrock"
]
},
"zai.glm-5": {
"format": "converse",
"flavor": "chat",
Expand Down Expand Up @@ -8969,6 +9015,48 @@
"bedrock"
]
},
"openai.gpt-5.6-sol": {
"format": "openai",
"flavor": "chat",
"multimodal": true,
"input_cost_per_mil_tokens": 5.5,
"output_cost_per_mil_tokens": 33,
"input_cache_read_cost_per_mil_tokens": 0.55,
"displayName": "OpenAI GPT-5.6 Sol (Bedrock)",
"reasoning": true,
"max_input_tokens": 272000,
"available_providers": [
"bedrock"
]
},
"openai.gpt-5.6-terra": {
"format": "openai",
"flavor": "chat",
"multimodal": true,
"input_cost_per_mil_tokens": 2.75,
"output_cost_per_mil_tokens": 16.5,
"input_cache_read_cost_per_mil_tokens": 0.28,
"displayName": "OpenAI GPT-5.6 Terra (Bedrock)",
"reasoning": true,
"max_input_tokens": 272000,
"available_providers": [
"bedrock"
]
},
"openai.gpt-5.6-luna": {
"format": "openai",
"flavor": "chat",
"multimodal": true,
"input_cost_per_mil_tokens": 1.1,
"output_cost_per_mil_tokens": 6.6,
"input_cache_read_cost_per_mil_tokens": 0.11,
"displayName": "OpenAI GPT-5.6 Luna (Bedrock)",
"reasoning": true,
"max_input_tokens": 272000,
"available_providers": [
"bedrock"
]
},
"xai.grok-4.3": {
"format": "openai",
"flavor": "chat",
Expand Down Expand Up @@ -9273,6 +9361,18 @@
"bedrock"
]
},
"nvidia.nemotron-nano-9b-v2": {
"format": "converse",
"flavor": "chat",
"input_cost_per_mil_tokens": 0.06,
"output_cost_per_mil_tokens": 0.23,
"displayName": "NVIDIA Nemotron Nano 9B v2",
"max_input_tokens": 128000,
"max_output_tokens": 8000,
"available_providers": [
"bedrock"
]
},
"amazon.nova-2-lite-v1:0": {
"format": "converse",
"flavor": "chat",
Expand Down Expand Up @@ -12722,6 +12822,41 @@
"databricks"
]
},
"databricks-gemini-3-6-flash": {
"format": "openai",
"flavor": "chat",
"multimodal": true,
"displayName": "Gemini 3.6 Flash",
"reasoning": true,
"reasoning_budget": true,
"max_input_tokens": 1048576,
"max_output_tokens": 65536,
"available_providers": [
"databricks"
]
},
"databricks-glm-5-2": {
"format": "openai",
"flavor": "chat",
"displayName": "GLM 5.2",
"reasoning": true,
"max_input_tokens": 262144,
"max_output_tokens": 128000,
"available_providers": [
"databricks"
]
},
"databricks-inkling": {
"format": "openai",
"flavor": "chat",
"multimodal": true,
"displayName": "Inkling",
"reasoning": true,
"max_input_tokens": 1048576,
"available_providers": [
"databricks"
]
},
"thinkingmachines/inkling": {
"format": "openai",
"flavor": "chat",
Expand Down