From cc853c4c4d5c0d3df6af0805d92ddd70748506d5 Mon Sep 17 00:00:00 2001 From: erin2722 <16248113+erin2722@users.noreply.github.com> Date: Sun, 23 Aug 2026 10:08:56 +0000 Subject: [PATCH 1/2] chore: update model catalog from bot issues --- packages/proxy/schema/index.ts | 1 + packages/proxy/schema/model_list.json | 13 +++++++++++++ 2 files changed, 14 insertions(+) diff --git a/packages/proxy/schema/index.ts b/packages/proxy/schema/index.ts index 5607e555..0d2510f7 100644 --- a/packages/proxy/schema/index.ts +++ b/packages/proxy/schema/index.ts @@ -1377,6 +1377,7 @@ export const AvailableEndpointTypes: { [name: string]: ModelEndpointType[] } = { "accounts/fireworks/models/qwen3p5-27b": ["fireworks"], "accounts/fireworks/models/qwen3p5-9b": ["fireworks"], "accounts/fireworks/models/qwen3p8-27b": ["fireworks"], + "google.gemma-3-27b-it": ["bedrock"], }; const modelEndpointAvailableModels = getAvailableModels(); diff --git a/packages/proxy/schema/model_list.json b/packages/proxy/schema/model_list.json index 98ad2ed8..6eacad41 100644 --- a/packages/proxy/schema/model_list.json +++ b/packages/proxy/schema/model_list.json @@ -8090,6 +8090,19 @@ "flavor": "completion", "displayName": "Text-block" }, + "google.gemma-3-27b-it": { + "format": "converse", + "flavor": "chat", + "multimodal": true, + "input_cost_per_mil_tokens": 0.23, + "output_cost_per_mil_tokens": 0.38, + "displayName": "Gemma 3 27B IT", + "max_input_tokens": 128000, + "max_output_tokens": 8000, + "available_providers": [ + "bedrock" + ] + }, "openai.gpt-daybreak-blue-5.6-sol": { "format": "openai", "flavor": "chat", From 8f85f153b8f0374c225a04926effe56ffa1573d8 Mon Sep 17 00:00:00 2001 From: Erin McNulty Date: Mon, 24 Aug 2026 17:24:45 +0000 Subject: [PATCH 2/2] catalog: refresh gpt-5.6-sol pricing to current OpenAI rates OpenAI lowered GPT-5.6 Sol's Standard pricing (developers.openai.com/api/docs/ pricing): input $5 -> $4, cached input $0.5 -> $0.4, output $30 -> $20, and 30m cache-write $6.25 -> $5 (1.25x input, consistent across the gpt-5.6 family). Update the openai-direct `gpt-5.6-sol` entry and its `gpt-5.6` alias (parent=gpt-5.6-sol) to match. cyber/luna/terra already match the page. Verified against the OpenAI developer pricing page; values match the same OpenAI-derived numbers the model sync produces. (This mirrors the Bedrock-side gpt-5.6-sol drop in #1153.) Co-Authored-By: Claude Opus 4.8 --- packages/proxy/schema/model_list.json | 16 ++++++++-------- 1 file changed, 8 insertions(+), 8 deletions(-) diff --git a/packages/proxy/schema/model_list.json b/packages/proxy/schema/model_list.json index 6eacad41..d5b85861 100644 --- a/packages/proxy/schema/model_list.json +++ b/packages/proxy/schema/model_list.json @@ -60,10 +60,10 @@ "format": "openai", "flavor": "chat", "multimodal": true, - "input_cost_per_mil_tokens": 5, - "output_cost_per_mil_tokens": 30, - "input_cache_read_cost_per_mil_tokens": 0.5, - "input_cache_write_cost_per_mil_tokens": 6.25, + "input_cost_per_mil_tokens": 4, + "output_cost_per_mil_tokens": 20, + "input_cache_read_cost_per_mil_tokens": 0.4, + "input_cache_write_cost_per_mil_tokens": 5, "displayName": "GPT-5.6", "reasoning": true, "parent": "gpt-5.6-sol", @@ -99,10 +99,10 @@ "format": "openai", "flavor": "chat", "multimodal": true, - "input_cost_per_mil_tokens": 5, - "output_cost_per_mil_tokens": 30, - "input_cache_read_cost_per_mil_tokens": 0.5, - "input_cache_write_cost_per_mil_tokens": 6.25, + "input_cost_per_mil_tokens": 4, + "output_cost_per_mil_tokens": 20, + "input_cache_read_cost_per_mil_tokens": 0.4, + "input_cache_write_cost_per_mil_tokens": 5, "displayName": "GPT-5.6 Sol", "reasoning": true, "fallback_models": [