diff --git a/ci_cd/generate_model_prices_schema.py b/ci_cd/generate_model_prices_schema.py index 8d0431e286b..8eec07dadda 100644 --- a/ci_cd/generate_model_prices_schema.py +++ b/ci_cd/generate_model_prices_schema.py @@ -228,8 +228,6 @@ COST_DESCRIPTIONS: dict[str, str] = { def cost_description(key: str) -> Optional[str]: if key in COST_DESCRIPTIONS: return COST_DESCRIPTIONS[key] - if key.endswith("_balanced"): - return "Balanced service-tier rate for the same-named base field." if key.endswith("_flex"): return "Flex service-tier rate for the same-named base field." if key.endswith("_priority"): diff --git a/model_prices_and_context_window.schema.json b/model_prices_and_context_window.schema.json index 34812b13439..8a4f7e14104 100644 --- a/model_prices_and_context_window.schema.json +++ b/model_prices_and_context_window.schema.json @@ -202,8 +202,7 @@ }, "cache_read_input_token_cost_balanced": { "type": "number", - "minimum": 0, - "description": "Balanced service-tier rate for the same-named base field." + "minimum": 0 }, "cache_read_input_token_cost_batches": { "type": "number", @@ -383,8 +382,7 @@ }, "input_cost_per_token_balanced": { "type": "number", - "minimum": 0, - "description": "Balanced service-tier rate for the same-named base field." + "minimum": 0 }, "input_cost_per_token_batches": { "type": "number", @@ -724,8 +722,7 @@ }, "output_cost_per_token_balanced": { "type": "number", - "minimum": 0, - "description": "Balanced service-tier rate for the same-named base field." + "minimum": 0 }, "output_cost_per_token_batches": { "type": "number", diff --git a/tests/test_litellm/test_utils.py b/tests/test_litellm/test_utils.py index 2a8b31c12cc..7aab68bf859 100644 --- a/tests/test_litellm/test_utils.py +++ b/tests/test_litellm/test_utils.py @@ -793,10 +793,12 @@ def test_aaamodel_prices_and_context_window_json_is_valid(): "input_cost_per_token_above_256k_tokens": {"type": "number"}, "input_cost_per_token_above_272k_tokens": {"type": "number"}, "input_cost_per_token_above_512k_tokens": {"type": "number"}, + "cache_read_input_token_cost_balanced": {"type": "number"}, "cache_read_input_token_cost_flex": {"type": "number"}, "cache_read_input_token_cost_priority": {"type": "number"}, "cache_read_input_token_cost_above_200k_tokens_priority": {"type": "number"}, "cache_read_input_token_cost_above_272k_tokens_priority": {"type": "number"}, + "input_cost_per_token_balanced": {"type": "number"}, "input_cost_per_token_flex": {"type": "number"}, "input_cost_per_token_priority": {"type": "number"}, "input_cost_per_token_above_200k_tokens_priority": {"type": "number"}, @@ -804,6 +806,7 @@ def test_aaamodel_prices_and_context_window_json_is_valid(): "input_cost_per_token_above_272k_tokens_batches": {"type": "number"}, "input_cost_per_token_above_272k_tokens_flex": {"type": "number"}, "input_cost_per_audio_token_priority": {"type": "number"}, + "output_cost_per_token_balanced": {"type": "number"}, "output_cost_per_token_flex": {"type": "number"}, "output_cost_per_token_priority": {"type": "number"}, "output_cost_per_token_above_200k_tokens_priority": {"type": "number"},