diff --git a/litellm/types/utils.py b/litellm/types/utils.py index 0c7358092cf..091307a1e8c 100644 --- a/litellm/types/utils.py +++ b/litellm/types/utils.py @@ -3825,6 +3825,8 @@ class CustomPricingLiteLLMParams(MirroredPricingParams): input_cost_per_token_balanced: float | None = None input_cost_per_token_ultrafast: float | None = None cache_creation_input_token_cost_above_1hr: float | None = None + cache_creation_input_token_cost_above_100k_tokens: float | None = None + cache_creation_input_token_cost_above_1hr_above_100k_tokens: float | None = None cache_creation_input_token_cost_above_200k_tokens: float | None = None cache_creation_input_token_cost_above_272k_tokens: float | None = None cache_creation_input_token_cost_above_272k_tokens_priority: float | None = None @@ -3838,15 +3840,18 @@ class CustomPricingLiteLLMParams(MirroredPricingParams): cache_read_input_token_cost_priority: float | None = None cache_read_input_token_cost_balanced: float | None = None cache_read_input_token_cost_ultrafast: float | None = None + cache_read_input_token_cost_above_100k_tokens: float | None = None cache_read_input_token_cost_above_200k_tokens: float | None = None cache_read_input_token_cost_above_200k_tokens_priority: float | None = None cache_read_input_token_cost_above_272k_tokens_priority: float | None = None cache_read_input_token_cost_above_272k_tokens_flex: float | None = None cache_read_input_token_cost_above_272k_tokens_ultrafast: float | None = None cache_read_input_token_cost_batches: float | None = None + cache_read_input_token_cost_above_100k_tokens_batches: float | None = None cache_read_input_token_cost_above_200k_tokens_batches: float | None = None cache_read_input_token_cost_above_272k_tokens_batches: float | None = None cache_creation_input_token_cost_batches: float | None = None + cache_creation_input_token_cost_above_100k_tokens_batches: float | None = None cache_creation_input_token_cost_above_200k_tokens_batches: float | None = None cache_creation_input_token_cost_above_272k_tokens_batches: float | None = None cache_read_input_audio_token_cost: float | None = None @@ -3855,12 +3860,14 @@ class CustomPricingLiteLLMParams(MirroredPricingParams): input_cost_per_audio_token: float | None = None input_cost_per_token_cache_hit: float | None = None input_cost_per_token_above_128k_tokens: float | None = None + input_cost_per_token_above_100k_tokens: float | None = None input_cost_per_token_above_200k_tokens: float | None = None input_cost_per_token_above_200k_tokens_priority: float | None = None input_cost_per_token_above_272k_tokens_priority: float | None = None input_cost_per_token_above_272k_tokens_flex: float | None = None input_cost_per_token_above_272k_tokens_ultrafast: float | None = None input_cost_per_token_above_200k_tokens_batches: float | None = None + input_cost_per_token_above_100k_tokens_batches: float | None = None input_cost_per_token_above_272k_tokens_batches: float | None = None input_cost_per_query: float | None = None input_cost_per_image: float | None = None @@ -3882,12 +3889,14 @@ class CustomPricingLiteLLMParams(MirroredPricingParams): output_cost_per_token_ultrafast: float | None = None output_cost_per_audio_token: float | None = None output_cost_per_token_above_128k_tokens: float | None = None + output_cost_per_token_above_100k_tokens: float | None = None output_cost_per_token_above_200k_tokens: float | None = None output_cost_per_token_above_200k_tokens_priority: float | None = None output_cost_per_token_above_272k_tokens_priority: float | None = None output_cost_per_token_above_272k_tokens_flex: float | None = None output_cost_per_token_above_272k_tokens_ultrafast: float | None = None output_cost_per_token_above_200k_tokens_batches: float | None = None + output_cost_per_token_above_100k_tokens_batches: float | None = None output_cost_per_token_above_272k_tokens_batches: float | None = None output_cost_per_character_above_128k_tokens: float | None = None output_cost_per_image: float | None = None