From 19145805dd5d6ae18be9fd3afdb871ecf7cc89f8 Mon Sep 17 00:00:00 2001 From: Krrish Dholakia Date: Mon, 17 Jun 2024 11:04:39 -0700 Subject: [PATCH] build(model_prices_and_context_window.json): add gemini pricing based on context window --- ...odel_prices_and_context_window_backup.json | 20 +++++++++++++++++++ model_prices_and_context_window.json | 20 +++++++++++++++++++ 2 files changed, 40 insertions(+) diff --git a/litellm/model_prices_and_context_window_backup.json b/litellm/model_prices_and_context_window_backup.json index 98da8d69c0c..9a25d39c40d 100644 --- a/litellm/model_prices_and_context_window_backup.json +++ b/litellm/model_prices_and_context_window_backup.json @@ -1519,7 +1519,11 @@ "max_audio_per_prompt": 1, "max_pdf_size_mb": 30, "input_cost_per_token": 0, + "input_cost_per_token_up_to_128k_tokens": 0.00000035, + "input_cost_per_token_above_128k_tokens": 0.0000007, "output_cost_per_token": 0, + "output_cost_per_token_up_to_128k_tokens": 0.00000105, + "output_cost_per_token_above_128k_tokens": 0.0000021, "litellm_provider": "gemini", "mode": "chat", "supports_function_calling": true, @@ -1531,7 +1535,11 @@ "max_input_tokens": 32760, "max_output_tokens": 8192, "input_cost_per_token": 0.0, + "input_cost_per_token_up_to_128k_tokens": 0.00000035, + "input_cost_per_token_above_128k_tokens": 0.0000007, "output_cost_per_token": 0.0, + "output_cost_per_token_up_to_128k_tokens": 0.00000105, + "output_cost_per_token_above_128k_tokens": 0.0000021, "litellm_provider": "gemini", "mode": "chat", "supports_function_calling": true, @@ -1542,7 +1550,11 @@ "max_input_tokens": 1000000, "max_output_tokens": 8192, "input_cost_per_token": 0, + "input_cost_per_token_up_to_128k_tokens": 0.00000035, + "input_cost_per_token_above_128k_tokens": 0.0000007, "output_cost_per_token": 0, + "output_cost_per_token_up_to_128k_tokens": 0.00000105, + "output_cost_per_token_above_128k_tokens": 0.0000021, "litellm_provider": "gemini", "mode": "chat", "supports_function_calling": true, @@ -1555,7 +1567,11 @@ "max_input_tokens": 1048576, "max_output_tokens": 8192, "input_cost_per_token": 0, + "input_cost_per_token_up_to_128k_tokens": 0.00000035, + "input_cost_per_token_above_128k_tokens": 0.0000007, "output_cost_per_token": 0, + "output_cost_per_token_up_to_128k_tokens": 0.00000105, + "output_cost_per_token_above_128k_tokens": 0.0000021, "litellm_provider": "gemini", "mode": "chat", "supports_function_calling": true, @@ -1568,7 +1584,11 @@ "max_input_tokens": 30720, "max_output_tokens": 2048, "input_cost_per_token": 0.0, + "input_cost_per_token_up_to_128k_tokens": 0.00000035, + "input_cost_per_token_above_128k_tokens": 0.0000007, "output_cost_per_token": 0.0, + "output_cost_per_token_up_to_128k_tokens": 0.00000105, + "output_cost_per_token_above_128k_tokens": 0.0000021, "litellm_provider": "gemini", "mode": "chat", "supports_function_calling": true, diff --git a/model_prices_and_context_window.json b/model_prices_and_context_window.json index 98da8d69c0c..9a25d39c40d 100644 --- a/model_prices_and_context_window.json +++ b/model_prices_and_context_window.json @@ -1519,7 +1519,11 @@ "max_audio_per_prompt": 1, "max_pdf_size_mb": 30, "input_cost_per_token": 0, + "input_cost_per_token_up_to_128k_tokens": 0.00000035, + "input_cost_per_token_above_128k_tokens": 0.0000007, "output_cost_per_token": 0, + "output_cost_per_token_up_to_128k_tokens": 0.00000105, + "output_cost_per_token_above_128k_tokens": 0.0000021, "litellm_provider": "gemini", "mode": "chat", "supports_function_calling": true, @@ -1531,7 +1535,11 @@ "max_input_tokens": 32760, "max_output_tokens": 8192, "input_cost_per_token": 0.0, + "input_cost_per_token_up_to_128k_tokens": 0.00000035, + "input_cost_per_token_above_128k_tokens": 0.0000007, "output_cost_per_token": 0.0, + "output_cost_per_token_up_to_128k_tokens": 0.00000105, + "output_cost_per_token_above_128k_tokens": 0.0000021, "litellm_provider": "gemini", "mode": "chat", "supports_function_calling": true, @@ -1542,7 +1550,11 @@ "max_input_tokens": 1000000, "max_output_tokens": 8192, "input_cost_per_token": 0, + "input_cost_per_token_up_to_128k_tokens": 0.00000035, + "input_cost_per_token_above_128k_tokens": 0.0000007, "output_cost_per_token": 0, + "output_cost_per_token_up_to_128k_tokens": 0.00000105, + "output_cost_per_token_above_128k_tokens": 0.0000021, "litellm_provider": "gemini", "mode": "chat", "supports_function_calling": true, @@ -1555,7 +1567,11 @@ "max_input_tokens": 1048576, "max_output_tokens": 8192, "input_cost_per_token": 0, + "input_cost_per_token_up_to_128k_tokens": 0.00000035, + "input_cost_per_token_above_128k_tokens": 0.0000007, "output_cost_per_token": 0, + "output_cost_per_token_up_to_128k_tokens": 0.00000105, + "output_cost_per_token_above_128k_tokens": 0.0000021, "litellm_provider": "gemini", "mode": "chat", "supports_function_calling": true, @@ -1568,7 +1584,11 @@ "max_input_tokens": 30720, "max_output_tokens": 2048, "input_cost_per_token": 0.0, + "input_cost_per_token_up_to_128k_tokens": 0.00000035, + "input_cost_per_token_above_128k_tokens": 0.0000007, "output_cost_per_token": 0.0, + "output_cost_per_token_up_to_128k_tokens": 0.00000105, + "output_cost_per_token_above_128k_tokens": 0.0000021, "litellm_provider": "gemini", "mode": "chat", "supports_function_calling": true,