diff --git a/litellm/model_prices_and_context_window_backup.json b/litellm/model_prices_and_context_window_backup.json index f063e8f811e..d8e750fdeee 100644 --- a/litellm/model_prices_and_context_window_backup.json +++ b/litellm/model_prices_and_context_window_backup.json @@ -1079,7 +1079,8 @@ "source": "https://cloud.google.com/vertex-ai/generative-ai/docs/learn/models#foundation_models" }, "vertex_ai/claude-3-sonnet@20240229": { - "max_tokens": 200000, + "max_tokens": 4096, + "max_input_tokens": 200000, "max_output_tokens": 4096, "input_cost_per_token": 0.000003, "output_cost_per_token": 0.000015, @@ -1087,13 +1088,23 @@ "mode": "chat" }, "vertex_ai/claude-3-haiku@20240307": { - "max_tokens": 200000, + "max_tokens": 4096, + "max_input_tokens": 200000, "max_output_tokens": 4096, "input_cost_per_token": 0.00000025, "output_cost_per_token": 0.00000125, "litellm_provider": "vertex_ai-anthropic_models", "mode": "chat" }, + "vertex_ai/claude-3-opus@20240229": { + "max_tokens": 4096, + "max_input_tokens": 200000, + "max_output_tokens": 4096, + "input_cost_per_token": 0.0000015, + "output_cost_per_token": 0.0000075, + "litellm_provider": "vertex_ai-anthropic_models", + "mode": "chat" + }, "textembedding-gecko": { "max_tokens": 3072, "max_input_tokens": 3072, diff --git a/model_prices_and_context_window.json b/model_prices_and_context_window.json index f063e8f811e..d8e750fdeee 100644 --- a/model_prices_and_context_window.json +++ b/model_prices_and_context_window.json @@ -1079,7 +1079,8 @@ "source": "https://cloud.google.com/vertex-ai/generative-ai/docs/learn/models#foundation_models" }, "vertex_ai/claude-3-sonnet@20240229": { - "max_tokens": 200000, + "max_tokens": 4096, + "max_input_tokens": 200000, "max_output_tokens": 4096, "input_cost_per_token": 0.000003, "output_cost_per_token": 0.000015, @@ -1087,13 +1088,23 @@ "mode": "chat" }, "vertex_ai/claude-3-haiku@20240307": { - "max_tokens": 200000, + "max_tokens": 4096, + "max_input_tokens": 200000, "max_output_tokens": 4096, "input_cost_per_token": 0.00000025, "output_cost_per_token": 0.00000125, "litellm_provider": "vertex_ai-anthropic_models", "mode": "chat" }, + "vertex_ai/claude-3-opus@20240229": { + "max_tokens": 4096, + "max_input_tokens": 200000, + "max_output_tokens": 4096, + "input_cost_per_token": 0.0000015, + "output_cost_per_token": 0.0000075, + "litellm_provider": "vertex_ai-anthropic_models", + "mode": "chat" + }, "textembedding-gecko": { "max_tokens": 3072, "max_input_tokens": 3072,