From 04dfe01660089f1f04142f625e79c449a3f1fc8c Mon Sep 17 00:00:00 2001 From: Krrish Dholakia Date: Tue, 16 Apr 2024 07:16:53 -0700 Subject: [PATCH] build(model_prices_and_context_window.json): add output vector size for openai models --- litellm/model_prices_and_context_window_backup.json | 6 +++++- model_prices_and_context_window.json | 6 +++++- 2 files changed, 10 insertions(+), 2 deletions(-) diff --git a/litellm/model_prices_and_context_window_backup.json b/litellm/model_prices_and_context_window_backup.json index afa2ede6ed2..a4c851c84f4 100644 --- a/litellm/model_prices_and_context_window_backup.json +++ b/litellm/model_prices_and_context_window_backup.json @@ -211,6 +211,7 @@ "text-embedding-3-large": { "max_tokens": 8191, "max_input_tokens": 8191, + "output_vector_size": 3072, "input_cost_per_token": 0.00000013, "output_cost_per_token": 0.000000, "litellm_provider": "openai", @@ -219,6 +220,7 @@ "text-embedding-3-small": { "max_tokens": 8191, "max_input_tokens": 8191, + "output_vector_size": 1536, "input_cost_per_token": 0.00000002, "output_cost_per_token": 0.000000, "litellm_provider": "openai", @@ -227,6 +229,7 @@ "text-embedding-ada-002": { "max_tokens": 8191, "max_input_tokens": 8191, + "output_vector_size": 1536, "input_cost_per_token": 0.0000001, "output_cost_per_token": 0.000000, "litellm_provider": "openai", @@ -1169,10 +1172,11 @@ "max_input_tokens": 3072, "output_vector_size": 768, "input_cost_per_token": 0.00000000625, + "input_cost_per_token_batch_requests": 0.000000005, "output_cost_per_token": 0, "litellm_provider": "vertex_ai-embedding-models", "mode": "embedding", - "source": "https://cloud.google.com/vertex-ai/generative-ai/docs/learn/models#foundation_models" + "source": "https://cloud.google.com/vertex-ai/generative-ai/pricing" }, "text-multilingual-embedding-preview-0409":{ "max_tokens": 3072, diff --git a/model_prices_and_context_window.json b/model_prices_and_context_window.json index afa2ede6ed2..a4c851c84f4 100644 --- a/model_prices_and_context_window.json +++ b/model_prices_and_context_window.json @@ -211,6 +211,7 @@ "text-embedding-3-large": { "max_tokens": 8191, "max_input_tokens": 8191, + "output_vector_size": 3072, "input_cost_per_token": 0.00000013, "output_cost_per_token": 0.000000, "litellm_provider": "openai", @@ -219,6 +220,7 @@ "text-embedding-3-small": { "max_tokens": 8191, "max_input_tokens": 8191, + "output_vector_size": 1536, "input_cost_per_token": 0.00000002, "output_cost_per_token": 0.000000, "litellm_provider": "openai", @@ -227,6 +229,7 @@ "text-embedding-ada-002": { "max_tokens": 8191, "max_input_tokens": 8191, + "output_vector_size": 1536, "input_cost_per_token": 0.0000001, "output_cost_per_token": 0.000000, "litellm_provider": "openai", @@ -1169,10 +1172,11 @@ "max_input_tokens": 3072, "output_vector_size": 768, "input_cost_per_token": 0.00000000625, + "input_cost_per_token_batch_requests": 0.000000005, "output_cost_per_token": 0, "litellm_provider": "vertex_ai-embedding-models", "mode": "embedding", - "source": "https://cloud.google.com/vertex-ai/generative-ai/docs/learn/models#foundation_models" + "source": "https://cloud.google.com/vertex-ai/generative-ai/pricing" }, "text-multilingual-embedding-preview-0409":{ "max_tokens": 3072,