From 0db13acdc7419c227388d96eed42de0317a3cc85 Mon Sep 17 00:00:00 2001 From: Ishaan Jaff Date: Tue, 5 Aug 2025 12:08:42 -0700 Subject: [PATCH] New models - add fireworks_ai/glm-4p5 model family (#13297) * add fireworks_ai/glm-4p5 * fix max output tokens --- ...odel_prices_and_context_window_backup.json | 26 +++++++++++++++++++ model_prices_and_context_window.json | 26 +++++++++++++++++++ 2 files changed, 52 insertions(+) diff --git a/litellm/model_prices_and_context_window_backup.json b/litellm/model_prices_and_context_window_backup.json index 3a266a38c72..2fd0364e0e1 100644 --- a/litellm/model_prices_and_context_window_backup.json +++ b/litellm/model_prices_and_context_window_backup.json @@ -14861,6 +14861,32 @@ "source": "https://fireworks.ai/pricing", "supports_tool_choice": false }, + "fireworks_ai/glm-4p5": { + "max_tokens": 128000, + "max_input_tokens": 128000, + "max_output_tokens": 96000, + "input_cost_per_token": 5.5e-07, + "output_cost_per_token": 2.19e-06, + "litellm_provider": "fireworks_ai", + "mode": "chat", + "supports_function_calling": true, + "supports_response_schema": true, + "supports_tool_choice": true, + "source": "https://fireworks.ai/models/fireworks/glm-4p5" + }, + "fireworks_ai/glm-4p5-air": { + "max_tokens": 128000, + "max_input_tokens": 128000, + "max_output_tokens": 96000, + "input_cost_per_token": 2.2e-07, + "output_cost_per_token": 8.8e-07, + "litellm_provider": "fireworks_ai", + "mode": "chat", + "supports_function_calling": true, + "supports_response_schema": true, + "supports_tool_choice": true, + "source": "https://artificialanalysis.ai/models/glm-4-5-air" + }, "fireworks_ai/nomic-ai/nomic-embed-text-v1.5": { "max_tokens": 8192, "max_input_tokens": 8192, diff --git a/model_prices_and_context_window.json b/model_prices_and_context_window.json index 3a266a38c72..2fd0364e0e1 100644 --- a/model_prices_and_context_window.json +++ b/model_prices_and_context_window.json @@ -14861,6 +14861,32 @@ "source": "https://fireworks.ai/pricing", "supports_tool_choice": false }, + "fireworks_ai/glm-4p5": { + "max_tokens": 128000, + "max_input_tokens": 128000, + "max_output_tokens": 96000, + "input_cost_per_token": 5.5e-07, + "output_cost_per_token": 2.19e-06, + "litellm_provider": "fireworks_ai", + "mode": "chat", + "supports_function_calling": true, + "supports_response_schema": true, + "supports_tool_choice": true, + "source": "https://fireworks.ai/models/fireworks/glm-4p5" + }, + "fireworks_ai/glm-4p5-air": { + "max_tokens": 128000, + "max_input_tokens": 128000, + "max_output_tokens": 96000, + "input_cost_per_token": 2.2e-07, + "output_cost_per_token": 8.8e-07, + "litellm_provider": "fireworks_ai", + "mode": "chat", + "supports_function_calling": true, + "supports_response_schema": true, + "supports_tool_choice": true, + "source": "https://artificialanalysis.ai/models/glm-4-5-air" + }, "fireworks_ai/nomic-ai/nomic-embed-text-v1.5": { "max_tokens": 8192, "max_input_tokens": 8192,