diff --git a/litellm/model_prices_and_context_window_backup.json b/litellm/model_prices_and_context_window_backup.json index b4a36750fa2..c9658c6cc47 100644 --- a/litellm/model_prices_and_context_window_backup.json +++ b/litellm/model_prices_and_context_window_backup.json @@ -1479,6 +1479,70 @@ "supports_system_messages": true, "supports_tool_choice": true }, + "gpt-realtime": { + "max_tokens": 4096, + "max_input_tokens": 32000, + "max_output_tokens": 4096, + "input_cost_per_token": 4e-06, + "cache_read_input_token_cost": 0.4e-06, + "output_cost_per_token": 16e-06, + "input_cost_per_audio_token": 32e-06, + "output_cost_per_audio_token": 64e-06, + "cache_creation_input_audio_token_cost": 0.4e-06, + "input_cost_per_image": 5e-06, + "litellm_provider": "openai", + "mode": "chat", + "supports_function_calling": true, + "supports_parallel_function_calling": true, + "supports_audio_input": true, + "supports_audio_output": true, + "supports_system_messages": true, + "supports_tool_choice": true, + "supported_endpoints": [ + "/v1/realtime" + ], + "supported_modalities": [ + "text", + "image", + "audio" + ], + "supported_output_modalities": [ + "text", + "audio" + ] + }, + "gpt-realtime-2025-08-28": { + "max_tokens": 4096, + "max_input_tokens": 32000, + "max_output_tokens": 4096, + "input_cost_per_token": 4e-06, + "cache_read_input_token_cost": 0.4e-06, + "output_cost_per_token": 16e-06, + "input_cost_per_audio_token": 32e-06, + "output_cost_per_audio_token": 64e-06, + "cache_creation_input_audio_token_cost": 0.4e-06, + "input_cost_per_image": 5e-06, + "litellm_provider": "openai", + "mode": "chat", + "supports_function_calling": true, + "supports_parallel_function_calling": true, + "supports_audio_input": true, + "supports_audio_output": true, + "supports_system_messages": true, + "supports_tool_choice": true, + "supported_endpoints": [ + "/v1/realtime" + ], + "supported_modalities": [ + "text", + "image", + "audio" + ], + "supported_output_modalities": [ + "text", + "audio" + ] + }, "gpt-4o-realtime-preview-2024-10-01": { "max_tokens": 4096, "max_input_tokens": 128000, diff --git a/model_prices_and_context_window.json b/model_prices_and_context_window.json index b4a36750fa2..c9658c6cc47 100644 --- a/model_prices_and_context_window.json +++ b/model_prices_and_context_window.json @@ -1479,6 +1479,70 @@ "supports_system_messages": true, "supports_tool_choice": true }, + "gpt-realtime": { + "max_tokens": 4096, + "max_input_tokens": 32000, + "max_output_tokens": 4096, + "input_cost_per_token": 4e-06, + "cache_read_input_token_cost": 0.4e-06, + "output_cost_per_token": 16e-06, + "input_cost_per_audio_token": 32e-06, + "output_cost_per_audio_token": 64e-06, + "cache_creation_input_audio_token_cost": 0.4e-06, + "input_cost_per_image": 5e-06, + "litellm_provider": "openai", + "mode": "chat", + "supports_function_calling": true, + "supports_parallel_function_calling": true, + "supports_audio_input": true, + "supports_audio_output": true, + "supports_system_messages": true, + "supports_tool_choice": true, + "supported_endpoints": [ + "/v1/realtime" + ], + "supported_modalities": [ + "text", + "image", + "audio" + ], + "supported_output_modalities": [ + "text", + "audio" + ] + }, + "gpt-realtime-2025-08-28": { + "max_tokens": 4096, + "max_input_tokens": 32000, + "max_output_tokens": 4096, + "input_cost_per_token": 4e-06, + "cache_read_input_token_cost": 0.4e-06, + "output_cost_per_token": 16e-06, + "input_cost_per_audio_token": 32e-06, + "output_cost_per_audio_token": 64e-06, + "cache_creation_input_audio_token_cost": 0.4e-06, + "input_cost_per_image": 5e-06, + "litellm_provider": "openai", + "mode": "chat", + "supports_function_calling": true, + "supports_parallel_function_calling": true, + "supports_audio_input": true, + "supports_audio_output": true, + "supports_system_messages": true, + "supports_tool_choice": true, + "supported_endpoints": [ + "/v1/realtime" + ], + "supported_modalities": [ + "text", + "image", + "audio" + ], + "supported_output_modalities": [ + "text", + "audio" + ] + }, "gpt-4o-realtime-preview-2024-10-01": { "max_tokens": 4096, "max_input_tokens": 128000,