diff --git a/litellm/llms/gemini/realtime/transformation.py b/litellm/llms/gemini/realtime/transformation.py index 8a15008b66e..e1d9046a44f 100644 --- a/litellm/llms/gemini/realtime/transformation.py +++ b/litellm/llms/gemini/realtime/transformation.py @@ -1467,9 +1467,9 @@ class GeminiRealtimeConfig(BaseRealtimeConfig): "maxOutputTokens" ) if tool_call_max_output_tokens is not None: - tool_call_done_event["response"][ - "max_output_tokens" - ] = tool_call_max_output_tokens + tool_call_done_event["response"]["max_output_tokens"] = cast( + int, tool_call_max_output_tokens + ) returned_message.append(tool_call_done_event) # Reset IDs so the next model turn (after tool results) starts a # fresh response with its own response.created preamble.