diff --git a/litellm/llms/vertex_ai.py b/litellm/llms/vertex_ai.py index f124a088ed4..9db661c3012 100644 --- a/litellm/llms/vertex_ai.py +++ b/litellm/llms/vertex_ai.py @@ -144,11 +144,9 @@ def completion( encoding.encode(model_response["choices"][0]["message"].get("content", "")) ) - model_response["usage"] = { - "prompt_tokens": prompt_tokens, - "completion_tokens": completion_tokens, - "total_tokens": prompt_tokens + completion_tokens, - } + model_response.usage.completion_tokens = completion_tokens + model_response.usage.prompt_tokens = prompt_tokens + model_response.usage.total_tokens = prompt_tokens + completion_tokens return model_response