mirror of
https://github.com/BerriAI/litellm.git
synced 2026-10-06 02:48:13 +00:00
return actual status code - /count_tokens endpoint
This commit is contained in:
parent
c68383068a
commit
f70e39483c
2 changed files with 17 additions and 14 deletions
|
|
@ -144,13 +144,6 @@ class VertexAIPartnerModelsTokenCounter(VertexBase):
|
|||
timeout=30.0,
|
||||
)
|
||||
|
||||
# Check for errors
|
||||
if response.status_code != 200:
|
||||
error_text = response.text
|
||||
raise ValueError(
|
||||
f"Token counting request failed with status {response.status_code}: {error_text}"
|
||||
)
|
||||
|
||||
# Parse response
|
||||
result = response.json()
|
||||
|
||||
|
|
|
|||
|
|
@ -7743,13 +7743,23 @@ async def token_counter(request: TokenCountRequest, call_endpoint: bool = False)
|
|||
)
|
||||
is True
|
||||
):
|
||||
result = await provider_counter.count_tokens(
|
||||
model_to_use=model_to_use or "",
|
||||
messages=messages, # type: ignore
|
||||
contents=contents,
|
||||
deployment=deployment,
|
||||
request_model=request.model,
|
||||
)
|
||||
try:
|
||||
result = await provider_counter.count_tokens(
|
||||
model_to_use=model_to_use or "",
|
||||
messages=messages, # type: ignore
|
||||
contents=contents,
|
||||
deployment=deployment,
|
||||
request_model=request.model,
|
||||
)
|
||||
except httpx.HTTPStatusError as e:
|
||||
error_message = getattr(e, "message", None) or str(e)
|
||||
status_code = getattr(e, "status_code", None) or 500
|
||||
raise ProxyException(
|
||||
message=error_message,
|
||||
type="token_counting_error",
|
||||
param="model",
|
||||
code=status_code
|
||||
)
|
||||
#########################################################
|
||||
# Transfrom the Response to the well known format
|
||||
#########################################################
|
||||
|
|
|
|||
Loading…
Add table
Reference in a new issue