fix: clamp max_output_tokens to OpenAI min of 16 in anthropic-to-responses adapter

This commit is contained in:
Sipan Petrosyan 2026-04-29 08:23:45 +01:00
parent 6e6b2ca2d8
commit 7fec1b58ea

View file

@ -333,8 +333,10 @@ class LiteLLMAnthropicToResponsesAPIAdapter:
responses_kwargs["instructions"] = "\n".join(filter(None, text_parts))
# max_tokens -> max_output_tokens
# OpenAI Responses API requires max_output_tokens >= 16
max_tokens = anthropic_request.get("max_tokens")
if max_tokens:
max_tokens = max(max_tokens, 16)
responses_kwargs["max_output_tokens"] = max_tokens
# temperature / top_p passed through