diff --git a/litellm/llms/openai_like/providers.json b/litellm/llms/openai_like/providers.json index fe10293c420..ea000b381f5 100644 --- a/litellm/llms/openai_like/providers.json +++ b/litellm/llms/openai_like/providers.json @@ -200,5 +200,12 @@ "temperature_max": 1.99 }, "supported_endpoints": ["/v1/chat/completions"] + }, + "sagg": { + "base_url": "https://api.privatedeskai.com/v1", + "api_key_env": "SAGG_API_KEY", + "param_mappings": { + "max_completion_tokens": "max_tokens" + } } } diff --git a/litellm/types/utils.py b/litellm/types/utils.py index dfc98a9d89d..fc2fcb17f15 100644 --- a/litellm/types/utils.py +++ b/litellm/types/utils.py @@ -4297,6 +4297,7 @@ class LlmProviders(str, Enum): COGNITION = "cognition" SCX_AI = "scx-ai" DARKBLOOM = "darkbloom" + SAGG = "sagg" META = "meta" LITELLM_AGENT = "litellm_agent" CURSOR = "cursor" diff --git a/provider_endpoints_support.json b/provider_endpoints_support.json index b8d1621cde3..08d4569dcbc 100644 --- a/provider_endpoints_support.json +++ b/provider_endpoints_support.json @@ -2246,6 +2246,22 @@ "interactions": true } }, + "sagg": { + "display_name": "SAGG (`sagg`)", + "url": "https://docs.litellm.ai/docs/providers/sagg", + "endpoints": { + "chat_completions": true, + "messages": false, + "responses": false, + "embeddings": false, + "image_generations": false, + "audio_transcriptions": false, + "audio_speech": false, + "moderations": false, + "batches": false, + "rerank": false + } + }, "searxng": { "display_name": "SearXNG (`searxng`)", "url": "https://docs.litellm.ai/docs/search/searxng", diff --git a/tests/test_litellm/llms/openai_like/test_sagg_provider.py b/tests/test_litellm/llms/openai_like/test_sagg_provider.py new file mode 100644 index 00000000000..da76601da56 --- /dev/null +++ b/tests/test_litellm/llms/openai_like/test_sagg_provider.py @@ -0,0 +1,86 @@ +""" +Tests for SAGG provider configuration and integration. + +SAGG (https://api.privatedeskai.com) is an OpenAI-compatible LLM +inference gateway with automatic multi-provider failover. +""" + +import litellm + + +class TestSaggProviderConfig: + def test_sagg_in_provider_list(self): + from litellm import LlmProviders + + assert hasattr(LlmProviders, "SAGG") + assert LlmProviders.SAGG.value == "sagg" + assert "sagg" in litellm.provider_list + + def test_sagg_json_config_exists(self): + from litellm.llms.openai_like.json_loader import JSONProviderRegistry + + assert JSONProviderRegistry.exists("sagg") + + sagg = JSONProviderRegistry.get("sagg") + assert sagg is not None + assert sagg.base_url == "https://api.privatedeskai.com/v1" + assert sagg.api_key_env == "SAGG_API_KEY" + assert sagg.param_mappings.get("max_completion_tokens") == "max_tokens" + + def test_sagg_provider_resolution(self): + """The real model id contains its own slash + (deepseek-ai/DeepSeek-V4-Flash-0731), so this also confirms + provider-prefix splitting only splits on the FIRST slash, same + as e.g. pinstripes/ps/glm-4.5-air elsewhere in this registry.""" + from litellm.litellm_core_utils.get_llm_provider_logic import get_llm_provider + + model, provider, api_key, api_base = get_llm_provider( + model="sagg/deepseek-ai/DeepSeek-V4-Flash-0731", + custom_llm_provider=None, + api_base=None, + api_key=None, + ) + + assert model == "deepseek-ai/DeepSeek-V4-Flash-0731" + assert provider == "sagg" + assert api_base == "https://api.privatedeskai.com/v1" + + def test_sagg_router_config(self): + from litellm import Router + + router = Router( + model_list=[ + { + "model_name": "sagg-deepseek", + "litellm_params": { + "model": "sagg/deepseek-ai/DeepSeek-V4-Flash-0731", + "api_key": "test-key", + }, + } + ] + ) + + assert len(router.model_list) == 1 + assert router.model_list[0]["model_name"] == "sagg-deepseek" + + def test_sagg_parameter_mapping(self): + """SAGG's own request parser only recognizes max_tokens, so a + caller sending max_completion_tokens needs this mapping to + actually take effect server-side rather than being dropped.""" + from litellm.llms.openai_like.dynamic_config import create_config_class + from litellm.llms.openai_like.json_loader import JSONProviderRegistry + + provider = JSONProviderRegistry.get("sagg") + config_class = create_config_class(provider) + config = config_class() + + optional_params = {} + non_default_params = {"max_completion_tokens": 100, "temperature": 0.7} + result = config.map_openai_params( + non_default_params, optional_params, "deepseek-ai/DeepSeek-V4-Flash-0731", False + ) + + assert "max_tokens" in result + assert result["max_tokens"] == 100 + assert "max_completion_tokens" not in result + assert result["temperature"] == 0.7