diff --git a/litellm/caching/qdrant_semantic_cache.py b/litellm/caching/qdrant_semantic_cache.py index a9f01a4c902..9206f326ecd 100644 --- a/litellm/caching/qdrant_semantic_cache.py +++ b/litellm/caching/qdrant_semantic_cache.py @@ -12,7 +12,7 @@ import ast import asyncio import json import os -from typing import Any, Optional, cast +from typing import Any, Dict, Optional, cast import litellm from litellm._logging import print_verbose @@ -135,6 +135,7 @@ class QdrantSemanticCache(BaseCache): ) self._ensure_cache_key_payload_index() else: + quantization_params: Dict[str, Any] if quantization_config is None or quantization_config == "binary": quantization_params = { "binary": {