mirror of
https://github.com/BerriAI/litellm.git
synced 2026-09-21 00:21:49 +00:00
test: read cost expectations from the catalog row the code bills against
Co-Authored-By: Devin AI <158243242+devin-ai-integration[bot]@users.noreply.github.com>
This commit is contained in:
parent
e8f098f38e
commit
eb2be3758a
2 changed files with 5 additions and 4 deletions
|
|
@ -465,9 +465,10 @@ class TestParallelAISearch:
|
|||
max_results=max_results,
|
||||
)
|
||||
|
||||
rate: Final = litellm.model_cost[
|
||||
"parallel_ai/search-fast" if mode in ("fast", "turbo") else "parallel_ai/search"
|
||||
]["input_cost_per_query"]
|
||||
pricing_model: Final = {"fast": "parallel_ai/search-fast", "turbo": "parallel_ai/search-turbo"}.get(
|
||||
mode, "parallel_ai/search"
|
||||
)
|
||||
rate: Final = litellm.model_cost[pricing_model]["input_cost_per_query"]
|
||||
request_count: Final = (
|
||||
sum(item["count"] for item in usage if item["name"] == "sku_search") if usage is not None else 1
|
||||
)
|
||||
|
|
|
|||
|
|
@ -1346,7 +1346,7 @@ def test_gemini_25_implicit_caching_cost():
|
|||
model="gemini/gemini-2.5-flash",
|
||||
)
|
||||
|
||||
model_info: Final = litellm.model_cost["gemini-2.5-flash"]
|
||||
model_info: Final = litellm.model_cost["gemini/gemini-2.5-flash"]
|
||||
expected_cost = (
|
||||
14316 * model_info["cache_read_input_token_cost"]
|
||||
+ (15033 - 14316) * model_info["input_cost_per_token"]
|
||||
|
|
|
|||
Loading…
Add table
Reference in a new issue