mirror of
https://github.com/BerriAI/litellm.git
synced 2026-09-29 01:42:19 +00:00
fix(provider): correct AIPG output limits
This commit is contained in:
parent
c8a4ccaffb
commit
62ab9e5a5d
3 changed files with 18 additions and 10 deletions
|
|
@ -54601,7 +54601,8 @@
|
|||
"input_cost_per_token": 7.5e-08,
|
||||
"litellm_provider": "aipg",
|
||||
"max_input_tokens": 60000,
|
||||
"max_tokens": 60000,
|
||||
"max_output_tokens": 32768,
|
||||
"max_tokens": 32768,
|
||||
"mode": "chat",
|
||||
"output_cost_per_token": 3e-07,
|
||||
"source": "https://docs.aipowergrid.io/streaming-api",
|
||||
|
|
@ -54614,7 +54615,8 @@
|
|||
"input_cost_per_token": 7e-08,
|
||||
"litellm_provider": "aipg",
|
||||
"max_input_tokens": 262144,
|
||||
"max_tokens": 262144,
|
||||
"max_output_tokens": 32768,
|
||||
"max_tokens": 32768,
|
||||
"mode": "chat",
|
||||
"output_cost_per_token": 1.4e-07,
|
||||
"source": "https://docs.aipowergrid.io/streaming-api",
|
||||
|
|
@ -54627,7 +54629,8 @@
|
|||
"input_cost_per_token": 5e-09,
|
||||
"litellm_provider": "aipg",
|
||||
"max_input_tokens": 2048,
|
||||
"max_tokens": 2048,
|
||||
"max_output_tokens": 1024,
|
||||
"max_tokens": 1024,
|
||||
"mode": "chat",
|
||||
"output_cost_per_token": 1e-08,
|
||||
"source": "https://docs.aipowergrid.io/streaming-api",
|
||||
|
|
|
|||
|
|
@ -54601,7 +54601,8 @@
|
|||
"input_cost_per_token": 7.5e-08,
|
||||
"litellm_provider": "aipg",
|
||||
"max_input_tokens": 60000,
|
||||
"max_tokens": 60000,
|
||||
"max_output_tokens": 32768,
|
||||
"max_tokens": 32768,
|
||||
"mode": "chat",
|
||||
"output_cost_per_token": 3e-07,
|
||||
"source": "https://docs.aipowergrid.io/streaming-api",
|
||||
|
|
@ -54614,7 +54615,8 @@
|
|||
"input_cost_per_token": 7e-08,
|
||||
"litellm_provider": "aipg",
|
||||
"max_input_tokens": 262144,
|
||||
"max_tokens": 262144,
|
||||
"max_output_tokens": 32768,
|
||||
"max_tokens": 32768,
|
||||
"mode": "chat",
|
||||
"output_cost_per_token": 1.4e-07,
|
||||
"source": "https://docs.aipowergrid.io/streaming-api",
|
||||
|
|
@ -54627,7 +54629,8 @@
|
|||
"input_cost_per_token": 5e-09,
|
||||
"litellm_provider": "aipg",
|
||||
"max_input_tokens": 2048,
|
||||
"max_tokens": 2048,
|
||||
"max_output_tokens": 1024,
|
||||
"max_tokens": 1024,
|
||||
"mode": "chat",
|
||||
"output_cost_per_token": 1e-08,
|
||||
"source": "https://docs.aipowergrid.io/streaming-api",
|
||||
|
|
|
|||
|
|
@ -70,14 +70,16 @@ def test_get_llm_provider_aipg():
|
|||
def test_aipg_model_metadata():
|
||||
model_cost = litellm.get_model_cost_map(url="")
|
||||
expected = {
|
||||
"aipg/gpt-oss-120b": (60000, 7.5e-08, 3e-07),
|
||||
"aipg/deepseek-v4-flash-nvfp4": (262144, 7e-08, 1.4e-07),
|
||||
"aipg/Smollm-135m": (2048, 5e-09, 1e-08),
|
||||
"aipg/gpt-oss-120b": (60000, 32768, 7.5e-08, 3e-07),
|
||||
"aipg/deepseek-v4-flash-nvfp4": (262144, 32768, 7e-08, 1.4e-07),
|
||||
"aipg/Smollm-135m": (2048, 1024, 5e-09, 1e-08),
|
||||
}
|
||||
for model, (context, input_cost, output_cost) in expected.items():
|
||||
for model, (context, output_limit, input_cost, output_cost) in expected.items():
|
||||
info = model_cost[model]
|
||||
assert info["litellm_provider"] == "aipg"
|
||||
assert info["mode"] == "chat"
|
||||
assert info["max_input_tokens"] == context
|
||||
assert info["max_output_tokens"] == output_limit
|
||||
assert info["max_tokens"] == output_limit
|
||||
assert info["input_cost_per_token"] == input_cost
|
||||
assert info["output_cost_per_token"] == output_cost
|
||||
|
|
|
|||
Loading…
Add table
Reference in a new issue