fix(provider): correct AIPG output limits

This commit is contained in:
halfaipg 2026-08-28 23:48:16 -04:00
parent c8a4ccaffb
commit 62ab9e5a5d
3 changed files with 18 additions and 10 deletions

View file

@ -54601,7 +54601,8 @@
"input_cost_per_token": 7.5e-08,
"litellm_provider": "aipg",
"max_input_tokens": 60000,
"max_tokens": 60000,
"max_output_tokens": 32768,
"max_tokens": 32768,
"mode": "chat",
"output_cost_per_token": 3e-07,
"source": "https://docs.aipowergrid.io/streaming-api",
@ -54614,7 +54615,8 @@
"input_cost_per_token": 7e-08,
"litellm_provider": "aipg",
"max_input_tokens": 262144,
"max_tokens": 262144,
"max_output_tokens": 32768,
"max_tokens": 32768,
"mode": "chat",
"output_cost_per_token": 1.4e-07,
"source": "https://docs.aipowergrid.io/streaming-api",
@ -54627,7 +54629,8 @@
"input_cost_per_token": 5e-09,
"litellm_provider": "aipg",
"max_input_tokens": 2048,
"max_tokens": 2048,
"max_output_tokens": 1024,
"max_tokens": 1024,
"mode": "chat",
"output_cost_per_token": 1e-08,
"source": "https://docs.aipowergrid.io/streaming-api",

View file

@ -54601,7 +54601,8 @@
"input_cost_per_token": 7.5e-08,
"litellm_provider": "aipg",
"max_input_tokens": 60000,
"max_tokens": 60000,
"max_output_tokens": 32768,
"max_tokens": 32768,
"mode": "chat",
"output_cost_per_token": 3e-07,
"source": "https://docs.aipowergrid.io/streaming-api",
@ -54614,7 +54615,8 @@
"input_cost_per_token": 7e-08,
"litellm_provider": "aipg",
"max_input_tokens": 262144,
"max_tokens": 262144,
"max_output_tokens": 32768,
"max_tokens": 32768,
"mode": "chat",
"output_cost_per_token": 1.4e-07,
"source": "https://docs.aipowergrid.io/streaming-api",
@ -54627,7 +54629,8 @@
"input_cost_per_token": 5e-09,
"litellm_provider": "aipg",
"max_input_tokens": 2048,
"max_tokens": 2048,
"max_output_tokens": 1024,
"max_tokens": 1024,
"mode": "chat",
"output_cost_per_token": 1e-08,
"source": "https://docs.aipowergrid.io/streaming-api",

View file

@ -70,14 +70,16 @@ def test_get_llm_provider_aipg():
def test_aipg_model_metadata():
model_cost = litellm.get_model_cost_map(url="")
expected = {
"aipg/gpt-oss-120b": (60000, 7.5e-08, 3e-07),
"aipg/deepseek-v4-flash-nvfp4": (262144, 7e-08, 1.4e-07),
"aipg/Smollm-135m": (2048, 5e-09, 1e-08),
"aipg/gpt-oss-120b": (60000, 32768, 7.5e-08, 3e-07),
"aipg/deepseek-v4-flash-nvfp4": (262144, 32768, 7e-08, 1.4e-07),
"aipg/Smollm-135m": (2048, 1024, 5e-09, 1e-08),
}
for model, (context, input_cost, output_cost) in expected.items():
for model, (context, output_limit, input_cost, output_cost) in expected.items():
info = model_cost[model]
assert info["litellm_provider"] == "aipg"
assert info["mode"] == "chat"
assert info["max_input_tokens"] == context
assert info["max_output_tokens"] == output_limit
assert info["max_tokens"] == output_limit
assert info["input_cost_per_token"] == input_cost
assert info["output_cost_per_token"] == output_cost