From 63cecf8b22b91b0d2b3e78277eda9e424768d394 Mon Sep 17 00:00:00 2001 From: Matt Rubens Date: Mon, 3 Mar 2025 09:37:55 -0500 Subject: [PATCH] Support 128k max tokens for openrouter thinking --- src/api/providers/__tests__/openrouter.test.ts | 2 +- src/api/providers/openrouter.ts | 2 +- 2 files changed, 2 insertions(+), 2 deletions(-) diff --git a/src/api/providers/__tests__/openrouter.test.ts b/src/api/providers/__tests__/openrouter.test.ts index 892c138172..981c9ad096 100644 --- a/src/api/providers/__tests__/openrouter.test.ts +++ b/src/api/providers/__tests__/openrouter.test.ts @@ -72,7 +72,7 @@ describe("OpenRouterHandler", () => { openRouterModelId: "test-model", openRouterModelInfo: { ...mockOpenRouterModelInfo, - maxTokens: 64_000, + maxTokens: 128_000, thinking: true, }, modelMaxTokens: 32_768, diff --git a/src/api/providers/openrouter.ts b/src/api/providers/openrouter.ts index 0bf98ba18e..db5c094d02 100644 --- a/src/api/providers/openrouter.ts +++ b/src/api/providers/openrouter.ts @@ -263,7 +263,7 @@ export async function getOpenRouterModels() { modelInfo.supportsPromptCache = true modelInfo.cacheWritesPrice = 3.75 modelInfo.cacheReadsPrice = 0.3 - modelInfo.maxTokens = rawModel.id === "anthropic/claude-3.7-sonnet:thinking" ? 64_000 : 16_384 + modelInfo.maxTokens = rawModel.id === "anthropic/claude-3.7-sonnet:thinking" ? 128_000 : 16_384 break case rawModel.id.startsWith("anthropic/claude-3.5-sonnet-20240620"): modelInfo.supportsPromptCache = true