diff --git a/docs/my-website/docs/providers/openai.md b/docs/my-website/docs/providers/openai.md
index 1f4a1687e8b..ce03642747c 100644
--- a/docs/my-website/docs/providers/openai.md
+++ b/docs/my-website/docs/providers/openai.md
@@ -434,7 +434,56 @@ curl -X POST 'http://0.0.0.0:4000/chat/completions' \
## Getting Reasoning Content in `/chat/completions`
-GPT-5 models return reasoning content when called via the Responses API. You can call these models via the `/chat/completions` endpoint by using the `openai/responses/` prefix.
+GPT-5 models return reasoning content when called via the Responses API. You can call these models via the `/chat/completions` endpoint in two ways:
+
+**Option A — per-request prefix:** Use the `openai/responses/` model prefix.
+
+**Option B — global flag (recommended):** Set `route_all_chat_openai_to_responses = True` to automatically route all OpenAI `/chat/completions` requests through the Responses API, no model prefix needed.
+
+
+
+
+```python
+import litellm
+
+litellm.route_all_chat_openai_to_responses = True
+
+response = litellm.completion(
+ model="gpt-5.4",
+ messages=[{"role": "user", "content": "What is the capital of France?"}],
+ reasoning_effort="low",
+)
+```
+
+
+
+
+Set in your proxy config:
+```yaml
+litellm_settings:
+ route_all_chat_openai_to_responses: true
+```
+
+Then call normally — no model prefix needed:
+```bash
+curl -X POST 'http://0.0.0.0:4000/chat/completions' \
+-H 'Content-Type: application/json' \
+-H 'Authorization: Bearer sk-1234' \
+-d '{
+ "model": "gpt-5.4",
+ "messages": [{"role": "user", "content": "What is the capital of France?"}],
+ "reasoning_effort": "low"
+}'
+```
+
+
+
+
+:::note
+`route_all_chat_openai_to_responses` only applies to the `openai` provider. Azure OpenAI is unaffected. You can also set it via env var: `LITELLM_ROUTE_ALL_CHAT_OPENAI_TO_RESPONSES=true`.
+:::
+
+**Option A — per-request prefix:** You can also prefix individual model names with `openai/responses/` to route just that call through the Responses API.
diff --git a/docs/my-website/docs/providers/openai/responses_api.md b/docs/my-website/docs/providers/openai/responses_api.md
index 31f21ba52a7..0d6b9013ac8 100644
--- a/docs/my-website/docs/providers/openai/responses_api.md
+++ b/docs/my-website/docs/providers/openai/responses_api.md
@@ -923,45 +923,6 @@ curl http://localhost:4000/v1/chat/completions \
-### Route all OpenAI chat completions through the Responses API (recommended)
-
-Instead of prefixing each model with `openai/responses/`, you can enable a global flag to automatically route **all** `/chat/completions` requests for OpenAI models through the Responses API bridge. This is the recommended approach for OpenAI models.
-
-
-
-
-```python showLineNumbers title="Global flag - route all OpenAI completions via Responses API"
-import litellm
-
-litellm.route_all_chat_openai_to_responses = True
-
-response = litellm.completion(
- model="gpt-4o",
- messages=[{"role": "user", "content": "Hello!"}],
-)
-```
-
-
-
-
-```yaml showLineNumbers title="proxy_config.yaml"
-litellm_settings:
- route_all_chat_openai_to_responses: true
-```
-
-Or set via environment variable:
-
-```bash
-LITELLM_ROUTE_ALL_CHAT_OPENAI_TO_RESPONSES=true
-```
-
-
-
-
-:::note
-This flag only applies to the `openai` provider. Azure OpenAI and other providers are unaffected.
-:::
-
## Free-form Function Calling