From c0eda613c88b3f3476e291b69e480edb9dca6a7b Mon Sep 17 00:00:00 2001 From: roboomp Date: Sat, 8 Aug 2026 14:54:29 +0000 Subject: [PATCH] fix(catalog): kept qwen3.8 max preview on enable_thinking Restored the preview to its main compat so the reasoning_effort dialect is scoped to qwen3.8-max, leaving the preview ladder unchanged. --- packages/ai/test/openai-compat-policy.test.ts | 14 ++++++++++++++ packages/catalog/src/models.json | 3 +-- .../catalog/src/provider-models/openai-compat.ts | 5 ++++- 3 files changed, 19 insertions(+), 3 deletions(-) diff --git a/packages/ai/test/openai-compat-policy.test.ts b/packages/ai/test/openai-compat-policy.test.ts index 1efed7c0c..125b28974 100644 --- a/packages/ai/test/openai-compat-policy.test.ts +++ b/packages/ai/test/openai-compat-policy.test.ts @@ -175,4 +175,18 @@ describe("OpenAI compat policy", () => { expect(params.chat_template_kwargs).toBeUndefined(); } }); + + it("keeps Token Plan qwen3.8-max-preview on the enable_thinking dialect", () => { + // The preview rides Alibaba's binary enable_thinking toggle, not the + // OpenAI reasoning_effort control, so effort selections must not leak an + // unsupported reasoning_effort onto the wire. + const model = getBundledModel<"openai-completions">("alibaba-token-plan", "qwen3.8-max-preview"); + const params = chatParams(); + applyChatCompletionsCompatPolicy( + params, + resolveOpenAICompatPolicy(model, { endpoint: "chat-completions", reasoning: Effort.High }), + ); + expect(params.enable_thinking).toBe(true); + expect(params.reasoning_effort).toBeUndefined(); + }); }); diff --git a/packages/catalog/src/models.json b/packages/catalog/src/models.json index b60cb422a..faba365b7 100644 --- a/packages/catalog/src/models.json +++ b/packages/catalog/src/models.json @@ -8070,8 +8070,7 @@ }, "compat": { "supportsDeveloperRole": false, - "supportsReasoningEffort": true, - "thinkingFormat": "openai" + "supportsReasoningEffort": true } } }, diff --git a/packages/catalog/src/provider-models/openai-compat.ts b/packages/catalog/src/provider-models/openai-compat.ts index 26cdb52ed..6c0bb816c 100644 --- a/packages/catalog/src/provider-models/openai-compat.ts +++ b/packages/catalog/src/provider-models/openai-compat.ts @@ -2714,7 +2714,10 @@ export const ALIBABA_TOKEN_PLAN_STATIC_MODELS: readonly ModelSpec<"openai-comple efforts: [Effort.Low, Effort.High, Effort.XHigh], requiresEffort: true, }, - compat: ALIBABA_TOKEN_PLAN_QWEN_EFFORT_COMPAT, + compat: { + ...ALIBABA_TOKEN_PLAN_COMPAT, + supportsReasoningEffort: true, + }, }, { id: "qwen3.8-max",