From 655270bf7817ee8fb6ffa976e54dc30f564f50eb Mon Sep 17 00:00:00 2001 From: Jaakko Husso Date: Fri, 21 Aug 2026 08:11:56 +0000 Subject: [PATCH] fix(core): Raise AI Assistant model verification token limit (#36787) Co-authored-by: Claude Opus 5 (1M context) --- .../__tests__/instance-ai-verification.service.test.ts | 3 ++- .../instance-ai/instance-ai-verification.service.ts | 8 +++++++- 2 files changed, 9 insertions(+), 2 deletions(-) diff --git a/packages/cli/src/modules/instance-ai/__tests__/instance-ai-verification.service.test.ts b/packages/cli/src/modules/instance-ai/__tests__/instance-ai-verification.service.test.ts index 387724e4dcb..47349cccf0e 100644 --- a/packages/cli/src/modules/instance-ai/__tests__/instance-ai-verification.service.test.ts +++ b/packages/cli/src/modules/instance-ai/__tests__/instance-ai-verification.service.test.ts @@ -105,7 +105,8 @@ describe('InstanceAiVerificationService', () => { ); expect(createModelMock).toHaveBeenCalledWith(modelConfig, expect.any(Function)); expect(generateTextMock).toHaveBeenCalledWith( - expect.objectContaining({ prompt: 'Reply with OK.', maxOutputTokens: 8 }), + // OpenAI's Responses API rejects max_output_tokens below 16. + expect.objectContaining({ prompt: 'Reply with OK.', maxOutputTokens: 16 }), ); }); diff --git a/packages/cli/src/modules/instance-ai/instance-ai-verification.service.ts b/packages/cli/src/modules/instance-ai/instance-ai-verification.service.ts index cb46f2d6ebd..7eec026933d 100644 --- a/packages/cli/src/modules/instance-ai/instance-ai-verification.service.ts +++ b/packages/cli/src/modules/instance-ai/instance-ai-verification.service.ts @@ -26,6 +26,12 @@ const VERIFICATION_TIMEOUT_MS = 30_000; const MAX_ERROR_MESSAGE_LENGTH = 512; +/** + * The probe only needs the call to succeed, not its text, but OpenAI's + * Responses API rejects `max_output_tokens` below 16. + */ +const VERIFICATION_MAX_OUTPUT_TOKENS = 16; + /** * Providers can echo credentials back in error messages. Scrub known secret * shapes (API keys, bearer tokens, key=value pairs), drop URL query strings @@ -135,7 +141,7 @@ export class InstanceAiVerificationService { await generateText({ model: createModel(modelConfig, createAiProxyFetch(this.outboundHttp)), prompt: 'Reply with OK.', - maxOutputTokens: 8, + maxOutputTokens: VERIFICATION_MAX_OUTPUT_TOKENS, abortSignal: AbortSignal.timeout(VERIFICATION_TIMEOUT_MS), }); return { ok: true, latencyMs: Math.round(performance.now() - startedAt) };