硬性契约:删除代码中一切写死的上下文窗口与最大输出上限(含六家模型元信息
钳制与全部兜底值)——唯一合法来源是设置面板「上下文长度」(llm.contextWindow)
与「最大输出上限」(llm.maxTokens),跨 Provider/模型原样透传。
P0 正确性收口:
- 迁移 11/12(SCHEMA_VERSION 5):记忆表 embedding 列 + 分 Provider 窗口键清理
- 记忆生命周期接线:会话终态清理 working memory / episodic 90 天 TTL / access_count 回写
- 回放缓冲模块化 + 会话终态清理(杜绝 4MB/会话内存滞留)
- i18n 收口:主进程 main-locale(zh/en,ui.locale 热切换)+ 渲染层 17 处出层
P1 能力演进:
- 本地向量混合检索:0.6×向量余弦 + 0.4×TF-IDF,Ollama embeddings 首次投产,
存量记忆惰性回填,嵌入不可用自动回退 TF-IDF
- MEMORY.md 维护闭环:固化去重消除截断盲区;两阶段维护(AI 建议 → 用户确认 →
原子改写 + 语义记忆双轨同步 + 审计);>50KB 告警
- 可观测闭环:cacheTokens 引擎→前端透传(Token 面板命中率/成本行)+ 输入框
上下文占用指示条
- MCP Prompts/Resources 对话可用:/mcp:{server}:{prompt} 与 @mcp:{server}:{uri}
P2 体验补全:
- 工具自定义策略(正则白/黑名单 + 频率 + 强制确认,热生效)
- 连续 ≥3 同类工具确认聚合为单弹框
- 会话消息游标分页(首屏 200 条向上翻页)
- 开机自启;Playwright + Electron E2E 冒烟(本地 mock LLM 零外联)
Review 回归修复:MCP 大小写失配 / 分页状态复位 / 清空=未配置语义(Number(null)=0
隐患)/ MEMORY.md 告警位置 / working_memories FK(迁移 13)/ 全局配置层废键清理;
附带根治权限加固启动时序、代理回环放行、safeStorage 降级、悬空 symlink 逃逸。
验证:typecheck/lint 0 问题;test:electron 2478/2478(0 跳过);E2E 2/2;
docs/v0.8.1-迭代实施清单.md 全项留档。
235 lines
7.8 KiB
TypeScript
235 lines
7.8 KiB
TypeScript
/**
|
||
* maxTokens 透传契约测试(v0.8.1 硬性契约重写)
|
||
*
|
||
* 背景:v0.5.3 曾引入"按 MODEL_INFO.maxOutputTokens 钳制"逻辑。v0.8.1 按硬性
|
||
* 契约废除 —— 设置面板「最大输出上限」(llm.maxTokens)是唯一合法的输出上限
|
||
* 配置,adapter 对一切 Provider/模型**原样透传** `params.maxTokens`,代码中
|
||
* 不存在任何写死的输出上限或按模型元信息的钳制行为。
|
||
*
|
||
* 测试策略(v0.5.2 教训):mock fetch 记录真实请求体并断言契约 ——
|
||
* 不 mock adapter 内部方法,验证"发出的 HTTP 请求体"这个最终事实。
|
||
*/
|
||
|
||
import { describe, it, expect, vi, beforeEach, afterEach } from 'vitest';
|
||
|
||
vi.mock('electron-log', () => ({
|
||
default: { info: vi.fn(), warn: vi.fn(), error: vi.fn(), debug: vi.fn() },
|
||
}));
|
||
|
||
import { DeepSeekAdapter } from '../deepseek.adapter';
|
||
import { AgnesAdapter } from '../agnes-ai.adapter';
|
||
import { MimoAdapter } from '../mimo.adapter';
|
||
import { OpenAIAdapter } from '../openai.adapter';
|
||
import { AnthropicAdapter } from '../anthropic.adapter';
|
||
import type { MetonaRequest } from '../../types';
|
||
|
||
const mockFetch = vi.fn();
|
||
vi.stubGlobal('fetch', mockFetch);
|
||
|
||
beforeEach(() => {
|
||
mockFetch.mockReset();
|
||
});
|
||
afterEach(() => {
|
||
mockFetch.mockReset();
|
||
});
|
||
|
||
/** 设置面板「最大输出上限」配置生效时的请求形态(llm.maxTokens → params.maxTokens) */
|
||
function makeRequest(overrides: Partial<MetonaRequest> = {}): MetonaRequest {
|
||
return {
|
||
meta: {
|
||
sessionId: 's',
|
||
iteration: 1,
|
||
requestId: 'r',
|
||
timestamp: Date.now(),
|
||
agentVersion: '1',
|
||
},
|
||
systemPrompt: { roleDefinition: '', outputConstraints: '', safetyGuidelines: '' },
|
||
messages: [{ role: 'user', content: 'hi', timestamp: Date.now() }],
|
||
params: {
|
||
maxTokens: 63_488,
|
||
temperature: 0,
|
||
stream: false,
|
||
thinkingEnabled: false,
|
||
},
|
||
...overrides,
|
||
};
|
||
}
|
||
|
||
/** OpenAI 兼容系成功响应 */
|
||
function openAIResponse(): Response {
|
||
return {
|
||
ok: true,
|
||
status: 200,
|
||
json: async () => ({ choices: [{ message: { content: 'ok' } }], usage: {} }),
|
||
} as unknown as Response;
|
||
}
|
||
|
||
/** Anthropic 成功响应 */
|
||
function anthropicResponse(): Response {
|
||
return {
|
||
ok: true,
|
||
status: 200,
|
||
json: async () => ({ content: [{ type: 'text', text: 'ok' }], usage: {} }),
|
||
} as unknown as Response;
|
||
}
|
||
|
||
/** 取 mock fetch 收到的请求体 */
|
||
function requestBody(): Record<string, unknown> {
|
||
const [, init] = mockFetch.mock.calls[0] as [string, RequestInit];
|
||
return JSON.parse(init.body as string) as Record<string, unknown>;
|
||
}
|
||
|
||
describe('maxTokens 原样透传(v0.8.1:设置面板是唯一合法上限配置)', () => {
|
||
it('DeepSeek:max_tokens 原样透传(不按模型钳制)', async () => {
|
||
mockFetch.mockResolvedValue(openAIResponse());
|
||
const adapter = new DeepSeekAdapter({
|
||
provider: 'deepseek',
|
||
baseURL: 'https://api.deepseek.com',
|
||
apiKey: 'sk',
|
||
defaultModel: 'deepseek-v4-pro',
|
||
});
|
||
await adapter.send(makeRequest());
|
||
expect(requestBody().max_tokens).toBe(63_488);
|
||
});
|
||
|
||
it('DeepSeek:超出旧模型元信息上限的值同样原样透传(钳制已废除)', async () => {
|
||
mockFetch.mockResolvedValue(openAIResponse());
|
||
const adapter = new DeepSeekAdapter({
|
||
provider: 'deepseek',
|
||
baseURL: 'https://api.deepseek.com',
|
||
apiKey: 'sk',
|
||
defaultModel: 'deepseek-v4-flash-vision-exp',
|
||
});
|
||
await adapter.send(makeRequest());
|
||
expect(requestBody().max_tokens).toBe(63_488);
|
||
});
|
||
|
||
it('Agnes:max_tokens 原样透传', async () => {
|
||
mockFetch.mockResolvedValue(openAIResponse());
|
||
const adapter = new AgnesAdapter({
|
||
provider: 'agnes',
|
||
baseURL: 'https://api.agnes.com/v1',
|
||
apiKey: 'k',
|
||
defaultModel: 'agnes-2.0-flash',
|
||
});
|
||
await adapter.send(makeRequest());
|
||
expect(requestBody().max_tokens).toBe(63_488);
|
||
});
|
||
|
||
it('MiMo standard:max_completion_tokens 原样透传(旧 32768 钳制已废除)', async () => {
|
||
mockFetch.mockResolvedValue(openAIResponse());
|
||
const adapter = new MimoAdapter({
|
||
provider: 'mimo',
|
||
baseURL: 'https://api.mimo.com/v1',
|
||
apiKey: 'k',
|
||
defaultModel: 'mimo-v2.5',
|
||
});
|
||
await adapter.send(makeRequest());
|
||
expect(requestBody().max_completion_tokens).toBe(63_488);
|
||
});
|
||
|
||
it('MiMo pro:max_completion_tokens 原样透传', async () => {
|
||
mockFetch.mockResolvedValue(openAIResponse());
|
||
const adapter = new MimoAdapter({
|
||
provider: 'mimo',
|
||
baseURL: 'https://api.mimo.com/v1',
|
||
apiKey: 'k',
|
||
defaultModel: 'mimo-v2.5-pro',
|
||
});
|
||
await adapter.send(makeRequest());
|
||
expect(requestBody().max_completion_tokens).toBe(63_488);
|
||
});
|
||
|
||
it('OpenAI gpt-4o(非推理模型):max_tokens 原样透传(旧 16384 钳制已废除)', async () => {
|
||
mockFetch.mockResolvedValue(openAIResponse());
|
||
const adapter = new OpenAIAdapter({
|
||
provider: 'openai',
|
||
baseURL: 'https://api.openai.com/v1',
|
||
apiKey: 'k',
|
||
defaultModel: 'gpt-4o',
|
||
});
|
||
await adapter.send(makeRequest());
|
||
expect(requestBody().max_tokens).toBe(63_488);
|
||
});
|
||
|
||
it('OpenAI o3-mini(推理模型):max_completion_tokens 原样透传,字段名路由正确', async () => {
|
||
mockFetch.mockResolvedValue(openAIResponse());
|
||
const adapter = new OpenAIAdapter({
|
||
provider: 'openai',
|
||
baseURL: 'https://api.openai.com/v1',
|
||
apiKey: 'k',
|
||
defaultModel: 'o3-mini',
|
||
});
|
||
await adapter.send(makeRequest());
|
||
expect(requestBody().max_completion_tokens).toBe(63_488);
|
||
expect(requestBody().max_tokens).toBeUndefined();
|
||
});
|
||
|
||
it('Anthropic opus:max_tokens 原样透传(旧 32000 钳制已废除)', async () => {
|
||
mockFetch.mockResolvedValue(anthropicResponse());
|
||
const adapter = new AnthropicAdapter({
|
||
provider: 'anthropic',
|
||
baseURL: 'https://api.anthropic.com',
|
||
apiKey: 'k',
|
||
defaultModel: 'claude-opus-4-1',
|
||
});
|
||
await adapter.send(makeRequest());
|
||
expect(requestBody().max_tokens).toBe(63_488);
|
||
});
|
||
|
||
it('Anthropic sonnet:max_tokens 原样透传', async () => {
|
||
mockFetch.mockResolvedValue(anthropicResponse());
|
||
const adapter = new AnthropicAdapter({
|
||
provider: 'anthropic',
|
||
baseURL: 'https://api.anthropic.com',
|
||
apiKey: 'k',
|
||
defaultModel: 'claude-sonnet-4-5',
|
||
});
|
||
await adapter.send(makeRequest());
|
||
expect(requestBody().max_tokens).toBe(63_488);
|
||
});
|
||
|
||
it('未配置 maxTokens:不下发任何输出上限字段(由 Provider 服务端默认值决定)', async () => {
|
||
mockFetch.mockResolvedValue(openAIResponse());
|
||
const request = makeRequest({
|
||
params: { temperature: 0, stream: false } as MetonaRequest['params'],
|
||
});
|
||
|
||
const mimo = new MimoAdapter({
|
||
provider: 'mimo',
|
||
baseURL: 'https://api.mimo.com/v1',
|
||
apiKey: 'k',
|
||
defaultModel: 'mimo-v2.5',
|
||
});
|
||
await mimo.send(request);
|
||
expect(requestBody().max_completion_tokens).toBeUndefined();
|
||
|
||
const deepseek = new DeepSeekAdapter({
|
||
provider: 'deepseek',
|
||
baseURL: 'https://api.deepseek.com',
|
||
apiKey: 'sk',
|
||
defaultModel: 'deepseek-v4-pro',
|
||
});
|
||
mockFetch.mockReset();
|
||
mockFetch.mockResolvedValue(openAIResponse());
|
||
await deepseek.send(request);
|
||
expect(requestBody().max_tokens).toBeUndefined();
|
||
});
|
||
|
||
it('Anthropic 未配置 maxTokens + thinking 开启:仅满足协议下限 2048(协议不变量,非上限)', async () => {
|
||
mockFetch.mockResolvedValue(anthropicResponse());
|
||
const adapter = new AnthropicAdapter({
|
||
provider: 'anthropic',
|
||
baseURL: 'https://api.anthropic.com',
|
||
apiKey: 'k',
|
||
defaultModel: 'claude-opus-4-1',
|
||
});
|
||
await adapter.send(
|
||
makeRequest({
|
||
params: { temperature: 0, stream: false, thinkingEnabled: true } as MetonaRequest['params'],
|
||
}),
|
||
);
|
||
expect(requestBody().max_tokens).toBe(2048);
|
||
});
|
||
});
|