feat: v0.8.1 记忆深化 · 观测闭环 · 体验收口 — 窗口/输出上限全局单一配置 · 2478 用例全量回归 + E2E 冒烟
硬性契约:删除代码中一切写死的上下文窗口与最大输出上限(含六家模型元信息
钳制与全部兜底值)——唯一合法来源是设置面板「上下文长度」(llm.contextWindow)
与「最大输出上限」(llm.maxTokens),跨 Provider/模型原样透传。
P0 正确性收口:
- 迁移 11/12(SCHEMA_VERSION 5):记忆表 embedding 列 + 分 Provider 窗口键清理
- 记忆生命周期接线:会话终态清理 working memory / episodic 90 天 TTL / access_count 回写
- 回放缓冲模块化 + 会话终态清理(杜绝 4MB/会话内存滞留)
- i18n 收口:主进程 main-locale(zh/en,ui.locale 热切换)+ 渲染层 17 处出层
P1 能力演进:
- 本地向量混合检索:0.6×向量余弦 + 0.4×TF-IDF,Ollama embeddings 首次投产,
存量记忆惰性回填,嵌入不可用自动回退 TF-IDF
- MEMORY.md 维护闭环:固化去重消除截断盲区;两阶段维护(AI 建议 → 用户确认 →
原子改写 + 语义记忆双轨同步 + 审计);>50KB 告警
- 可观测闭环:cacheTokens 引擎→前端透传(Token 面板命中率/成本行)+ 输入框
上下文占用指示条
- MCP Prompts/Resources 对话可用:/mcp:{server}:{prompt} 与 @mcp:{server}:{uri}
P2 体验补全:
- 工具自定义策略(正则白/黑名单 + 频率 + 强制确认,热生效)
- 连续 ≥3 同类工具确认聚合为单弹框
- 会话消息游标分页(首屏 200 条向上翻页)
- 开机自启;Playwright + Electron E2E 冒烟(本地 mock LLM 零外联)
Review 回归修复:MCP 大小写失配 / 分页状态复位 / 清空=未配置语义(Number(null)=0
隐患)/ MEMORY.md 告警位置 / working_memories FK(迁移 13)/ 全局配置层废键清理;
附带根治权限加固启动时序、代理回环放行、safeStorage 降级、悬空 symlink 逃逸。
验证:typecheck/lint 0 问题;test:electron 2478/2478(0 跳过);E2E 2/2;
docs/v0.8.1-迭代实施清单.md 全项留档。
This commit is contained in:
@@ -0,0 +1,97 @@
|
||||
/**
|
||||
* MetonaAI Desktop — E2E 冒烟测试(v0.8.1 P2-5)
|
||||
*
|
||||
* 端到端链路(Playwright + Electron):
|
||||
* 启动应用(隔离 userData)→ 跳过引导(种子配置)→ 新建会话 → 输入消息 →
|
||||
* 发送 → 引擎调用本地 mock LLM(SSE 流式)→ 断言回复渲染 + mock 收到合法
|
||||
* 请求体(携带「最大输出上限」设置值)→ 中断按钮恢复 idle。
|
||||
*
|
||||
* 契约:不触外网(LLM 指向 127.0.0.1 随机端口 mock)、不污染真实用户数据
|
||||
* (METONA_USER_DATA_DIR 重定向)、断言的配置值即设置面板合法配置项。
|
||||
*/
|
||||
|
||||
import { expect, test, type ElectronApplication, type Page } from '@playwright/test';
|
||||
import { _electron as electron } from 'playwright';
|
||||
import { mkdtempSync, rmSync, mkdirSync, writeFileSync } from 'fs';
|
||||
import { tmpdir } from 'os';
|
||||
import { join } from 'path';
|
||||
import { startMockLLM, MOCK_REPLY, type MockLLMHandle } from './mock-llm';
|
||||
|
||||
let electronApp: ElectronApplication;
|
||||
let page: Page;
|
||||
let mock: MockLLMHandle;
|
||||
let userDataDir: string;
|
||||
let workspaceDir: string;
|
||||
|
||||
test.beforeAll(async () => {
|
||||
// 1. 本地 mock Provider(随机端口,仅监听 127.0.0.1)
|
||||
mock = await startMockLLM();
|
||||
|
||||
// 2. 隔离的用户数据与工作空间目录
|
||||
userDataDir = mkdtempSync(join(tmpdir(), 'metona-e2e-user-'));
|
||||
workspaceDir = join(userDataDir, 'workspace');
|
||||
mkdirSync(workspaceDir, { recursive: true });
|
||||
// workspace-config.json 指向隔离工作空间(main.ts 启动时优先读取)
|
||||
writeFileSync(
|
||||
join(userDataDir, 'workspace-config.json'),
|
||||
JSON.stringify({ workspacePath: workspaceDir }),
|
||||
'utf-8',
|
||||
);
|
||||
|
||||
// 3. 启动 Electron(产物构建由 npm run test:e2e 的 build 步骤保证)
|
||||
electronApp = await electron.launch({
|
||||
args: ['.'],
|
||||
env: {
|
||||
...process.env,
|
||||
METONA_USER_DATA_DIR: userDataDir,
|
||||
METONA_E2E_SEED_CONFIG: '1',
|
||||
METONA_E2E_LLM_URL: mock.url,
|
||||
// 隔离冒烟环境无更新源(生产环境 updater 由 feedUrl 空值禁用,双保险)
|
||||
METONA_E2E_DISABLE_UPDATE: '1',
|
||||
} as Record<string, string>,
|
||||
});
|
||||
page = await electronApp.firstWindow();
|
||||
await page.waitForLoadState('domcontentloaded');
|
||||
});
|
||||
|
||||
test.afterAll(async () => {
|
||||
await electronApp?.close();
|
||||
await mock?.close();
|
||||
// 调试期保留 userData(main.log 排查用);稳定后恢复清理
|
||||
if (!process.env['METONA_E2E_KEEP_USER_DATA']) {
|
||||
try {
|
||||
rmSync(userDataDir, { recursive: true, force: true });
|
||||
} catch {
|
||||
/* Windows 文件句柄释放延迟 — 清理失败不影响断言 */
|
||||
}
|
||||
}
|
||||
});
|
||||
|
||||
test('冒烟:发送消息 → mock LLM 流式回复渲染到会话', async () => {
|
||||
// 等待聊天输入框可用(配置加载 + 工具就绪后启用)
|
||||
// InputBase 把 data-chat-input 挂在根 div —— 实际可编辑元素是内部 textarea
|
||||
//(MUI 另渲染一个 readonly 隐藏 textarea 用于测量,需用 .first() 取可交互的)
|
||||
const input = page.locator('[data-chat-input] textarea').first();
|
||||
await expect(input).toBeVisible({ timeout: 30_000 });
|
||||
|
||||
// 发送一条用户消息
|
||||
await input.click();
|
||||
await input.fill('你好,请做一个冒烟回复');
|
||||
await input.press('Enter');
|
||||
|
||||
// mock LLM 的流式回复出现在聊天区(引擎 → SSE → 渲染层全链路)
|
||||
await expect(page.getByText(MOCK_REPLY).first()).toBeVisible({ timeout: 30_000 });
|
||||
|
||||
// 用户消息持久化回显
|
||||
await expect(page.getByText('你好,请做一个冒烟回复').first()).toBeVisible();
|
||||
});
|
||||
|
||||
test('冒烟:引擎请求体携带设置面板「最大输出上限」配置(2048)', async () => {
|
||||
// beforeAll 后发送的第一条消息已在 mock.requests 中(顺序执行时上一测试已完成)
|
||||
const chatRequests = mock.requests.filter((r) => 'messages' in r);
|
||||
expect(chatRequests.length).toBeGreaterThanOrEqual(1);
|
||||
// llm.maxTokens 原样透传(无任何按模型钳制)
|
||||
expect(chatRequests[0].max_tokens).toBe(2048);
|
||||
// 请求发往本地 mock(经 adapter 组装),模型名来自种子配置
|
||||
expect(chatRequests[0].model).toBe('deepseek-v4-flash');
|
||||
});
|
||||
+101
@@ -0,0 +1,101 @@
|
||||
/**
|
||||
* Mock LLM Server — E2E 冒烟测试的本地 OpenAI 兼容 Provider(v0.8.1 P2-5)
|
||||
*
|
||||
* 实现 DeepSeek 适配器实际消费的最小协议面:
|
||||
* - POST {baseURL}/chat/completions(stream=true):按 SSE 推送一段固定文本 +
|
||||
* finish_reason=stop + usage + [DONE];
|
||||
* - POST /chat/completions(stream=false):非流式 JSON(压缩摘要等内部调用兜底)。
|
||||
*
|
||||
* 端口随机分配(127.0.0.1),测试结束关闭 —— 不触外网、不落真实会话数据。
|
||||
*/
|
||||
|
||||
import { createServer, type Server } from 'http';
|
||||
import type { AddressInfo } from 'net';
|
||||
|
||||
/** 流式回复的固定文本(断言锚点) */
|
||||
export const MOCK_REPLY = 'Hello from mock LLM. E2E smoke reply.';
|
||||
|
||||
export interface MockLLMHandle {
|
||||
url: string;
|
||||
close: () => Promise<void>;
|
||||
/** 收到的 chat/completions 请求体列表(断言用) */
|
||||
readonly requests: Array<Record<string, unknown>>;
|
||||
}
|
||||
|
||||
export function startMockLLM(): Promise<MockLLMHandle> {
|
||||
const requests: Array<Record<string, unknown>> = [];
|
||||
const server: Server = createServer((req, res) => {
|
||||
if (!req.url?.includes('/chat/completions')) {
|
||||
res.writeHead(404).end();
|
||||
return;
|
||||
}
|
||||
let body = '';
|
||||
req.on('data', (chunk) => {
|
||||
body += chunk;
|
||||
});
|
||||
req.on('end', () => {
|
||||
let parsed: Record<string, unknown> = {};
|
||||
try {
|
||||
parsed = JSON.parse(body) as Record<string, unknown>;
|
||||
} catch {
|
||||
/* 忽略解析失败 */
|
||||
}
|
||||
requests.push(parsed);
|
||||
|
||||
const isStream = parsed.stream === true;
|
||||
if (!isStream) {
|
||||
res.writeHead(200, { 'Content-Type': 'application/json' });
|
||||
res.end(
|
||||
JSON.stringify({
|
||||
id: 'mock-1',
|
||||
model: parsed.model ?? 'mock',
|
||||
choices: [
|
||||
{
|
||||
index: 0,
|
||||
message: { role: 'assistant', content: MOCK_REPLY },
|
||||
finish_reason: 'stop',
|
||||
},
|
||||
],
|
||||
usage: { prompt_tokens: 10, completion_tokens: 8, total_tokens: 18 },
|
||||
}),
|
||||
);
|
||||
return;
|
||||
}
|
||||
|
||||
res.writeHead(200, {
|
||||
'Content-Type': 'text/event-stream',
|
||||
'Cache-Control': 'no-cache',
|
||||
Connection: 'keep-alive',
|
||||
});
|
||||
const frame = (payload: Record<string, unknown>): void => {
|
||||
res.write(`data: ${JSON.stringify(payload)}\n\n`);
|
||||
};
|
||||
// 首 chunk:正文增量
|
||||
frame({
|
||||
id: 'mock-1',
|
||||
model: parsed.model ?? 'mock',
|
||||
choices: [{ index: 0, delta: { role: 'assistant', content: MOCK_REPLY } }],
|
||||
});
|
||||
// 末帧:finish_reason + usage
|
||||
frame({
|
||||
id: 'mock-1',
|
||||
model: parsed.model ?? 'mock',
|
||||
choices: [{ index: 0, delta: {}, finish_reason: 'stop' }],
|
||||
usage: { prompt_tokens: 10, completion_tokens: 8, total_tokens: 18 },
|
||||
});
|
||||
res.write('data: [DONE]\n\n');
|
||||
res.end();
|
||||
});
|
||||
});
|
||||
|
||||
return new Promise((resolve) => {
|
||||
server.listen(0, '127.0.0.1', () => {
|
||||
const addr = server.address() as AddressInfo;
|
||||
resolve({
|
||||
url: `http://127.0.0.1:${addr.port}`,
|
||||
close: () => new Promise<void>((r) => server.close(() => r())),
|
||||
requests,
|
||||
});
|
||||
});
|
||||
});
|
||||
}
|
||||
Reference in New Issue
Block a user