feat: v0.8.1 记忆深化 · 观测闭环 · 体验收口 — 窗口/输出上限全局单一配置 · 2478 用例全量回归 + E2E 冒烟
CI / 类型检查 + Lint + 单元测试 (push) Failing after 9m8s
CI / 全量测试 (Electron ABI) (push) Failing after 6m0s
CI / 产物编译验证 (push) Successful in 10m58s

硬性契约:删除代码中一切写死的上下文窗口与最大输出上限(含六家模型元信息
钳制与全部兜底值)——唯一合法来源是设置面板「上下文长度」(llm.contextWindow)
与「最大输出上限」(llm.maxTokens),跨 Provider/模型原样透传。

P0 正确性收口:
- 迁移 11/12(SCHEMA_VERSION 5):记忆表 embedding 列 + 分 Provider 窗口键清理
- 记忆生命周期接线:会话终态清理 working memory / episodic 90 天 TTL / access_count 回写
- 回放缓冲模块化 + 会话终态清理(杜绝 4MB/会话内存滞留)
- i18n 收口:主进程 main-locale(zh/en,ui.locale 热切换)+ 渲染层 17 处出层

P1 能力演进:
- 本地向量混合检索:0.6×向量余弦 + 0.4×TF-IDF,Ollama embeddings 首次投产,
  存量记忆惰性回填,嵌入不可用自动回退 TF-IDF
- MEMORY.md 维护闭环:固化去重消除截断盲区;两阶段维护(AI 建议 → 用户确认 →
  原子改写 + 语义记忆双轨同步 + 审计);>50KB 告警
- 可观测闭环:cacheTokens 引擎→前端透传(Token 面板命中率/成本行)+ 输入框
  上下文占用指示条
- MCP Prompts/Resources 对话可用:/mcp:{server}:{prompt} 与 @mcp:{server}:{uri}

P2 体验补全:
- 工具自定义策略(正则白/黑名单 + 频率 + 强制确认,热生效)
- 连续 ≥3 同类工具确认聚合为单弹框
- 会话消息游标分页(首屏 200 条向上翻页)
- 开机自启;Playwright + Electron E2E 冒烟(本地 mock LLM 零外联)

Review 回归修复:MCP 大小写失配 / 分页状态复位 / 清空=未配置语义(Number(null)=0
隐患)/ MEMORY.md 告警位置 / working_memories FK(迁移 13)/ 全局配置层废键清理;
附带根治权限加固启动时序、代理回环放行、safeStorage 降级、悬空 symlink 逃逸。

验证:typecheck/lint 0 问题;test:electron 2478/2478(0 跳过);E2E 2/2;
docs/v0.8.1-迭代实施清单.md 全项留档。
This commit is contained in:
2026-09-08 09:35:58 +08:00
parent 839860083f
commit 9b45c445bf
85 changed files with 5286 additions and 1158 deletions
@@ -452,13 +452,25 @@ describe('OllamaAdapter — 能力探测', () => {
expect(caps).toEqual({ supportsTools: true, supportsVision: true, supportsThinking: true });
});
it('capabilities 为空数组(showModel 缺省 [])→ 三能力全 false(非 null', async () => {
// v0.8.1: showModel 保留 undefined 语义 —— 响应缺 capabilities 字段 = 未知 → null
//fail-open),不再把"字段缺失"与"权威空"混同(探测竞态下曾误判不支持思考)
it('capabilities 字段缺失 → 返回 null(未知,fail-open', async () => {
const adapter = makeAdapter();
mockFetch.mockResolvedValue({
ok: true,
status: 200,
json: async () => ({ parameters: '', template: '' }),
} as unknown as Response);
expect(await adapter.probeCapabilities('qwen3')).toBeNull();
});
it('capabilities 为显式空数组(服务端权威无能力)→ 三能力全 false', async () => {
const adapter = makeAdapter();
mockFetch.mockResolvedValue({
ok: true,
status: 200,
json: async () => ({ parameters: '', template: '', capabilities: [] }),
} as unknown as Response);
expect(await adapter.probeCapabilities('qwen3')).toEqual({
supportsTools: false,
supportsVision: false,
@@ -688,28 +700,33 @@ describe('OllamaAdapter — 图片归一化', () => {
// ===== getContextWindow =====
describe('OllamaAdapter — getContextWindow', () => {
it('未探测到时返回默认 4096', () => {
describe('OllamaAdapter — getContextWindow(v0.8.1:唯一来源是设置面板配置)', () => {
it('未配置 contextWindow → 返回 0(无 4096 写死兜底,引擎跳过压缩判定)', () => {
const adapter = makeAdapter();
expect(adapter.getContextWindow()).toBe(4096);
expect(adapter.getContextWindow()).toBe(0);
});
it('探测到 num_ctx 后返回实测值(机会主义缓存收敛)', async () => {
// 需在构造前就位:构造时的 fire-and-forget 探测消费首个 fetch
it('config.contextWindowllm.contextWindow 注入)→ 返回配置值', () => {
const adapter = makeAdapter('qwen3', { contextWindow: 32_768 });
expect(adapter.getContextWindow()).toBe(32_768);
});
it('/api/show 探测不再缓存窗口数值(num_ctx 由引擎 contextLength 下发)', async () => {
mockFetch.mockResolvedValue({
ok: true,
status: 200,
json: async () => ({ parameters: 'num_ctx 32768', template: '', capabilities: [] }),
} as unknown as Response);
const adapter = makeAdapter();
// 等待构造时的探测完成并写入缓存
await vi.waitFor(() => expect(adapter.getContextWindow()).toBe(32768));
// 探测完成(含失败路径)后窗口仍为 0 —— 探测只服务于能力门控
await new Promise((r) => setTimeout(r, 20));
expect(adapter.getContextWindow()).toBe(0);
});
it('探测失败(网络错误)→ 保持默认 4096', async () => {
it('探测失败(网络错误)→ 仍返回配置值/0,不抛错不阻塞', async () => {
mockFetch.mockRejectedValue(new Error('down'));
const adapter = makeAdapter();
await new Promise((r) => setTimeout(r, 20));
expect(adapter.getContextWindow()).toBe(4096);
expect(adapter.getContextWindow()).toBe(0);
});
});