feat: v0.8.1 记忆深化 · 观测闭环 · 体验收口 — 窗口/输出上限全局单一配置 · 2478 用例全量回归 + E2E 冒烟
CI / 类型检查 + Lint + 单元测试 (push) Failing after 9m8s
CI / 全量测试 (Electron ABI) (push) Failing after 6m0s
CI / 产物编译验证 (push) Successful in 10m58s

硬性契约:删除代码中一切写死的上下文窗口与最大输出上限(含六家模型元信息
钳制与全部兜底值)——唯一合法来源是设置面板「上下文长度」(llm.contextWindow)
与「最大输出上限」(llm.maxTokens),跨 Provider/模型原样透传。

P0 正确性收口:
- 迁移 11/12(SCHEMA_VERSION 5):记忆表 embedding 列 + 分 Provider 窗口键清理
- 记忆生命周期接线:会话终态清理 working memory / episodic 90 天 TTL / access_count 回写
- 回放缓冲模块化 + 会话终态清理(杜绝 4MB/会话内存滞留)
- i18n 收口:主进程 main-locale(zh/en,ui.locale 热切换)+ 渲染层 17 处出层

P1 能力演进:
- 本地向量混合检索:0.6×向量余弦 + 0.4×TF-IDF,Ollama embeddings 首次投产,
  存量记忆惰性回填,嵌入不可用自动回退 TF-IDF
- MEMORY.md 维护闭环:固化去重消除截断盲区;两阶段维护(AI 建议 → 用户确认 →
  原子改写 + 语义记忆双轨同步 + 审计);>50KB 告警
- 可观测闭环:cacheTokens 引擎→前端透传(Token 面板命中率/成本行)+ 输入框
  上下文占用指示条
- MCP Prompts/Resources 对话可用:/mcp:{server}:{prompt} 与 @mcp:{server}:{uri}

P2 体验补全:
- 工具自定义策略(正则白/黑名单 + 频率 + 强制确认,热生效)
- 连续 ≥3 同类工具确认聚合为单弹框
- 会话消息游标分页(首屏 200 条向上翻页)
- 开机自启;Playwright + Electron E2E 冒烟(本地 mock LLM 零外联)

Review 回归修复:MCP 大小写失配 / 分页状态复位 / 清空=未配置语义(Number(null)=0
隐患)/ MEMORY.md 告警位置 / working_memories FK(迁移 13)/ 全局配置层废键清理;
附带根治权限加固启动时序、代理回环放行、safeStorage 降级、悬空 symlink 逃逸。

验证:typecheck/lint 0 问题;test:electron 2478/2478(0 跳过);E2E 2/2;
docs/v0.8.1-迭代实施清单.md 全项留档。
This commit is contained in:
2026-09-08 09:35:58 +08:00
parent 839860083f
commit 9b45c445bf
85 changed files with 5286 additions and 1158 deletions
+19 -27
View File
@@ -52,21 +52,19 @@ export class AnthropicAdapter extends BaseAdapter {
readonly supportsToolCalling = true;
readonly supportsThinking = true;
// v0.8.1: 仅承载展示与能力声明 —— 窗口/输出上限数值已按硬性契约删除,
// 唯一合法来源是设置面板 llm.contextWindow / llm.maxTokens
private static readonly MODEL_INFO: Record<string, MetonaModelInfo> = {
'claude-sonnet-4-5': {
id: 'claude-sonnet-4-5',
name: 'Claude Sonnet 4.5',
contextWindow: 200_000,
maxOutputTokens: 64_000,
supportsToolCalling: true,
supportsThinking: true,
description: 'Anthropic 旗舰模型,200K 上下文,支持扩展思考与工具调用',
description: 'Anthropic 旗舰模型,支持扩展思考与工具调用',
},
'claude-opus-4-1': {
id: 'claude-opus-4-1',
name: 'Claude Opus 4.1',
contextWindow: 200_000,
maxOutputTokens: 32_000,
supportsToolCalling: true,
supportsThinking: true,
description: 'Anthropic 深度推理模型',
@@ -74,8 +72,6 @@ export class AnthropicAdapter extends BaseAdapter {
'claude-haiku-4-5': {
id: 'claude-haiku-4-5',
name: 'Claude Haiku 4.5',
contextWindow: 200_000,
maxOutputTokens: 32_000,
supportsToolCalling: true,
supportsThinking: true,
description: 'Anthropic 低延迟模型',
@@ -416,13 +412,9 @@ export class AnthropicAdapter extends BaseAdapter {
return this.supportedModels.map((id) => AnthropicAdapter.MODEL_INFO[id] ?? { id });
}
override getContextWindow(): number {
if (typeof this.config.contextWindow === 'number' && this.config.contextWindow > 0) {
return this.config.contextWindow;
}
const modelInfo = AnthropicAdapter.MODEL_INFO[this.config.defaultModel];
return modelInfo?.contextWindow ?? 200_000;
}
// getContextWindow 使用基类实现 —— v0.8.1 硬性契约:唯一来源是
// 设置面板「上下文长度」(llm.contextWindow → AdapterConfig.contextWindow),
// 未配置返回 0,引擎据此跳过压缩预算计算。
// ========== 私有方法 ==========
@@ -531,22 +523,21 @@ export class AnthropicAdapter extends BaseAdapter {
});
}
// v0.5.3: max_tokens 按模型上限钳制(sonnet 64000 / opus 32000 / haiku 32000)—
// 引擎默认 63488 超过 opus/haiku 上限时 API 直接 400thinking budget 已在此值内二分
const anthropicMaxOutput =
AnthropicAdapter.MODEL_INFO[this.config.defaultModel]?.maxOutputTokens ?? 64_000;
// v0.6.4 边界加固: thinking 开启时保证 max_tokens ≥ 2048 —— 协议要求
// budget_tokens >= 1024 且 < max_tokens。原实现当用户配置极小 maxTokens
// (如 1500)时 Math.floor(1500/2)=750 < 1024 直接 API 400。
const requestedMaxTokens = request.params.maxTokens ?? 8192;
// v0.8.1 硬性契约: max_tokens 原样透传设置面板「最大输出上限」(llm.maxTokens),
// 删除了旧的按模型元信息钳制逻辑(MODEL_INFO.maxOutputTokens 已删除)。
// 唯一保留的协议不变量:thinking 开启时 max_tokens ≥ 2048 —— Anthropic 协议
// 要求 budget_tokens >= 1024 且 < max_tokens,用户配置低于该下限时 API 必然
// 400,此为协议正确性下限而非输出上限(不修改用户配置的持久化值,仅在
// 本次请求体上满足协议约束)。
const requestedMaxTokens = request.params.maxTokens;
const maxTokensForRequest = thinkingRequested
? Math.max(2048, Math.min(requestedMaxTokens, anthropicMaxOutput))
: Math.min(requestedMaxTokens, anthropicMaxOutput);
? Math.max(2048, requestedMaxTokens ?? 2048)
: requestedMaxTokens;
const body: Record<string, unknown> = {
model: this.config.defaultModel,
max_tokens: maxTokensForRequest,
// v0.8.1: 未配置「最大输出上限」时不下发 max_tokens(服务端默认值生效)
...(maxTokensForRequest != null ? { max_tokens: maxTokensForRequest } : {}),
messages: merged,
stream,
};
@@ -581,7 +572,8 @@ export class AnthropicAdapter extends BaseAdapter {
max: 32768,
};
const effortBudget = budgetMap[request.params.thinkingEffort ?? 'high'] ?? 16384;
const budget = Math.min(effortBudget, Math.floor(maxTokensForRequest / 2));
// thinking 路径 maxTokensForRequest 恒为数字(Math.max(2048, …) 兜底)
const budget = Math.min(effortBudget, Math.floor((maxTokensForRequest ?? 2048) / 2));
body.thinking = { type: 'enabled', budget_tokens: budget };
} else {
body.temperature = request.params.temperature;