fix: v0.5.5 全量复检修复 — 图片 token 估算缺失(压缩预算失真)+ 过时文案清理
CI / 类型检查 + Lint + 单元测试 (push) Failing after 5m41s
CI / 产物编译验证 (push) Successful in 10m6s
CI / 全量测试 (Electron ABI) (push) Failing after 5m21s

背景:v0.5.4 多模态增强(多轮图片记忆 + 总开关 + DeepSeek vision)发布后的
全量全方位复检,重点核查新增功能的跨模块边界。

复检通过项(无回归确认):
- 多轮图片记忆 × 五家 adapter:Anthropic(base64 块)/ OpenAI(image_url
  parts)/ Ollama(纯 base64 数组)/ Agnes / MiMo 均正确处理恢复的历史 images
- 多轮图片记忆 × 引擎运行时压缩:摘要请求仅含文本(图片不进摘要调用);
  toKeep 消息的 images 原样保留;孤立 tool 消息配对逻辑不受影响
- 多轮图片记忆 × 摘要服务:maybeSummarize 用截断文本 transcript,无图片干扰
- history 组装 slice(0,-1) × 图片恢复无冲突(当前消息 images 走独立通道)
- 编辑重发/重新生成路径与图片恢复同源(attachments.preview),行为一致

修复项:
- P1 token 估算器完全忽略 images(estimateMessagesTokens):
  带 10 张图的消息被按纯文本估算。影响:压缩 keepBudget 严重低估 →
  压缩后实际 token 仍超 80% 阈值 → 反复触发压缩循环(每轮多一次 LLM
  摘要调用);上下文占用显示严重失真。修复:每张图按 1000 tokens 计入
  (1024px 压缩图在主流 Provider 约 700~1500 视觉 token,取保守上界)
- 文案清理:ChatInput 附件按钮 Tooltip 硬编码"DeepSeek 不支持图片"改为
  按拒绝原因区分(开关未开启 vs 当前模型不支持);openai-format.ts 共享层
  注释更新(DeepSeek vision 已支持,非 vision 模型才丢弃)

测试(243 → 245 用例):
- 新增 token 估算图片用例 ×2:带 images 消息按每张 1000 tokens 计入 /
  无 images 字段消息行为不变(向后兼容)

验证: lint 0 / typecheck 双工程 0 / test:electron 245 全过 / build 成功
This commit is contained in:
2026-08-21 23:09:36 +08:00
parent 4ee5100661
commit 22028c91c3
6 changed files with 66 additions and 21 deletions
+1 -1
View File
@@ -1,6 +1,6 @@
{
"name": "metona-ai-desktop",
"version": "0.5.4",
"version": "0.5.5",
"description": "MetonaAI Desktop — 生产级通用 AI Agent 智能体桌面应用",
"main": "dist-electron/main/main.js",
"author": "Metona Team",