硬性契约:删除代码中一切写死的上下文窗口与最大输出上限(含六家模型元信息
钳制与全部兜底值)——唯一合法来源是设置面板「上下文长度」(llm.contextWindow)
与「最大输出上限」(llm.maxTokens),跨 Provider/模型原样透传。
P0 正确性收口:
- 迁移 11/12(SCHEMA_VERSION 5):记忆表 embedding 列 + 分 Provider 窗口键清理
- 记忆生命周期接线:会话终态清理 working memory / episodic 90 天 TTL / access_count 回写
- 回放缓冲模块化 + 会话终态清理(杜绝 4MB/会话内存滞留)
- i18n 收口:主进程 main-locale(zh/en,ui.locale 热切换)+ 渲染层 17 处出层
P1 能力演进:
- 本地向量混合检索:0.6×向量余弦 + 0.4×TF-IDF,Ollama embeddings 首次投产,
存量记忆惰性回填,嵌入不可用自动回退 TF-IDF
- MEMORY.md 维护闭环:固化去重消除截断盲区;两阶段维护(AI 建议 → 用户确认 →
原子改写 + 语义记忆双轨同步 + 审计);>50KB 告警
- 可观测闭环:cacheTokens 引擎→前端透传(Token 面板命中率/成本行)+ 输入框
上下文占用指示条
- MCP Prompts/Resources 对话可用:/mcp:{server}:{prompt} 与 @mcp:{server}:{uri}
P2 体验补全:
- 工具自定义策略(正则白/黑名单 + 频率 + 强制确认,热生效)
- 连续 ≥3 同类工具确认聚合为单弹框
- 会话消息游标分页(首屏 200 条向上翻页)
- 开机自启;Playwright + Electron E2E 冒烟(本地 mock LLM 零外联)
Review 回归修复:MCP 大小写失配 / 分页状态复位 / 清空=未配置语义(Number(null)=0
隐患)/ MEMORY.md 告警位置 / working_memories FK(迁移 13)/ 全局配置层废键清理;
附带根治权限加固启动时序、代理回环放行、safeStorage 降级、悬空 symlink 逃逸。
验证:typecheck/lint 0 问题;test:electron 2478/2478(0 跳过);E2E 2/2;
docs/v0.8.1-迭代实施清单.md 全项留档。
158 lines
6.5 KiB
TypeScript
158 lines
6.5 KiB
TypeScript
/**
|
||
* MiMo (Xiaomi) Provider Adapter
|
||
*
|
||
* 基于 OpenAI 兼容 API。支持 Tool Calling、Thinking 模式、流式输出。
|
||
* 模型: mimo-v2.5-pro(1M 上下文 / 131072 max_tokens)/ mimo-v2.5(1M 上下文 / 32768 max_tokens)
|
||
*
|
||
* v0.6.4 P3-1: 继承 OpenAICompatibleAdapter —— 传输/组装/回退链收敛到共享基类,
|
||
* 本文件只保留 MiMo 差异点:max_completion_tokens 字段名、tool_choice 强制 "auto"、
|
||
* 思考模式与 temperature/top_p 互斥、无 /models 端点(本地元数据列表)。
|
||
*
|
||
* @see apis/mimo-api-docs-20260715.html
|
||
*/
|
||
|
||
import log from 'electron-log';
|
||
import type { MetonaRequest } from '../types';
|
||
import type { MetonaModelInfo } from '../types/metona-adapter';
|
||
import { buildOpenAICompatibleMessages, buildOpenAICompatibleTools } from './shared/openai-format';
|
||
import { OpenAICompatibleAdapter } from './shared/openai-compatible-base';
|
||
|
||
export class MimoAdapter extends OpenAICompatibleAdapter {
|
||
override readonly providerId: string = 'mimo';
|
||
readonly supportedModels = ['mimo-v2.5-pro', 'mimo-v2.5'];
|
||
readonly supportsToolCalling = true;
|
||
readonly supportsThinking = true;
|
||
|
||
// MiMo 模型元信息
|
||
// v0.8.1: 仅承载展示与能力声明 —— 窗口/输出上限数值已按硬性契约删除,
|
||
// 唯一合法来源是设置面板 llm.contextWindow / llm.maxTokens
|
||
private static readonly MODEL_INFO: Record<string, MetonaModelInfo> = {
|
||
'mimo-v2.5-pro': {
|
||
id: 'mimo-v2.5-pro',
|
||
name: 'MiMo V2.5 Pro',
|
||
supportsToolCalling: true,
|
||
supportsThinking: true,
|
||
description: '小米 MiMo 旗舰模型,支持深度思考与工具调用',
|
||
},
|
||
'mimo-v2.5': {
|
||
id: 'mimo-v2.5',
|
||
name: 'MiMo V2.5',
|
||
supportsToolCalling: true,
|
||
supportsThinking: true,
|
||
description: '小米 MiMo 标准模型,低延迟推理',
|
||
},
|
||
};
|
||
|
||
// ===== 共享基类差异声明 =====
|
||
|
||
protected override chatCompletionsUrl(): string {
|
||
return `${this.config.baseURL}/chat/completions`;
|
||
}
|
||
|
||
protected override sendTimeoutMs(): number {
|
||
return 120_000;
|
||
}
|
||
|
||
protected override modelInfoTable(): Record<string, MetonaModelInfo> {
|
||
return MimoAdapter.MODEL_INFO;
|
||
}
|
||
|
||
protected override providerLabel(): string {
|
||
return 'MiMo';
|
||
}
|
||
|
||
/**
|
||
* MiMo 官方未提供 /models 端点,直接返回本地元数据。
|
||
*/
|
||
override async listModels(): Promise<MetonaModelInfo[]> {
|
||
return this.supportedModels.map((id) => MimoAdapter.MODEL_INFO[id] ?? { id });
|
||
}
|
||
|
||
// ========== 协议参数映射(MiMo 差异点) ==========
|
||
|
||
protected override toNativeRequest(
|
||
request: MetonaRequest,
|
||
stream: boolean,
|
||
): Record<string, unknown> {
|
||
// v0.6.2: images 处理收敛至共享层(原索引对齐循环在孤立 tool 过滤后会错位)
|
||
const messages = buildOpenAICompatibleMessages(request, true);
|
||
const tools = buildOpenAICompatibleTools(request.tools);
|
||
|
||
// MiMo 使用 max_completion_tokens(非 max_tokens)
|
||
// v0.8.1 硬性契约: 原样透传设置面板「最大输出上限」(llm.maxTokens),删除了
|
||
// 旧的"#41 thinking 兜底 32768"与"按模型上限钳制"逻辑 —— 代码中不存在任何
|
||
// 写死的输出上限;未配置时该字段不下发,由服务端默认值决定。
|
||
const body: Record<string, unknown> = {
|
||
model: this.config.defaultModel,
|
||
messages,
|
||
max_completion_tokens: request.params.maxTokens,
|
||
stream,
|
||
};
|
||
|
||
if (stream) {
|
||
body.stream_options = { include_usage: true };
|
||
}
|
||
|
||
if (tools) {
|
||
body.tools = tools;
|
||
// MiMo 仅支持 tool_choice: "auto"
|
||
body.tool_choice = 'auto';
|
||
}
|
||
|
||
// v0.6.4 P4-3: MiMo 服务端内置工具透出 —— config.providerOptions.enableWebSearch
|
||
// 开启后附加 {type:'web_search'} 服务端搜索工具(annotations 引用随响应返回,
|
||
// 由上层归并为文本内容展示)。与客户端 tools 定义互不影响。
|
||
const providerOptions = this.config.providerOptions as Record<string, unknown> | undefined;
|
||
if (providerOptions?.['enableWebSearch'] === true) {
|
||
const serverTools = body.tools
|
||
? [...(body.tools as Array<Record<string, unknown>>), { type: 'web_search' }]
|
||
: [{ type: 'web_search' }];
|
||
body.tools = serverTools;
|
||
if (!body.tool_choice) body.tool_choice = 'auto';
|
||
}
|
||
|
||
// v0.6.4 P4-3: strict JSON 响应格式开关(response_format: json_object)——
|
||
// 供结构化抽取类任务使用;与流式模式兼容性由服务端保证(文档标注支持子集)
|
||
if (providerOptions?.['responseFormatJson'] === true) {
|
||
body.response_format = { type: 'json_object' };
|
||
}
|
||
|
||
// Thinking 模式(与 DeepSeek 参数结构一致)
|
||
// MiMo API 默认 thinking.type = "enabled",必须显式发送 disabled 才能关闭
|
||
// v0.8.0 修订(用户意图优先): 思考参数完全遵循用户配置,不再按
|
||
// supportsThinking 元信息硬门控 —— 预算耗尽风险由引擎空响应守卫的
|
||
// 降级重试链路兜底;元信息与配置不符时仅告警不拦截。
|
||
const wantThinking = request.params.thinkingEnabled !== false;
|
||
if (!wantThinking) {
|
||
// 显式禁用思考:传 disabled + temperature/top_p(非思考模式下这两个参数有效)
|
||
body.thinking = { type: 'disabled' };
|
||
body.temperature = request.params.temperature;
|
||
body.top_p = request.params.topP;
|
||
} else {
|
||
// 启用思考(包括 undefined,因为 MiMo 默认 enabled)
|
||
// 思考模式下 temperature/top_p 被 API 强制覆盖为 1.0/0.95,不传
|
||
body.thinking = { type: 'enabled' };
|
||
// 元信息标注不支持思考但用户开启 —— 告知降级兜底路径(不拦截)
|
||
if (MimoAdapter.MODEL_INFO[this.config.defaultModel]?.supportsThinking === false) {
|
||
log.warn(
|
||
`[MiMo] model "${this.config.defaultModel}" metadata says thinking unsupported — sending thinking params per user config (degraded retry handles budget exhaustion)`,
|
||
);
|
||
}
|
||
// v0.8.0 P0-3: 思考占用输出预算 —— 用户配置的输出预算过小时显式告警
|
||
const effectiveMax = body.max_completion_tokens as number | undefined;
|
||
if (typeof effectiveMax === 'number' && effectiveMax < 8192) {
|
||
log.warn(
|
||
`[MiMo] thinking enabled with small output budget (${effectiveMax} tokens per user config) — reasoning may consume the entire budget and truncate the answer`,
|
||
);
|
||
}
|
||
}
|
||
|
||
// 停止序列
|
||
if (request.params.stopSequences?.length) {
|
||
body.stop = request.params.stopSequences;
|
||
}
|
||
|
||
return body;
|
||
}
|
||
}
|