P0 会话可靠性收口(根治"模型思考着会话就停止"): - P0-1 finish_reason 全链路贯通:DONE 事件与 IterationStep 新增 finishReason,OpenAI 共享 SSE / Anthropic message_delta.stop_reason / Ollama done_reason 三路采集,TRACE 层弃用硬编码 'stop' 记录真值 - P0-2 空响应守卫 + 降级重试:零产出流→可重试错误走退避;思考耗尽输出预算(reasoning-only + length)→自动关闭思考降级重试一次;仍失败→OUTPUT_LENGTH_EXCEEDED 结构化错误 + 故障转移;附带根治 abort 恰逢零工具调用轮被 COMPLETED 抢占的真实缺陷 - P0-3 思考×能力×预算三对齐:DeepSeek/MiMo/Agnes/Ollama 四家 supportsThinking=false 强制不发思考参数;小输出预算告警;设置页联动提示 - P0-4 渲染层可见性:截断/空完成/友好错误三类提示,i18n 全部出层 - P0-5 回归四件套:reasoning-only 终止判定、集成级空闲超时、504 引擎重试归类、思考中 abort→USER_INTERRUPT、P4-2 强制收尾路径 FEAT-1:LLM 设置新增「最大输出上限」——Provider 支持矩阵显隐 + 模型上限钳制提示 + 超限保存警告 + llm.maxTokens 热生效 P1 修复面收口: - 渲染层三缺陷根治:后台会话回放缓冲(2000 条/4MB 有界 + agent:getReplayState + 事件总线)+ abort 双层自愈 + sendMessage 收尾兜底 + 中断卡片清扫 - 工具 abort 信号全覆盖:web_search/web_fetch/http_request/code_search/git 系列/delegate_task 全部接入引擎中断;web_search 时间预算收敛(720s→≤240s);移除伪造 ToolExecutionContext 与死代码 - 安全:本地 Pinned CONNECT 代理根治浏览器通道 DNS rebinding(校验期 IP pinning,可注入 resolver 表测);配置 URL 域名解析深校验(DeepCheckSoftFailure 软失败);SSE 空 error 帧防御修复;Ollama generate/embed AbortSignal.any 合并 - 缺陷清单:UTF-16 BOM 读取、tmp 同毫秒碰撞(nanoid 后缀)、code_search JS 回退参数对称(case_sensitive/前后文独立)、list_directory include_node_modules、崩溃自愈退避(60s 窗 ≥3 次停 reload)、MemoryViewer/Sidebar i18n 收口 P2 能力演进: - 会话回收站:SCHEMA_VERSION 3 + 迁移 10(deleted_at,存在性守卫),软删除/恢复/彻底删除/30 天自动清理(启动+24h),searchMessages 聚合剔除,Sidebar 回收站面板 - 会话回放播放器:sessions:listRecordings/readRecording(白名单+目录边界+20MB 上限),SessionReplayPlayer 时间轴/步进/变速,Trace 面板入口 - electron-updater 自动更新:双轨(手动 feed 比对保留),生产环境启动静默检查 + update:status 广播 + app:updateInstall + LogsSettings UpdatePanel + builder publish 配置 - @ 文件提及:workspace.listFiles/readFileClip(边界/512KB/NUL 拒绝/MEMORY.md 保护),ChatInput Fuse 联想+键盘导航+附件管线注入 - MCP Resources/Prompts 发现:可选能力 try/catch 降级,mcp:listServerContents,MCPSettings 展开视图 - 文档对齐:内部 API 标准 HTML(Adapter 清单补 MiMo/已实现注记/STREAM_RESET/DONE.finishReason/ repetition_truncation 映射);README v0.8.0 亮点表 P3 测试基建: - 新增 4 个测试文件:engine-stream-contract(6)、engine-stream-reliability(4:集成空闲超时/504 重试/思考中 abort/P4-2 强制收尾)、thinking-capability-gate(7)、pinned-proxy(9,含深校验 5)、session-trash(5,DB 域)、use-agent-stream hook 级(5)、agent.test 回放缓冲(2) - 契约更新:orchestrator 被中断 SubAgent success=false(abort 优先级修复语义)、SSE 空 error 帧、UTF-16 正常读取、DeepSeek 未配置思考显式 disabled、迁移矩阵 v2→3 - 弱断言根治:registry WEBP 单向断言、hooks-contracts 自比恒真、memory 空 token 补强 全量验证:typecheck 0 错误 / lint 0 问题 / 系统 Node 2144 通过(301 DB 用例按 ABI 跳过)/ Electron ABI 2445/2445 全量通过 0 跳过
243 lines
8.8 KiB
TypeScript
243 lines
8.8 KiB
TypeScript
/**
|
||
* DeepSeek Provider Adapter
|
||
*
|
||
* 基于 OpenAI 兼容 API。支持 Tool Calling、Thinking 模式、流式输出。
|
||
* 模型: deepseek-v4-flash / deepseek-v4-pro(1M 上下文,384K 最大输出)
|
||
*
|
||
* v0.6.4 P3-1: 继承 OpenAICompatibleAdapter —— send/sendStream/响应组装/
|
||
* 认证头/上下文窗口回退链全部收敛到共享基类,本文件只保留 DeepSeek 差异点:
|
||
* vision 模型判定、/models 合并、/user/balance、thinking+reasoning_effort 映射。
|
||
*
|
||
* @see apis/deepseek-api-docs-20260518.html
|
||
*/
|
||
|
||
import log from 'electron-log';
|
||
import type { MetonaRequest } from '../types';
|
||
import type { MetonaModelInfo } from '../types/metona-adapter';
|
||
import { buildOpenAICompatibleMessages, buildOpenAICompatibleTools } from './shared/openai-format';
|
||
import { OpenAICompatibleAdapter } from './shared/openai-compatible-base';
|
||
|
||
export class DeepSeekAdapter extends OpenAICompatibleAdapter {
|
||
// H-2 修复: providerId(规范要求)
|
||
override readonly providerId: string = 'deepseek';
|
||
readonly supportedModels = [
|
||
'deepseek-v4-pro',
|
||
'deepseek-v4-flash',
|
||
'deepseek-v4-flash-vision-exp',
|
||
];
|
||
readonly supportsToolCalling = true;
|
||
readonly supportsThinking = true;
|
||
|
||
// H-2 修复: DeepSeek 模型元信息(1M 上下文,384K 最大输出)
|
||
private static readonly MODEL_INFO: Record<string, MetonaModelInfo> = {
|
||
'deepseek-v4-pro': {
|
||
id: 'deepseek-v4-pro',
|
||
name: 'DeepSeek V4 Pro',
|
||
contextWindow: 1_000_000,
|
||
maxOutputTokens: 384_000,
|
||
supportsToolCalling: true,
|
||
supportsThinking: true,
|
||
description: 'DeepSeek 旗舰模型,1M 上下文,支持深度推理与工具调用',
|
||
},
|
||
'deepseek-v4-flash': {
|
||
id: 'deepseek-v4-flash',
|
||
name: 'DeepSeek V4 Flash',
|
||
contextWindow: 1_000_000,
|
||
maxOutputTokens: 384_000,
|
||
supportsToolCalling: true,
|
||
supportsThinking: true,
|
||
description: 'DeepSeek 快速版,1M 上下文,低延迟推理',
|
||
},
|
||
// v0.5.4: DeepSeek 多模态实验模型(OpenAI image_url content parts 格式)
|
||
'deepseek-v4-flash-vision-exp': {
|
||
id: 'deepseek-v4-flash-vision-exp',
|
||
name: 'DeepSeek V4 Flash Vision (Exp)',
|
||
contextWindow: 128_000,
|
||
maxOutputTokens: 8_192,
|
||
supportsToolCalling: true,
|
||
supportsThinking: false,
|
||
description: 'DeepSeek 多模态实验模型,支持图片输入(image_url content parts)',
|
||
},
|
||
};
|
||
|
||
// ===== 共享基类差异声明 =====
|
||
|
||
protected override chatCompletionsUrl(): string {
|
||
return `${this.config.baseURL}/chat/completions`;
|
||
}
|
||
|
||
protected override sendTimeoutMs(): number {
|
||
return 120_000;
|
||
}
|
||
|
||
protected override modelInfoTable(): Record<string, MetonaModelInfo> {
|
||
return DeepSeekAdapter.MODEL_INFO;
|
||
}
|
||
|
||
protected override providerLabel(): string {
|
||
return 'DeepSeek';
|
||
}
|
||
|
||
/**
|
||
* v0.5.4: 当前模型是否支持多模态图片输入
|
||
*
|
||
* DeepSeek 仅 vision 系列模型支持图片(命名含 'vision');
|
||
* 非 vision 模型收到 images 时静默丢弃(避免 API 400)。
|
||
* 前端上传入口由 llm.multimodalEnabled 配置总开关控制,此处是 adapter 侧的模型级防线。
|
||
*/
|
||
private isVisionModel(): boolean {
|
||
return this.config.defaultModel.includes('vision');
|
||
}
|
||
|
||
// ===== GET /models =====
|
||
|
||
/**
|
||
* 优先尝试从 API 获取实时模型列表,并合并本地 MODEL_INFO 元数据。
|
||
* API 不可用时回退到 supportedModels。
|
||
*/
|
||
override async listModels(): Promise<MetonaModelInfo[]> {
|
||
try {
|
||
const response = await fetch(`${this.config.baseURL}/models`, {
|
||
headers: { Authorization: `Bearer ${this.config.apiKey}` },
|
||
signal: AbortSignal.timeout(10_000),
|
||
});
|
||
if (response.ok) {
|
||
const data = (await response.json()) as { data?: Array<{ id: string }> };
|
||
if (data.data?.length) {
|
||
// 合并 API 返回的模型 ID 与本地元数据
|
||
return data.data.map((m) => DeepSeekAdapter.MODEL_INFO[m.id] ?? { id: m.id });
|
||
}
|
||
}
|
||
} catch {
|
||
// API 不可用时降级
|
||
}
|
||
// 回退到 supportedModels(带本地元数据)
|
||
return this.supportedModels.map((id) => DeepSeekAdapter.MODEL_INFO[id] ?? { id });
|
||
}
|
||
|
||
// ===== GET /user/balance =====
|
||
|
||
/**
|
||
* 查询账户余额
|
||
*
|
||
* v0.5.2 修复: 官方 API 返回 balance_infos 数组格式(此前按扁平字段解析恒为 0)。
|
||
* URL 规范化: 余额端点为 {root}/user/balance(无 /v1 前缀),需剥离配置中的尾斜杠与 /v1。
|
||
*/
|
||
async getBalance(): Promise<{
|
||
currency: string;
|
||
totalBalance: string;
|
||
grantedBalance: string;
|
||
toppedUpBalance: string;
|
||
} | null> {
|
||
try {
|
||
const root = this.config.baseURL.replace(/\/+$/, '').replace(/\/v1$/, '');
|
||
const response = await fetch(`${root}/user/balance`, {
|
||
headers: { Authorization: `Bearer ${this.config.apiKey}` },
|
||
signal: AbortSignal.timeout(10_000),
|
||
});
|
||
if (!response.ok) return null;
|
||
const data = (await response.json()) as {
|
||
is_available?: boolean;
|
||
balance_infos?: Array<{
|
||
currency?: string;
|
||
total_balance?: string;
|
||
granted_balance?: string;
|
||
topped_up_balance?: string;
|
||
}>;
|
||
// 扁平格式字段(网关/代理兼容)
|
||
currency?: string;
|
||
total_balance?: string;
|
||
granted_balance?: string;
|
||
topped_up_balance?: string;
|
||
};
|
||
const info = data.balance_infos?.[0] ?? data;
|
||
return {
|
||
currency: info.currency ?? 'CNY',
|
||
totalBalance: info.total_balance ?? '0',
|
||
grantedBalance: info.granted_balance ?? '0',
|
||
toppedUpBalance: info.topped_up_balance ?? '0',
|
||
};
|
||
} catch {
|
||
return null;
|
||
}
|
||
}
|
||
|
||
// ========== 协议参数映射(DeepSeek 差异点) ==========
|
||
|
||
protected override toNativeRequest(
|
||
request: MetonaRequest,
|
||
stream: boolean,
|
||
): Record<string, unknown> {
|
||
// v0.6.2: images 处理收敛至共享层(includeImages = vision 模型才转换,
|
||
// 非 vision 静默丢弃——正确行为,见 openai-format.ts #27 记录)
|
||
const messages = buildOpenAICompatibleMessages(request, this.isVisionModel());
|
||
const tools = buildOpenAICompatibleTools(request.tools);
|
||
|
||
// v0.5.3: max_tokens 按模型上限钳制 — 引擎默认 63488 超过部分模型上限时 API 直接 400
|
||
const modelInfo = DeepSeekAdapter.MODEL_INFO[this.config.defaultModel];
|
||
const maxOutput = modelInfo?.maxOutputTokens ?? 384_000;
|
||
const maxTokens = Math.min(request.params.maxTokens ?? maxOutput, maxOutput);
|
||
|
||
const body: Record<string, unknown> = {
|
||
model: this.config.defaultModel,
|
||
messages,
|
||
temperature: request.params.temperature,
|
||
max_tokens: maxTokens,
|
||
stream,
|
||
};
|
||
|
||
// v0.5.4: vision 模型图片数审计(转换在共享层完成)
|
||
if (this.isVisionModel()) {
|
||
const imageCount = request.messages.reduce((n, m) => n + (m.images?.length ?? 0), 0);
|
||
if (imageCount > 0) {
|
||
log.info(`[DeepSeek] Vision model processing ${imageCount} image(s)`);
|
||
}
|
||
}
|
||
|
||
if (stream) {
|
||
body.stream_options = { include_usage: true };
|
||
}
|
||
|
||
if (tools) {
|
||
body.tools = tools;
|
||
}
|
||
|
||
// Thinking 模式
|
||
// v0.8.0 P0-3 根治: 模型能力门控 —— MODEL_INFO.supportsThinking === false 的
|
||
// 模型(如 deepseek-v4-flash-vision-exp)一律不发思考参数并显式 disabled,
|
||
// 防止思考消耗输出预算(生产事故:vision-exp 8192 输出预算被 max 档思考
|
||
// 全部烧光 → finish_reason=length 空回复 → 会话静默停止)。
|
||
const modelThinkingSupported =
|
||
DeepSeekAdapter.MODEL_INFO[this.config.defaultModel]?.supportsThinking !== false;
|
||
const wantThinking = request.params.thinkingEnabled === true && modelThinkingSupported;
|
||
// API 默认 thinking.type = "enabled",必须显式发送 disabled 才能关闭
|
||
if (!wantThinking) {
|
||
body.thinking = { type: 'disabled' };
|
||
} else {
|
||
body.thinking = { type: 'enabled' };
|
||
const effortMap: Record<string, string> = {
|
||
low: 'high',
|
||
medium: 'high',
|
||
high: 'high',
|
||
max: 'max',
|
||
};
|
||
// DeepSeek API 仅支持 high / max 两档,low/medium 映射为 high
|
||
body.reasoning_effort = effortMap[request.params.thinkingEffort ?? 'high'] ?? 'high';
|
||
// v0.8.0 P0-3: 思考会占用输出预算 —— 钳制后预算过小时显式告警
|
||
//(思考 token 计入 max_tokens,预算过小会出现"思考耗尽正文为零"截断)
|
||
if (maxTokens < 8192) {
|
||
log.warn(
|
||
`[DeepSeek] thinking enabled with small output budget (${maxTokens} tokens after model clamp) — reasoning may consume the entire budget and truncate the answer`,
|
||
);
|
||
}
|
||
}
|
||
|
||
// 停止序列
|
||
if (request.params.stopSequences?.length) {
|
||
body.stop = request.params.stopSequences;
|
||
}
|
||
|
||
return body;
|
||
}
|
||
}
|