建木 JIANMUCASE ANALYSIS EXPERTEnglish

已记录的合成案例 / 2026 年 9 月 27 日归档核查

复杂资料,
执行过程清晰可查。

2.75M索引资料库中的记录
39.8 分钟记录中的分析运行用时
1,255已记录查询事件

一次已完成的真实模型合成案例运行:13 张表、2,749,851 条索引记录,34 个不同席位、114 次交接事件。源数据清单摘要与运行记录一致。分析时间不含前置导入;资料库规模不等于每条记录均进入模型提示。

记录中的协调:3 个主控会话、14 个协调会话与 22 个分析会话。事件日志含 6 个假设关口事件,不等于 6 次人工审批。这些记录不证明独立场景中的 1M 上下文或 5/0 关口配置。

记录中的 Token 台账 · 查看分配
39 份分析与协调记录 · 服务商用量分类
角色未缓存输入缓存写入缓存读取输出
分析角色 (22)396525,2703,149,781150,463
协调角色 (14)5046,402107,21718,828
主控角色 (3)1214,03827,4117,236
合计458585,7103,284,409176,527

记录 Token 共 4,047,104,包含缓存输入;分析与协调输入 Token 中 84.9% 为缓存读取。缓存读取仍是 Token,并非 Token 消除。独立复核的 86 份日志另记 499,967 个“tokens used”,但无输入、输出、缓存拆分,未混入上方服务商用量分类。

在线模型快速对比 · DeepSeek 计价

使用 2026 年 9 月 27 日核查的 DeepSeek 美元公开单价,对分析与协调 Token 组合重新计价。原运行记录模型别名“sonnet”,对应记录费用小计 $4.766。此处为价格表测算,不是 DeepSeek 实际执行、完整运行账单或质量对比。

相同记录 Token 组合 · 假设相同缓存命中与输出量
公开模型非高峰估算高峰估算
DeepSeek-V4.1-Flash$0.204$0.407
DeepSeek-V4-Pro-0813$0.809$1.617

公式:缓存读取 Token × 命中单价 +(未缓存输入 + 缓存写入 Token)× 未命中单价 + 输出 Token × 输出单价,再除以一百万。不含复核、硬件、导入与服务费用。实际运行的分词、推理长度、缓存行为、质量与时延均可能不同。

DeepSeek 官方 API 同样支持工具调用与结构化输出。公平对比应在相同数据上比较建木编排与明确配置的工具基线,而非假设普通模型不能使用工具。

官方模型规格与单价 ↗
来源核算与范围

只读核查检查事件序列、最终裁定修正、数据清单摘要和会话唯一性。用量仅累加会话顶层汇总,不重复累加内部迭代。38 项候选发现最终为 13 项已核验、2 项假设及 23 项驳回;这些是复核状态,不是独立评测准确率。34 个席位表示运行期间的不同角色,不是同时并发测量。

下载脱敏核算摘要 ↓

合成工作负载 / 场景测算

同样 1 TB,
不同的处理方式。

河口计划:一个虚构的采购调查场景,涉及支付、通信、合同、扫描件与系统日志。分析支付链、关联实体与矛盾点,并将发现连接到原始资料。

A / 场景基线

串行模型流程

由模型重复读取、分析与复核,各阶段顺序执行。

模型 Token 预算
42.00 B
测算总用时
1,176.7 h
有效速率 10,000 Token/秒 + 10 小时非模型工作

B / 建木场景

混合执行工作流

脚本处理记录,专业角色按需读取依据,独立任务并行执行。

模型 Token 预算
1.74 B
测算总用时
22.5 h
有效速率 40,000 Token/秒 + 10.4 小时非模型工作
95.9%Token 减少:420 亿 → 17.4 亿52.3×测算提速:1,176.7 小时 → 22.5 小时

同一个 1 TB 合成工作负载,对比不同执行策略与假设吞吐。以上为预算测算,不是模型实测结果。同为 40,000 Token/秒时:301.7 小时对比 22.5 小时,即 13.4 倍。基线不代表 DeepSeek、Claude 或所有多智能体系统。

340 GB表格与交易
260 GB扫描件与文档
220 GB通信与附件
180 GB日志与导出

采用十进制单位。假设提取 120 GB 文本,按 4 字节/Token 估算,为 300 亿 Token 等价量。二进制存储字节不直接折算模型 Token。本页计算工作负载,不包含或实际处理 1 TB 数据集。