运行统计卡片
运行统计(Run Stats)测量一个智能体的一次运行,并用醒目、精确的数字显示出来,方便截图或粘贴到报告中。 这是 NeuroSquad 用于基准测试的官方卡片:让 Claude Code、Codex 和 OpenCode 在同一模型上执行同一个提示, 在每个智能体旁放一张运行统计卡片,然后进行比较。
这是 NeuroSquad 出品的已验证自定义卡片。在添加菜单(画布上的 +)中选择 Custom card…,从 Verified 标签页安装 Run Stats,添加到画布,并在卡片与智能体之间画一条箭头。需要 NeuroSquad 0.1.254 或更高版本。
显示内容
| 指标 | 含义 |
|---|---|
| 提示 | 交给智能体的回合数。回答权限请求属于同一回合。 |
| 模型请求 | 智能体对模型 API 的调用次数,来自工具自身的日志。 |
| 输入 | 未缓存的输入(提示)词元。 |
| 输出 | 输出词元,含推理(推理部分显示在下方)。 |
| 缓存读取 / 缓存写入 | 从服务商缓存读取 / 写入缓存的输入词元。 |
| 词元总数 | 输入 + 输出 + 缓存读取 + 缓存写入。 |
| 总用时 | 从第一个提示到最后一次完成(智能体工作时实时计时)。 |
| 工作时间 | 智能体实际工作的时间——不含等你的时间。 |
| 费用 | 按标价,或按工具自身记录的费用。未知模型显示无价格,绝不显示 $0。 |
词元数为精确整数,与用量页面使用的数据相同。如果工具或其背后的服务器不报告某个数字——例如本地 模型服务器不发送缓存计数——卡片会显示未报告,而不是 0。提示数、总用时和工作时间对所有智能体都有效; Amp 和 Cursor 没有 NeuroSquad 可读取的用量日志,因此只测量这几项。
测量一次运行
- 连接智能体后,卡片会统计该智能体至今的所有活动——对于新智能体,这正好就是这次运行。
- 立即开始测量(之后为新的运行)开始一次干净的测量:下一个提示即为这次运行。
- 完成时冻结(默认开启)在智能体完成时固定数字,即使你继续与智能体对话,截图用的数字也不会变。点击 解除冻结继续统计。
- MD 和 JSON 复制结果;发送到笔记(卡片菜单)把 Markdown 表格追加到用箭头连接的笔记。
- 缩小画布时,卡片磁贴显示词元总数和用时。
适用于: 在同一任务上比较不同的 CLI 或模型,以及回答“这次运行花了多少”。