一周的 Agent 工作会在本地留下足够的证据,用来回答一些具体问题:会话什么时候活跃、活动出自哪家服务商、出现过哪些模型,以及 token 结构按天怎么变化
当前覆盖:Agent Island 2.1.2 支持 Claude Code、Codex、Antigravity、Grok 和 Cursor —— 五家都有实时会话状态与轮到你了提醒,macOS 与 Windows 同步
同一批数据证明不了代码是对的,证明不了这一周有产出,也证明不了一个 API 价值估算等于花掉的钱。周报有用的前提,是把这些边界摆在明面上
1. 用自然日,不要用漂移的 168 小时窗口
一份读得懂的周报应该用今天加上前面六个本地自然日。每日柱状、服务商合计、模型行和头条数字必须共用这同一条边界
把自然日的图表和滚动的模型合计混在一起,会出现各行加起来超过头条数字的情况。时区处理和午夜边界是记账规则,不是视觉细节
2. 把 token 总量当成活动量来读
输入、输出、缓存创建和缓存读取描述的是不同的工作。全量 token 总数能显示本地记录里出现了多少活动;只算输入加输出的口径则排除缓存流量,视角更窄
这两个数字都不是生产力评分。一次重缓存的重构搬动的 token,可能比一个很小但很关键的修复多得多;一次失败的运行也可能很贵;一个安静的会话可能是在等人,而不是什么都没做成
3. 对比服务商,但别造出等价关系
服务商占比能显示记录到的活动里有多少来自 Claude Code、多少来自 Codex。它不该暗示两家各一个 token 代表同等的工作量、延迟、质量或额度压力
额度窗口始终是服务商报告的状态,本地 token 活动始终是重建出来的台账。报告可以同时展示两者,但不该拿其中一个去填补另一个的缺口
4. 把模型行当成一份带日期的清单
模型名在一次会话中途也可能变。每个 token 事件都应该保留它发生时生效的模型上下文。未知的模型标识应当保持可见,而不是继承一个猜出来的价格
按 API 价值估算排序和按 token 体量排序回答的是不同问题。一个跑了大量廉价缓存读取的模型可能在 token 上领先,另一个则在价值上领先
5. 做一次五分钟的周复盘
- 看本地这七天是不是都在
- 找一找没解释的缺口、重放造成的尖峰,或者服务商新鲜度报错
- 对比服务商与模型结构,但别把它们当成质量
- 使用估算时,只在它显示的价目表日期下使用
- 为下一周写下一条具体的操作改动,比如减少无人值守的运行,或者去查一个反复出现的认证失败
最后这一步才是周报变得有用的地方。光有数字改不了工作流,一个具体的决定才能
6. 分享和采集要分开
Agent Island 用本来就存在机器上的会话记录构建本地报告。会话内容不会上传到 Agent Island 的服务,也不需要 Agent Island 账号
可分享的卡片是一份渲染出来的摘要,不是自动广播。复制或导出它是一个明确的动作。分享任何报告之前,先看一遍上面可见的模型名、日期、总量和项目上下文,确认没有你不想公开的信息
当前已验证范围
这里描述的周报与分享行为,在 Agent Island v1.7.1 的 macOS 上已验证。Agent Island 也提供 Windows 版本,但在没有当前界面验证之前,本页不声称那边有完全相同的报告卡界面
可以读 本地台账的工程笔记,或者核对 AI 编码成本追踪的测量合同
← 全部文章