一周的 Claude Code 和 Codex 工作会在本地留下足够的痕迹,能回答几个具体问题:会话何时活跃?哪些供应商产生了活动?哪些模型出现?每日 token 结构如何变化?但它无法证明代码是否正确、这周是否有产出、API 估值是否等于实际花费。正是这个边界让周报有用。
使用本地日历日:周报应覆盖今天加之前六个本地日历日。标题、每日柱状图、供应商总计和模型行必须使用相同的边界。若图表用日历日而模型行用滚动 168 小时窗口,各部件会不一致,一行可能超出标题,即使每个单独计算都看似合理。时区和午夜行为是核算规则。
token 总量描述活动:输入、输出、缓存创建和缓存读取代表不同工作。建议保留两个总量:wire token 总量(包含本地记录的所有分类)和输入/输出总量(排除缓存流量)。两者都不是生产力分数。缓存密集的重构可能比小改动移动更多 token;一次失败运行可能很昂贵;安静的会话可能是在等人而非空闲。
比较供应商时不制造等价:供应商拆分能显示多少记录活动来自 Claude Code、多少来自 Codex,但无法证明每个供应商的一个 token 代表同等的工作、延迟、质量或配额压力。供应商配额是报告状态,本地 token 活动是重建的账本。显示两者没问题,用一个填补另一个的缺失数据则不行。
每个事件保留模型上下文:一个会话可以切换模型。后面的 token 事件需要当时活动的模型上下文,而非文件顶部显示的模型。未知命名的模型应保持可见且无定价。猜测相近模型家族会让历史报告不可审计。token 排名和 API 估值排名也不同:一个模型可能因大量廉价缓存读取而数量领先,另一个则因估值领先。
五分钟周回顾:用周报做一次操作决策——检查七天是否齐全,寻找缺口、重播峰值或过期供应商数据;比较供应商和模型组合而不将其视为质量;仅在显示的费率日期下阅读预估 API 值;为下一周写一个工作流变更,例如减少无人值守运行、修复重复身份验证失败或更改开始长会话的时间。数字本身不改进工作流,决策才改进。
分享必须是单独操作:本地报告默认应留在本地。Agent Island 从已存储在机器上的记录构建报告,内容不上传到其服务。可分享的卡片是渲染摘要而非自动广播,复制或导出需要显式操作。分享前检查日期、总量、模型名称和项目上下文,排除任何不愿披露的信息。
一份周报通过说明每个数字的含义及其不能证明什么来赢得信任。完整工作流与当前验证范围见规范指南。
#开发者 #工具 #AI编码 #周报 #活动日志 #Claude #Codex #AgentIsland
@DevToolboxHub