Benchmark Radar 第十天:AI 简报、GPT 洞察与发布准备
Published:
雷达开始说话了。第十天加入了 AI 生成的每日简报、GPT 驱动的洞察分析,以及面向中文社交平台的发布文案。
今日交付
有界的每日 AI 简报。 新功能从雷达的发现中生成每日简报。简报受到 token 预算约束,不会在句子中间被截断。
GPT 雷达洞察。 由 GPT 生成的、带证据支撑的洞察,每条声明都链接到具体的证据来源。简报包含时间采集上下文(数据何时采集、覆盖什么时间窗口)。
OpenAI 速率限制处理。 OpenAI API 的速率限制错误现在会被诊断并通过指数退避重试。截断的 API 错误响应被妥善处理,不会导致流水线崩溃。
Token 预算适配。 洞察包被适配到 token 速率预算,防止在 API 边界被截断。
简报证据链接。 首页简报现在链接到引用的证据。证据详情默认折叠,保持页面可扫读。
每日发现排名。 发现按照读者能从中获取多少新信息来排名,而不仅仅按时间排序。选择漏斗中最大的损耗被标注出来。
符合条件的记录保留。 低于推荐阈值的记录如果满足资格条件也会被保留,防止不必要的数据丢失。
全局观察渲染有界。 跨整个归档的观察渲染现在受到限制,防止性能问题。
扫描日期过滤修复。 过滤器现在允许显示所有日期,而不是只能逐个选择。
URL 参数修复。 自动前沿信息被排除在分享 URL 之外,避免让接收者产生困惑。
发布文案。 为中文社交平台起草了发布帖文。小红书草稿配上了适当的分数说明,已可发布。
为什么重要
每日简报是第一个不需要打开仪表盘就能阅读的人类可读输出。它把雷达从一个你需要主动去访问的工具,变成了一个会主动来找你的工具。GPT 洞察层在数据之上增加了解读:不只是”采集到了这些基准”,而是”这里发生了什么变化,为什么这很重要”。
速率限制处理是生产环境的必需品。OpenAI API 有每分钟的 token 限制。没有重试逻辑的话,一次速率限制错误就会搞垮整个每日简报运行。
解决的问题
- #121:有界的每日 AI 简报
- #125:连接器失败时来源面板折叠
- #126:Semantic Scholar 搜索请求修复
- #128:在仪表盘上持久化每日简报
- #130:计算每日发现
- #131:按学习价值对发现排名
- #132:URL 和过滤器修复(#123, #129)
- #133:标注最大漏斗损耗
- #135:保留符合条件的记录
- #136:在每日发现中标注证据
- #138:GPT 雷达洞察
- #139:OpenAI 速率限制处理
- #140:Token 预算适配
- #141:简报输出截断修复
- #142:简报证据链接
- #143:折叠简报证据详情
第十一天:KW-Bench 能力层与社区发布。
