Benchmark Radar 第二十九天:发布先于更新、0 到 1 读作 0 到 100、高亮始终可见

less than 1 minute read

Published:

新东西该在第一页,而不是藏在第三页。第二十九天我们做了三件事:让新发布排在例行更新之前,把 0 到 1 的分数按 0 到 100 来显示而不断点,让当前栏目始终看起来是选中的。先说几个词:发布是全新冒出来的基准;更新是对已有条目的改动,例如版本升级或新增分数;0 到 1 与 0 到 100 可以是同一数值的两种刻度。

作者:Koutian WuGitHub: ktwu01

PR #349 把三处关联修复合成一次发布。第一是排行榜的显示换算。抓来的 llm-stats 分数存为 0 到 1,例如 0.72,而站内其余处都说 0 到 100。图的几何本来就是对的,只是标签与提示按 100 倍读错了。现在显示层乘 100,0.72 读作 72,存的值与点的位置都不动。在 0 到 100 的轴上读 72,仍是原来那个点。

第二是排序顺序。雷达原来把新鲜发布与例行更新按同一套时效混排。现在发布排在更新之前,且在发布内部按新鲜度分层,让最鲜的直达第一页。实现上对当天发布按龄分级,今天发的基准即便相关性相近,也排在两周前发的前面。以前一个新发布可能被一串老基准的更新挤到第三页,现在第一页先回答今天新出现了什么,再说今天什么变了。

第三是每日简报的选材。每日简报是 GPT 按当天证据写的短总结,以前读未排序的证据,且会被一次类别构成的负向检查否掉,于是某类基准占多数的日子,恰好会压掉排名已顶到前面的新发布。现在它读发布优先的已排序证据,那次构成检查不再否决发布级的洞察。标题与排名因此读同一份有序清单。

同一个 PR 还让站点安静下来。修掉横向溢出,窄屏不再左右晃;弱化分割线,去掉全大写标签与装饰性笑脸。图上破纪录的点放大到 1.5 倍,不在线上的点不再默认淡化到看不清,静置时也保持可读。

PR #350 修了导航高亮。以前只有部分栏目看起来是选中,因为 Today、Leaderboard、Trends、Explore 与 Rubric 弹窗各自用了略有不同的类或依赖不同属性。现在五处共用同一个高亮类,并为路由视图与 Rubric 弹窗补齐 ARIA 语义。关闭 Rubric 会恢复底下视图的状态,关后高亮的就是你真正回到的视图。并为锚点、按钮与弹窗状态补上回归用例。

为什么要在意

发布先于更新,改变了第一页的含义。第一页该回答今天新来了什么,而不是今天什么被小改了一下。按新鲜度分层让新鲜本身成为排序输入,而不是靠你记得去设筛选。

把 0 到 1 按 0 到 100 显示而不挪点,让存储与画面一致。值本来就是对的,只是标签差了两位小数。修标签不动几何,避免无声重写历史。

看起来不选中的导航,等于没选中。如果高亮与屏上视图错位,或在弹窗后忘了你从哪来,你就不再信这套外框。一个共用高亮类加上弹窗后的状态恢复,让高亮在每一步都对得上视图,包括关掉什么之后。

解决的问题

  • #341:抓来的 0 到 1 分数按 0 到 100 显示
  • #333:发布排在更新前,最鲜的一档直达第一页
  • #332:去横向溢出、弱化视觉、破纪录点 1.5 倍
  • 简报改读发布优先的已排序证据,不再被类别构成否决
  • #350:五处导航共用高亮类、带 ARIA 与 Rubric 恢复

第三十天:给每张卡片配一句可扫读的发布摘要。