数据与排序方法
公开说明一条热点从来源进入页面之前经历了什么。
最后更新:2026 年 9 月 9 日来源从哪里来
本站按优先级读取平台公开 API、同站点 RSS 和官网榜单页面。只有在主来源不可用时,才尝试经过登记的公开回退来源。来源名称和分类由本站维护的统一清单决定,RSS 等传输协议不会被显示成内容来源。
我们如何校验
每次刷新会检查标题、原文链接、抓取时间、排名连续性与重复项。缺少标题、没有直达链接或指向搜索结果的条目不会进入前台。缓存以完整快照替换,读者不会看到写到一半的数据。
- 链接
- 优先平台内原始详情页
- 时间
- 记录条目实际抓取时间
- 排名
- 保留各平台公开榜单顺序
- 失败
- 明确标记,不生成虚构数据
去重与热摸爽热度
综合流按规范化后的详情链接和标题合并重复内容。如果聚合回退来源与原站条目重复,优先保留原站直达条目,并记录合并来源。排序使用本站计算的“热摸爽热度”:37% 来自条目在原榜单中的相对名次,25% 来自独立来源共识,30% 来自内容时效,8% 来自来源权重。较旧内容还会按分类采用不同保鲜期和分档降权;在跨来源榜单中,同一来源连续占位过多和非中文内容也会被适当降权。
页面显示的热摸爽热度,会按照当前完整榜单的实际得分分布动态拉伸:低热度通常为数百,头部内容可以达到数千万,因此没有固定上下限。它用于表达一条内容在热摸爽当前观测范围内的相对关注程度,不是第三方平台公布的阅读量、播放量,也不代表真实参与人数。各平台原始指标只用于展示,不会被直接相加。
每次 Cloudflare 分片刷新只更新少量来源;未刷新来源保留上次有效条目和原抓取时间,失败来源也不会立刻清空。内容会随着时间自然降权,不同分类使用不同保鲜期,例如实时新闻衰减更快,AI、编程和知识内容保留时间更长。
历史快照与 AI 日报
实时热点每 30 分钟保存一次当日候选,每天上海时间 05:00 冻结过去 24 小时为不可覆盖的历史快照。每日总结按来源与分类多样性选取 15–30 条材料,再合并同一主语、同一时间的重复新闻,实际发布条数以整理结果为准:来源充足时至少覆盖 10 个来源、单一来源不超过 5 条;程序优先读取原始页面正文,无法读取时仅使用来源已经提供的标题和摘要,并在后台标记证据级别。
AI 只能为固定的热点 ID 返回摘要,摘要同时作为口播内容;标题、来源名称和链接均由程序从冻结快照回填。模型遗漏条目、增加条目、返回重复 ID 或摘要过短时,整期草稿都会被拒绝。草稿经人工核查来源后才公开。
趋势判定:升温、爆发与扩散
除了“现在有多热”,本站还记录“热度在怎么变”。每 10 分钟为一个观测时段,为最近 6 小时内仍在活动的事件保存一次热度、独立来源数、各平台名次与新加入的来源。变化幅度(velocity)是本时段稳定基础热度相对上一个时段的比例:0.3 表示上涨 30%。基础热度不会随本轮全榜的展示区间重新缩放;同一个时段内反复计算时基准也不变,因此显示的百分比不会因其他条目进出榜或采集轮次而凭空抖动。
“刚刚爆发”要求同时满足:首次出现不超过 24 小时、热度涨幅达到较高阈值、当前独立来源数达标,并且来源数相对上一个时段确实增长。超过 24 小时的旧事件再次变热只会记为“正在升温”,不会冒充刚刚发生;单个平台自己的暴涨同样不会被标成爆发。涨幅超过较低阈值记为“正在升温”,明显下跌记为“降温”,首次出现 60 分钟内记为“新出现”。全部阈值写在代码仓库的配置文件里,判定由程序按固定规则完成,不经过语言模型。
一个事件第一次被观测到时没有可比的上一个时段,此时变化幅度为空值,页面不显示任何百分比,也不会被判成升温或爆发。事件掉出榜单后不再有新观测,其变化幅度会被清空,不会继续挂在“正在升温”里。
事件页的扩散时间线只展示实际观测到的各来源首次出现时刻。观测记录不足两个不同时刻时整块不展示——我们不推测传播路径。若本站开始记录的时间晚于事件首次出现,页面会明确说明“自某时起有记录”。
已知限制
- 榜单衡量的是平台关注度,不等于事件的重要性或真实性。
- 平台接口、页面结构和反爬策略变化可能导致来源暂时缺失。
- 自动去重可能遗漏语义相同但写法差异很大的标题。
- 趋势判定依赖跨时段延续同一个事件的身份。代表标题变化很大时可能被当成新事件,从而重新计时;反之,用词高度重合的两件事也可能被并成一件,使涨幅偏高。
- 观测粒度是 10 分钟,比这更短的波动不会被记录;采集本身中断时,那段时间没有观测数据,扩散时间线会相应缺段。
- 实时内容可能触及敏感或受限主题;此类条目会被标记为不可自动投放广告,并进入人工复核范围。