热点是怎么“传开”的?我们盯了 24 天的 10 分钟数据

想看热点怎么传开,近八成事件却在首次入榜时就已有多个来源。二十四天记录里,能看到过程的那批约一小时达到三个来源;“慢热更长寿”的数字,还藏着一个筛选条件。

热摸爽9 分钟阅读2 次浏览

热点凑够 3 个来源的累计占比

我们想看看,一条热点是怎么从一个来源,传到三四个来源的。于是翻了二十四天的记录,每十分钟一份。

能观察到的那一部分,中位用时约一小时。

问题是,近八成达到三个来源的事件,第一次进入这份记录时就已经有三个以上来源。我们本来想看热闹怎么起来的,结果到场时,围观群众已经站好了。

每十分钟看一眼,我们看到了什么

项目

内容

数据时间范围

北京时间 2026-09-08 08:00 至 2026-10-02 12:30,约 24 天

样本数量

3,438 个 10 分钟趋势桶;4,642 个事件,其中首尾各留 3 小时缓冲后,完整观测的有 3,998 个;达到 3 个及以上来源的“跨平台事件”有 2,043 个

数据来源

热摸爽存放在 Cloudflare R2 的 10 分钟趋势桶(trend/buckets),每桶记录当时热度前 300 的事件及其来源数、名次;另引用热摸爽第 37、38 周周报

计算方法

首次露面 = 事件第一次出现在某个桶里;扩散用时 = 来源数第一次达到 3 个的时间,减去首次露面的时间;存活 = 最后一次出现减首次露面

表里的“桶”,就是每十分钟保存的一份记录,只收当时热度前300的事件。本文把达到三个来源叫作“跨平台”,它是这次统计的门槛,不代表已经传遍互联网。

大多数事件入场时,已经不是一个来源了

首次露面时的来源数

事件数

占完整观测事件

后来的去向

1 个

551

13.8%

83 个(15%)拿到第 2 个来源,17 个(3%)凑够 3 个

2 个

1,836

45.9%

415 个(23%)凑够 3 个,59 个(3%)到 5 个

3 个及以上

1,611

40.3%

已经跨平台,无从观察扩散过程

两千多个达到门槛的事件里,一千六百多个首次被记录时,就有至少三个来源。只有剩下的四百多个,让我们看到了从一两个来源增加到三个的过程。这里的起点是第一次进入前300,并不是事件真正发生的时间。

第一次被记录时只有一个来源的事件,后来约3%达到三个;起步有两个来源的,约23%达到了门槛。两组差得很远。我会更留意第二个来源有没有出现,但不能据此说,给它添一个来源,就能把传播概率提高七倍。

那四百多个“赶上了开头”的事件

凑够 3 个来源的累计占比:30 分钟 37.0%,1 小时 53.7%,3 小时 80.8%,12 小时 96.8%

用时

累计占比

10 分钟内

14.4%

30 分钟内

37.0%

1 小时内

53.7%

3 小时内

80.8%

12 小时内

96.8%

24 小时内

98.8%

这组事件过半在一小时内达到三个来源,八成在三小时内,九成约六小时。超过十二小时的只有十四个。对它们来说,上午刚看到的消息,到午饭时可能已经不止一家在说了。

在后来还达到五个来源的那部分事件里,从三个增加到五个,中位用时约二十分钟。看起来后半程更快,不过这已经筛掉了停在三四个来源的事件,不能把这二十分钟套到所有热点上。

凌晨的热点,也有点困

按首次露面时间段分组的扩散用时中位数:0–5 点 220 分钟,6–11 点 40 分钟,12–17 点 60 分钟,18–23 点 50 分钟

首次露面时间

事件数

用时中位数(分钟)

P25–P75(分钟)

0–5 点

40

220

60–450

6–11 点

159

40

20–110

12–17 点

131

60

30–150

18–23 点

102

50

30–150

白天几个时段达到三个来源,中位用时约四十到六十分钟;凌晨零点到五点首次被记录的那组,约三个半小时。消息倒是没睡,后面跟进的节奏慢了不少。

夜间编辑和账号跟进减少,是一种可能解释;内容类型和抓取节奏也可能有影响。这组只有四十个事件,我暂时只把它当作时段差异,不急着给夜班编辑开考勤单。

慢热的留得久?这张表得多看一眼

按扩散用时分组的存活中位数:30 分钟内 11.2 小时,30 分钟至 3 小时 12.7 小时,3 至 12 小时 20.8 小时,超过 12 小时 87.0 小时

凑够 3 个来源的用时

事件数

存活中位数(小时)

峰值来源数中位数

30 分钟内

160

11.2

3

30 分钟–3 小时

189

12.7

3

3–12 小时

69

20.8

3

超过 12 小时

14

87.0

3

半小时内达到三个来源的事件,首次到末次被记录的跨度中位数约十一小时。等了十二小时以上才达标的那组,约八十七小时,差了近八倍。乍看很像“慢热更耐活”,但这里有个容易漏掉的条件。

一个事件要等十二小时才达到门槛,首次到达标的记录跨度就已经至少十二小时了。很快消失的事件,根本进不了这组。拿这组证明“传得慢,所以活得久”,有点像只在长跑终点采访,再感慨大家体力都不错。

而且最后一组只有十四个事件,各组峰值来源数的中位数又都是三个。我更愿意把这张表理解成不同传播节奏的记录,还不能据此断定哪种节奏更有生命力。这里的时长是首次到末次出现的跨度,也不保证期间一直在前300。

哪家先被我们记录到

十分钟记录没有保存来源名字,因此这一节改看热摸爽周报。它按内部记录中最早出现的来源统计,能说明热摸爽先看到了哪家,不能直接当成新闻首发榜。

最早记录到的来源

第 38 周(735 个跨平台事件)

第 37 周(395 个)

网易新闻

22.4%

26.8%

东方财富

12.1%

—

36氪

9.3%

—

新华网 / 新华社新闻

8.4%

16.2%

抖音

7.5%

—

腾讯新闻

3.1%

8.6%

网易新闻两周都排第一,占两到三成。有意思的是,第 38 周里抖音最早被记录的占了 7.5%,第 37 周却没进前八。表里的“—”是该来源没进当周前八,不是 0。

周报还给了几个最快的例子。最早在36氪被记录的“中国证监会拟对17起案件线索的‘吹哨人’给予奖励”,4 分钟凑够 3 个来源,后来涨到 7 个。最早在今日头条被记录的“中国足球小将西班牙捧杯”和最早在金融界被记录的“广汽集团回应紧急停牌”,都是 5 分钟。

同一件事,两只秒表

把十分钟记录和周报放在一起核对,有些数字对不上。

周报里“美联储宣布加息25个基点”(网易新闻最早被记录)的扩散用时是 1275 分钟,也就是 21 个小时。可桶里显示,它第一次露面时就已经有 18 个来源。“[流言板]亚运会半决赛:中国男篮77-97惨败日本”也一样,周报写 270 分钟,桶里第一次露面就有 14 个来源。

我们没有查清原因。一个合理的解释是:周报用的是事件在内部状态里的最早出现时间,那时它排名很低,不在前 300,等冲进前 300 已经传开了。也不排除聚类把更早的相关报道并了进来。

两只秒表不一定从同一刻开始计时。我的判断是,这两套记录应该分别解释,不能把周报里的四分钟和这里的一小时排在一起,得出谁传播得更快。

我们这次漏掉了什么

没进前300的事件不在记录里。已经达到三个来源才进榜的事件,也没法补出之前的过程。因此这里的一小时,只对应那四百多个从不足三个来源增长到达标的事件,不代表全部事件的传播速度。

记录每十分钟一份,“零分钟”只能说明同一份记录里已经达标,不能证明瞬间传开。期间还有十八处断档,最长三小时,首次出现和达标时刻都可能晚于实际情况。

事件由聚类识别:换了标题可能被拆开,相关报道也可能被并到一起。首尾各留三小时缓冲,能减少边界影响,但不等于所有传播过程都已完整记录。

热摸爽怎么用这个

热摸爽每 10 分钟记录一次热度和来源数。“刚刚爆发”要求首次出现不超过 24 小时、涨幅够高、来源数达标,而且来源数比上一个时段确实增加。只有单个平台自己暴涨的,不会被标成爆发。

扩散时间线只展示实际记录到的来源出现时刻。不足两个不同时刻,就不展示。我认为这个取舍应该保留:近八成事件进榜时已经有多个来源,硬画出一条传播路线,看着很专业,实际上是在替没看到的部分写剧本。

一小时之后,我们到底能说什么

能看到从一两个来源增至三个的那批事件,中位用时约一小时。但更多事件第一次入榜时,就已经有多个来源了。前者是我们赶上了的过程,后者只能看到结果。

我现在会先看一条消息有没有新的独立来源跟进,再看它用了多久。名次突然变高、来源数增加,都值得留意;“已经传遍全网”这句话,还得另找证据。

研究传播,最怕把自己到场的时间,当成事情开始的时间。热点可不会等统计的人打开表格,再喊一声:好了,现在开始热。

关于本文数据

数据范围
2026-09-08 ~ 2026-10-02
数据来源
热摸爽 Cloudflare R2 的 10 分钟趋势桶(trend/buckets),3,438 个桶;引用热摸爽第 37、38 周周报
样本数量
4,642
统计方法
首次露面=第一次出现在热度前300的十分钟记录;本次以来源数≥3为跨平台门槛。扩散用时=首次达到3个来源减首次露面,仅统计首次来源数<3且后来达标的432个事件。存活时长=末次出现减首次出现,是记录跨度,不保证连续在榜。首尾各留3小时缓冲后样本3998个,不能保证全程观测。记录有18处断档;周报最早来源指内部观测,不等于新闻首发。

了解热摸爽的数据与排序方法