53,489 部电影,
评分的差距藏在哪里?

此刻铺满屏幕的每颗光点,都是一部真实电影,共 加载中。这片星图背后,藏着两条差距:欧洲电影平均比其他地区高 --,老电影也普遍比新电影高——把分界年份在 1990 到 2020 之间随便挪动,分成“早”“晚”两半,早的那半总要高出 ----

这两条差距,单靠眼睛看不出来。差距藏在哪里?往下滑,一幕一幕找。

页面收录的电影上映于 加载中 年之间,每部都至少有 --为它打过分。向下阅读,光点会随故事重新列队。每一幕都可以亲手换条件、验数字,还能点开其中任何一部电影。

↓ 向下阅读 ↓
第一幕 · 地区与评分

欧洲电影分高,只是因为更老、更“文艺”吗?

先说欧洲。分数高,一个常见的解释是:欧洲片拍得早、剧情片多,占了好类型的便宜。这个解释经不经得起检验?办法很直接——让两边“拍得一样早、类型搭配一样”,再比一次平均分。

欧洲收录 -- 部,平均 -- 分。其余地区合计 -- 部,平均 -- 分,相差 --。让两边年代、类型完全对齐再比,欧洲仍高出 --——“拍得早、剧情片多”只解释了其中约 -- 分,五分之一。剩下的差距另有来历。

第二幕 · 类型与口碑

不同类型的电影,评分的形状一样吗?

第一幕留下的 0.40 分先按下不表——要找到它,得先承认“平均分”这个工具本身有盲区:它只报中心位置,盖住了分布的形状。粒子按主类型排成七列,每一列是一种类型的全部电影。点一个类型,它会点亮,线旁标出平均分与打分分歧,数据卡里还有低于 5 分的比例。

类型的评分形状差别很大。剧情片平均 6.94 分,打分分歧 1.13,低于 5 分的很少。悬疑/惊悚平均只有 5.96 分,超过五分之一的电影不足 5 分,分数散得开。只看平均分,会漏掉这一层。再交代两列的口径:「悬疑/惊悚」同时容纳恐怖片;「其他」收纳纪录片、动画与少量未标类型的条目,均分 7.57,是七列里最高的一列——它更像一个杂物抽屉,使用这根轴时应记得它的构成。

第三幕 · 传奇年份检验

1994 年真是“电影奇迹年”?

《肖申克的救赎》《这个杀手不太冷》《阿甘正传》都上映于 1994 年,单《肖申克的救赎》就有超过 250 万人打分——影迷把这个年份称作奇迹。粒子按年份展开,黄色点亮 1990 年代——拿整年的片单,验一验这个说法。

1994 年收录 --电影,平均 -- 分,8.5 分以上占 --,九十年代其余年份是 --——按高分占比,1994 略高一线;换回平均分,又比其余年份略低一线。两个方向都只差一丝。奇迹感来自少数被反复重温的经典。放回整个年份里,1994 年和其他年份几乎站在同一条线上。

第四幕 · 年度比较

哪边电影分更高,是早就定下的吗?

第一幕把所有地区合在一起比,这里换一个更细的问法:同一个年份内部,北美(蓝色)与东亚+华语区(红色,合并日韩与两岸四地)谁高谁低?很多人心里都有现成答案,而且以为答案不会变。把镜头拉近到单个年份,答案开始晃动:拖动年份,亲眼看着它变。

2011 年,东亚+华语区收录 -- 部,平均 -- 分。北美收录 -- 部,平均 -- 分——东亚组减北美组,得 --,肉眼分不出高低。这条分差随年份来回改写:有的年份贴到 0 附近,有的年份拉开到半分以上,1990 到 2020 年间共换过 -- 次方向——其中两次只是分差贴着 0 的轻微抖动。挑任何一年下结论,都容易把巧合当成格局。

第五幕 · 语言构成

“世界电影”的语言,很多元吧?

按理说,银幕上的世界应该百花齐放。粒子换成五个语言组,排成五列:蓝色英语、绿色欧洲语言/其他、红色普通话、金色方言/混合语种、青色日语/韩语,五条基准线各自标出平均分,谁高谁低一眼可辨。

英语组有 -- 部,占 --。把它和「欧洲语言/其他」加在一起约六成,普通话、方言/混合语种与日语/韩语分掉其余四成——银幕上的语言,没有看上去那么多元。日语与韩语这次单独成组:9,071 部,平均 7.05 分,均分在五组里排第二,仅次于欧洲语言/其他;无对白与未细分语言仍留在「欧洲语言/其他」组。点单列可逐组细看,点「全部」回到五列同屏。右上角的按钮可收起文字,看完整的星空。

第六幕 · 分界线实验

老电影分高,是那个年代出好片?

顺着常识,答案似乎是“黄金年代拍得更认真”。但还有另一种解释:能被今天观众看到的老电影,本来就经过了几十年的挑选。拖动分界年份,把电影分成“早”“晚”两半对照——蓝色较早,橘红较晚,两半始终同屏。

以 2010 年为界,此前 -- 部,平均 -- 分,此后 -- 部,平均 -- 分。把分界年份从 1990 一路挪到 2020,早的那半始终高出 ----。差距最大的地方在评分表底端:1990 年以前的电影,低于 5 分的只有 --。2010 年代每 7 部就有 1 部(--)。新片里的烂片还在榜上,老片里的烂片多半已少有人问津——“黄金年代”的传说,可能有相当一部分是遗忘帮忙写的。这是一个与留存过程相符的解释;单次截面数据无法直接验证电影如何随时间退出视野。

第七幕 · 分布下限

欧洲电影分高,靠的是神作多吗?

现在回到第一幕按下的 0.40 分。点开一个地区(当前地区绿色点亮),三个数见分晓:后四分之一的电影从几分起步,中间位置在哪,低于 5 分的占多少。

欧洲 --电影里,后四分之一从 -- 分起步。其余地区的同一档,从 -- 分起步。最扎眼的差距在低分一段:欧洲只有 -- 的电影低于 5 分,约每 40 部才 1 部,其余地区是 --,约每 10 部就 1 部。欧洲的优势,更多来自把烂片的比例压到很低——下限稳了,平均分自然被抬上去。另需交代一句口径:豆瓣的宽口径把电视特别篇、演唱会与纪录片也计入地区比较,这类条目评分普遍偏高,欧洲又尤其多——下限稳的优势里,也有它们的一份。

第八幕 · 华语组内比较

方言电影,分数会更低吗?

印象里,方言片似乎更“偏门”。先把范围收小,只看华语片:亮蓝色为普通话电影,金黄色为方言/混合语种电影,切换年代,看两边谁高谁低。值得先交代一句:这个“方言组”并不小众——粤语港片、多语合片都在其中,它的平均评价人数居五个语言组之首。

全部年份合在一起算:方言/混合语种 -- 部,平均 -- 分。普通话 -- 部,平均 -- 分——方言/混合语种组高出 --。拆开年代,答案会翻面:九十年代方言组--,2010 年代--。这条分差从 -- 走到 --,整整调了个头。原因在低分一段——这十年里超过三分之一的普通话电影低于 5 分,把两组的位置整个拽了过来。一个总平均,就这样把两个相反的故事抹成了同一行数字。

终章 · 回到具体电影

那么,差距究竟是哪里来的?

差距主要藏在评分表的下端:老电影和欧洲电影里,低分的更少,这与“好片被反复重温、烂片被慢慢忘记”的留存过程相一致。粒子回到星云,蓝色北美、绿色欧洲、红色东亚、黄色中国大陆、青色港澳台,每颗光点都在等你点开。

点一颗粒子,或按“随机打捞”让数据替你挑一部。每一幕的条件都还在原处,随时回去换个问法再问一遍。统计给出结构,电影给出体温。

自由打捞:从统计集合回到电影

探索舱收录了这次分析的全部 加载中 部电影。组合年代、地区与语言后,页面会告诉你还剩多少部电影,并分页列出来。点击任意一部,可以核对简介、评分、评价人数与来源记录。

电影详情

剧情简介

导演
类型
制片国家/地区
语言
评价人数
分析分类
数据来源
数据集 ID
查看来源记录