#豆瓣评分##电影##电影市场观察##豆瓣#
豆瓣评分,我只看队形,不看分数 [doge]
我从 2014 年开始折腾投影,养成一个改不掉的毛病:看参数永远不看单个数值,看曲线。
对比度看的是明暗分布,亮度看的是增益曲线,色准看的是灰阶走向——单个数字会骗人,曲线的形状不会。
后来我发现,看豆瓣也是这个道理。
先说结论:
豆瓣分数是群众口碑的均值,队形才是群众口碑的结构。专业评价是另一套坐标系,三者经常不商量。
单看那个数字,你会错过一半信息。
先放两组数据。
《肖申克的救赎》,9.7分,常年坐在豆瓣第一把交椅上,评分柱状图是教科书级的F型——五星铺天盖地,一星几乎绝迹。
《富春山居图》,3.0分,柱状图是另一种教科书,一星占了大半个江山,水军和粉丝合力都救不回来的那种。
同样是两个数字,一个9.7一个3.0,中间隔着的6.7分里,藏着的其实是两类完全不同的"人群共识"。
【队形学:五种形状,五种人群动力学】
豆瓣评分的分布,公开流传的说法大致分五种形状:F、P、b、C、L。
形状的差异,本质上是打分人群结构的差异——谁在打分、为什么打,比打了多少分更重要。
F型,传世好片。
五星最多,逐级递减,一二三星几乎没有。《霸王别姬》《肖申克的救赎》都是这个形状。
F型意味着什么?意味着各路人马罕见地达成了共识——文青、路人、院线观众、多年后补课的人,全给五星。
这种共识极其昂贵,因为它没法靠水军刷出来:水军只能把五星堆成C型,堆不出F型。你想想,为什么?
P型,一般好片。
四星居多,三星五星各有一部分,一星二星几乎没有。《烈日灼心》《战狼2》《湄公河行动》都在这个区间,分数大体8分上下。
P型是"大家都觉得不错,但没到愿意跪下打五星"的形态。注意,一星二星几乎为零,这一点很关键——它没有真正激怒过谁。
b型,一般烂片。
和P型镜像,一星二星三星居多,四星五星几乎绝迹。分数4到6分。《栀子花开》是这个形状。
这类片子的群众口碑非常诚实:无聊,但无聊得不够彻底,还没烂到人人想打一星泄愤。
C型,奇葩电影。
这个形状最有意思——五星和一星都很多,中间几乎空掉,像两拨人隔着河对骂。
发生什么了?粉丝/水军打五星,被激怒的普通观众打一星,双方互相觉得"我必须拉一下这个分"。
所以C型是失真最严重的形态,分数不代表质量,代表战争烈度。
今年最教科书的案例是《牛来》——35.8% 的五星和 37.8% 的一星几乎平起平坐,中间三星加四星加起来只有 16.9%,硬生生把分数拉到了 5.9 这个"虚假的中间值"。
所以看到 C 型,别急着下结论——先翻翻短评,搞清楚那 35.8% 的五星到底是真的喜欢还是反讽玩梗。
L型,绝世烂片。
一星占据压倒多数,一边倒,水军都救不回来。《富春山居图》《恶棍天使》是这种。
L型的群众口碑是彻底崩塌的,连利益相关方都放弃了治疗。
【三个坐标系,别指望它们互相换算】
群众口碑、专业评价、票房,是三套独立坐标系。硬要互相换算,就会得出很多离谱结论。
群众口碑,就是豆瓣分数本身。
它是大样本的均值,样本越大越诚实。豆瓣那套防水军机制,加上动辄几十万人的样本量,决定了均值很难被长期操纵——
《三生三世十里桃花》粉丝锁场刷分,一度冲上5分,尘埃落定还是4.0;
《大护法》上映初期被一星围攻,照样靠质量爬回7.9。
而《牛来》反向操作——大量反讽式五星和真心一星打得有来有回,把分数稳定在 5.9,粉丝和水军都救不了它,也毁不了它。
水分是暂时的,样本是长期的,均值会回归。
专业评价,是另一套坐标系。
它评价的不是"好不好看",是电影语言、美学、叙事结构。
欧洲三大电影节的获奖片,在豆瓣常年7分上下晃悠——不是群众瞎,是两边用的尺子不一样。
最有意思的反例是《肖申克的救赎》:当年奥斯卡7项提名颗粒无收,全输给《阿甘正传》。
可群众用时间投了票,几十年过去,它成了豆瓣和IMDb双料第一。
专业评审当年看走眼了吗?看走眼了,群众口碑替它翻了案。
票房,是第三套。
它是商品属性的成绩单,和口碑可以完全脱钩。这里就不展开骂了,大家都懂。
【所以,分数怎么用?】
我的习惯是三步:先看队形,再看分数,最后才看短评。
队形告诉你人群结构,分数告诉你均值,短评告诉你到底发生了什么。顺序反了,容易被单个数字带偏。
另外,数字和形状都只能帮你做筛选,不能替你做选择。
F型可能不对你胃口,L型可能恰好挠中你的恶趣味——这很正常。
9.7分的神作你看着打瞌睡,2.2分的烂片你笑出腹肌,都是合理的观影体验。
别被"权威"绑架,也别被"共识"压垮。
分数是别人的平均值。看片是自己的事。
无聊的人生,我死也不要;无聊的评分,我只看形状。
