《红色沙漠》在Metacritic上的媒体均分停在77分。这个分数不算差,但离年度游戏候选差得远,更谈不上什么"神作"。有意思的是,分数一出来,媒体和玩家之间就有点对不上了——打低分的评测在抱怨"叙事深度不够""系统太多太散",而玩家社区那边,反而挺喜欢这种把不同类型揉在一起的沙盒。
这种分歧其实不新鲜。媒体和玩家为游戏吵架,几乎每次大作发售都要来一轮,有时候还没发售就先吵上了。但这次不一样的地方在于,Pearl Abyss的一位高管出来给了一个自己的解释。
CEO的说法:评测用的不是发售版本
Pearl Abyss欧洲CEO Lybee Park在接受The Game Business采访时说了一句话,大意是:我觉得双方都有道理,尤其是媒体那边。他们拿到的版本和发售版本并不完全一样,而且时间也有限。通常评测游戏的经典做法是跟着主线任务走,但《红色沙漠》的独特魅力是散在整个游戏世界里的——那些藏起来的小细节,那种可以超出常规预期去探索的自由。
这段话其实点出了一个挺现实的问题:评测流程本身是有约束的。
Park提到,评测版本不包含首日补丁,媒体玩到的版本,和后来修了一堆社区痛点热修的版本不是同一个。另外,评测还有截稿时间。这话说得挺实在——做评测的人不是整天坐着打游戏,通常要一边评测一边处理别的事,两周的期限摆在那,想慢慢逛地图基本不现实,有些部分可能得赶着打完。
用没有首日补丁的版本、顶着截稿压力去玩《红色沙漠》,再加上Pearl Abyss这个开放世界的体量本身就大,评测分数受影响,在Park看来是说得通的。他接着说,那些独特的部分、那些有意思的新东西,我不认为媒体在评测期里有公平的机会去探索和体验。
但这个解释站得住吗?
先把Park的话放在一边,看看反方会怎么说。
关于"游戏需要首日补丁才能跑到最佳状态"这件事,本身就有很多可聊的。就算那些打低分的媒体有充足时间在Pywel大陆上闲逛,也不代表他们一定会给更高的分数。说不定逛得越久,他们对游戏的那些意见反而越强烈。
这个反驳其实挺关键。Park的逻辑是"时间不够+版本不同=分数偏低",但这条因果链并不是必然的。评测者抱怨的"系统太多太散",可能恰恰是玩得越深越明显的毛病,而不是玩得不够久造成的误判。换句话说,给更多时间,问题可能被放大,而不是被消解。
所以这里其实有两套逻辑在打架:
- 一方认为,评测机制本身有结构性缺陷——版本不同步、时间不够、只能跟主线走,这些都会让开放世界游戏吃亏。
- 另一方认为,分数低就是分数低,时间再多也改变不了核心体验上的问题,甚至可能更糟。
两边都不是没道理。评测确实有它的局限,这一点做媒体的人自己最清楚。但"评测有局限"和"这个游戏被低估了"是两回事,不能直接划等号。
Pearl Abyss没有把批评当耳旁风
值得注意的是,Pearl Abyss并没有对批评置之不理。免费的Crimson Desert Enhanced更新加入了新的剧情片段和对话,加上发售后几个月的持续改进。另外,即将到来的Charting the Unknown扩展内容定在10月29日上线。
这个动作本身说明了一些东西。如果厂商真觉得"都是评测机制的锅",那大可不必在发售后花几个月去补剧情、改体验。愿意动手改,至少说明那些批评里有一部分是被听进去了的。
当然,这也不代表Park的解释就是错的。两件事可以同时成立:评测机制确实对这类开放世界不够友好,同时游戏本身也确实有需要修的地方。
77分到底意味着什么
把数据摆出来看会更清楚。OpenCritic上,《红色沙漠》的顶级媒体均分是79/100,媒体推荐率75%。Metacritic那边是77分。两个平台的数字接近,说明这不是某一家媒体的极端评价拉低了平均,而是整体上媒体给出的就是"中上但不惊艳"的判断。
游戏在2026年3月19日发售,由Pearl Abyss开发并发行,类型是动作、冒险、开放世界、探索,ESRB评级为Mature 17+,涉及血液、药物指涉、强烈暴力和粗口。
TheGamer给了它四星,夸的是"庞大而美丽的世界"和"流畅的战斗"。这也说明媒体内部并不是铁板一块——有人打低分嫌它散,也有人给好评夸它大而美。
玩家和媒体的分歧,到底该怎么看
回到最开始那个问题:媒体77分,玩家却爱玩,这矛盾吗?
其实不太矛盾。媒体评测和玩家体验,本来就是两种不同的场景。评测是在有限时间里、按某种相对标准化的路径去完成一款游戏,然后给出一个可比较的分数。玩家是自己花钱买的,想玩多久玩多久,想干嘛干嘛,玩到哪算哪。这两种场景下,同一款游戏呈现出不同的面貌,很正常。
《红色沙漠》这种把不同类型混在一起的沙盒,恰恰是最容易在这种差异里"吃亏"的类型。它的乐趣是分散的、需要自己去发现的,而不是集中在一条主线上等着你走完。这种设计对评测流程不友好,但对愿意自己找乐子的玩家来说,可能正好对胃口。
但反过来也得说,不能因为"玩家喜欢"就否定媒体的批评。那些说"系统太多太散"的评测,指出的可能是真实存在的设计问题,只是这些问题对不同玩家的影响不一样。有人觉得散是自由,有人觉得散是没重点,这本身就是口味问题,不是谁对谁错。
Park的解释提供了一个视角:评测机制确实有它的结构性限制,尤其是对开放世界游戏。但这个视角不能用来把所有批评都挡回去。Pearl Abyss自己也没这么做——他们选择了在发售后继续改。
所以这件事的结论可能没那么戏剧性:77分是一个在特定条件下得出的分数,玩家的喜爱是另一种条件下的真实反馈,两者都成立。至于哪个更接近"真相",取决于你是那个赶着截稿的评测者,还是那个周末窝在沙发里慢慢逛地图的玩家。
热门跟贴