Overall Score / Grade
89.6 — B+
是什么 Game Rating Calculator?
▾
游戏评分计算器应用加权评分系统来评估多个类别的视频游戏,产生反映整体质量的单一综合评分。加权系统不是平等地对待游戏的各个方面,而是让评论者和玩家更加重视他们最关心的维度。例如,注重叙事的审稿人可能会将故事和写作的权重设为 30%,而将图形的权重仅设为 10%,而竞争性的游戏玩家可能会优先考虑游戏机制和网络代码。 核心公式将每个类别得分乘以其权重求和,然后除以总权重,将结果标准化到一致的范围(通常为 1-10 或 1-100)。这反映了 Metacritic、OpenCritic 和 IGN 等专业媒体所使用的方法,每个媒体都会汇总评论家的分数,有时会应用自己的内部权重来考虑媒体的可靠性或评论的新近度。 典型的评级类别包括:游戏玩法(控制、深度、平衡)、图形/视觉、音频/配乐、故事/叙述、可重玩性、性能/优化和物有所值。 Steam 和 Metacritic 等社区驱动平台的用户评分允许玩家提交自己的评分,然后进行汇总。了解这些系统背后的数学原理有助于消费者批判性地解读评论分数。一款 Metascore 为 74 分的游戏可能会在发布当天因技术性能问题而获得近乎完美的游戏评分,而不是代表一款平庸的产品。了解权重的分配方式可以让您在做出购买决定之前根据个人优先事项重新衡量分数。
Calkulon makes complex calculations simple — built for students and everyday problem-solvers.
公式
▾
加权分数 = sum(category_score_i * Weight_i) / sum(weight_i)
其中每个变量代表健康和医疗领域中的特定可测量量。替换已知值并求解未知值。对于多步计算,首先计算内部表达式,然后使用标准运算顺序组合结果。变量说明
▾
| 符号 | 名称 | 单位 | 描述 |
|---|---|---|---|
| S_i | 类别得分 | points (1-10) | 以安培为单位测量的电流,代表电荷通过导体的运动速率,并确定热效应和磁场强度 |
| W_i | 类别权重 | percent or decimal | 以指定单位测量的受试者的体重或质量,作为依赖于物理质量(例如剂量、结构负载或能量消耗)的计算的主要输入 |
| WS | 加权分数 | points (1-10) | 以指定单位测量的受试者的体重或质量,作为依赖于物理质量(例如剂量、结构负载或能量消耗)的计算的主要输入 |
| n | 类别数量 | count | 应用计算的时间段数(年、月或其他间隔),确定复利、摊销或计量的持续时间 |
如何 Game Rating Calculator
▾
- 1确定与游戏类型相关的评级类别(例如游戏玩法、图形、音频、故事、可重玩性、价值)。
- 2为每个类别分配一个反映其重要性的权重。权重之和应为 100%(或 1.0)。
- 3按一致的等级(通常为 1 到 10)对每个类别进行评分。
- 4将每个类别得分乘以相应的权重:weighted_value = 得分 * 权重。
- 5将所有加权值相加以获得原始加权总计。
- 6除以权重总和(如果权重是总和为 100 的百分比,则等于 1)以获得标准化的最终评级。
- 7(可选)通过将 10 分制结果乘以 10,将结果缩放至 100 分制。
例题解析
▾
游戏性 (2.7) + 图形 (1.2) + 音频 (0.8) + 故事 (2.25) + 可重玩性 (0.7) + 价值 (0.8) = 8.45。由于这些权重强调故事和游戏玩法,像开放世界角色扮演游戏这样在这些维度上表现出色的游戏即使可重玩性不高,也会得分很高。将故事权重调整至 10%,将游戏性权重调整至 45%,会将注意力转向以动作为导向的玩家。
对于竞技 FPS 来说,游戏体验和网络代码占据主导地位。游戏玩法 (4.0) + 网络代码 (1.75) + 图形 (0.8) + 音频 (0.8) + 故事 (0.2) + 价值 (0.9) = 8.45。故事几乎不会影响最终得分,这是合适的,因为竞技玩家很少关心战役深度。网络代码较差(得分 4)的游戏会降至 7.35,这反映出技术性能在在线游戏中的重要性。
独立益智游戏通常通过严格的谜题设计和氛围而不是图形保真度而获得成功。游戏性 (3.15) + 图形 (0.7) + 音频 (1.2) + 故事 (1.6) + 可重玩性 (0.6) + 价值 (0.9) = 8.15。相对较低的图形重量意味着像素艺术美学不会影响游戏。强大的价值(预算游戏为 9/10)和氛围将分数推向 8+。
体育模拟游戏的评判主要取决于玩家的游戏感觉和真实感以及物理模拟。游戏性 (2.4) + 图形 (1.8) + 音频 (0.7) + 真实感 (2.25) + 模式 (0.6) + 价值 (0.25) = 8.0。低价值(每年发布 70 美元,最低新内容得分为 5/10)的阻力有限,因为其权重仅为 5%。将价值权重提高到 20% 将使综合指数下降到大约 7.55,更好地反映消费者对年度体育赛事的不满情绪。
实际应用
▾
初级保健医生和内科医生在常规临床评估期间使用 Game Rating Calc 来筛查患者,建立纵向监测基线,并确定可能需要转诊给专家进行进一步诊断评估或治疗干预的个人。
医院临床药剂师应用 Game Rating Calc 来验证药物剂量计算,特别是对于治疗指数狭窄的药物,如华法林、氨基糖苷类药物和化疗药物,其中患者特定因素(如肾功能和体重)严重影响安全剂量范围。
公共卫生流行病学家在人群筛查计划中使用 Game Rating Calc 来计算疾病患病率,评估筛查测试的敏感性和特异性,并确定在不同人口亚组中检测一个病例所需的筛查数量。
临床研究人员将 Game Rating Calc 纳入研究设计方案中,以计算样本量、确定检测临床有意义差异的统计功效,并根据定量生理阈值建立纳入标准。
特殊情况
▾
儿童与成人参考范围
在实践中,这种边缘情况需要仔细考虑,因为标准假设可能不成立。当游戏评分计算器计算中遇到这种场景时,从业者应该验证边界条件,检查除零风险,并考虑模型的假设在这些极端条件下是否仍然有效。
怀孕和荷尔蒙变化
在实践中,这种边缘情况需要仔细考虑,因为标准假设可能不成立。当游戏评分计算器计算中遇到这种场景时,从业者应该验证边界条件,检查除零风险,并考虑模型的假设在这些极端条件下是否仍然有效。
极端的身体成分
在实践中,这种边缘情况需要仔细考虑,因为标准假设可能不成立。当游戏评分计算器计算中遇到这种场景时,从业者应该验证边界条件,检查除零风险,并考虑模型的假设在这些极端条件下是否仍然有效。
参考表
▾
| 分数 | 标签 | 解释 |
|---|---|---|
| 9.0 - 10.0 | 杰作 | 在大多数或所有类别中都表现出色;具有里程碑意义的发布 |
| 8.0 - 8.9 | 伟大的 | 在关键领域表现强劲,只有较小的弱点 |
| 7.0 - 7.9 | 好的 | 令人愉快,但根据类别有一些明显的缺陷 |
| 6.0 - 6.9 | 体面的 | 有能力但不起眼;流派粉丝可能仍然喜欢它 |
| 5.0 - 5.9 | 平庸 | 重大问题抵消了任何积极因素 |
| 5.0以下 | 贫穷的 | 跨多个类别的基本问题 |
常见问题
▾
Metacritic 如何计算其 Metascore?
Metacritic 汇总了来自专业媒体的评论,并应用专有的权重系统,为选定的“顶级评论家”出版物提供更大的影响力。确切的权重并未公开披露,但 Metacritic 已证实并非所有评论都具有相同的权重。个人评论家分数在聚合之前从其原始等级(字母等级、百分比、星级)映射到 0-100 等级。
Metacritic 上的“普遍好评”分数是多少?
Metacritic 使用三个等级:绿色(有利,61-100)、黄色(混合或平均,40-60)和红色(一般不利,0-39)。 90 分或以上的分数被非正式地视为“普遍好评”,并在销售报告和新闻稿中引用。 《塞尔达传说:荒野之息》(97 分)和《荒野大镖客:救赎 2》(97 分)等游戏位居历史排行榜榜首。
我可以使用自定义权重进行个人游戏评分吗?
在游戏评级计算的背景下,这取决于用户的具体输入、假设和目标。基本公式提供了输入和输出之间的确定性关系,但实际应用需要在更广泛的健康和医疗实践背景下解释结果。专业人士通常将计算器输出与行业基准、历史数据和监管要求进行交叉引用。为了获得最可靠的结果,请确保输入来自经过验证的数据,了解公式做出哪些假设,并考虑运行多个场景来划分可能结果的范围。
为什么用户评分和评论家评分往往相差如此之大?
评论家通常在补丁发布之前在截止日期压力下评估游戏,并应用专业基准。用户评分反映了更广泛的期望、个人品味,并且容易受到评论轰炸(针对争议而协调的大规模低评分)。研究表明,与更正态分布的评论家分数相比,Metacritic 和 Steam 上的用户分数往往接近极端(非常高或非常低)。
一个好的游戏评级系统应该包含多少个类别?
游戏评级计算的良好或正常结果在很大程度上取决于具体环境——行业基准、个人目标、监管阈值以及输入中嵌入的假设。在健康和医疗应用中,从业人员通常将结果与公布的参考范围、历史性能数据或监管标准进行比较。用户不应将任何单个数字视为普遍好或坏,而应根据其具体情况解释输出,考虑输入的误差幅度,并在多个场景之间进行比较,以了解合理结果的范围。
抢先体验游戏的评级是否应该与正式版游戏的评级相同?
不可以。抢先体验游戏的评级应采用修改后的权重配置文件,更加注重稳定性、核心游戏循环和开发者沟通,同时减少或消除故事完整性和内容量的权重。许多审阅者明确注意到早期访问状态,并在完全发布后使用标准权重配置文件重新审阅。
什么是 OpenCritic?它与 Metacritic 有何不同?
OpenCritic 是一个评论聚合平台,于 2015 年推出,作为 Metacritic 的更透明的替代品。它不应用秘密渠道权重——所有包含的评论对总数的贡献相同。 OpenCritic 还显示推荐游戏的评论家的百分比,这是一种二元指标,通常比数字平均值对消费者更有用。由于其更具包容性的评论家网络,它已成为许多独立开发者的首选聚合器。
常见错误注意事项
▾
- !当某些方面对于游戏的核心身份明显更重要时,对所有类别使用相同的权重。
- !混合不同的评分标准(例如,某些类别的得分为 5 分,其他类别的得分为 10 分),而不先进行标准化。
- !忘记使权重总和达到 100%,这会破坏标准化并夸大或缩小最终分数。
- !在发布补丁解决技术问题之前立即对游戏进行评级,捕获不反映完善的最终产品的快照。
- !在设定权重时忽略游戏的目标受众——儿童教育游戏不应该因为简单的故事而受到惩罚。
专业提示
在构建个人评分模板时,请在玩游戏之前决定您的权重,以避免无意识地使您的类别分数偏向于您的整体直觉。预先承诺权重可以使系统保持诚实。
你知道吗?
Metacritic 上评分最高的游戏是《塞尔达传说:时之笛》(1998 年),Metascore 为 99 分,这一记录已保持了 25 年多,尽管其硬件得分仅为现代游戏机处理能力的一小部分。
Regional Guides
▾
🇺🇸 US▾
🇬🇧 UK▾
🇪🇺 EU▾
参考资料
获取每周数学提示
加入 12,000+ 订阅者,每周都会获得计算器提示。