3発では分かりません:1つのステータスを検証する標本数
✍️ アリス・愛麗沙
3発撮ったスクリーンショットは何も証明しません。 ダメージ計算式のいちばん外側は roundup(2 × rand(最小ダメージ×0.95, 最大ダメージ×1.05) × …) です。武器にはもともと最小と最大があり、その外側へさらに 5% ずつ広げられます。900/1000 の武器なら実際の抽選区間は 855〜1050、最高値は最低値より 22.8% 高い。この雑音のなかで 3% のステータス差を見分けるには片側およそ 60発、1% なら片側 550発 が要ります。さらにクリティカルと非クリティカルを分けて記録していないなら、必要な標本数はもう 35倍。測るなという話ではありません。測った結果が結論になるようにしよう、という話です。
雑音は三層あります
外側から順に三つ。
第一層、計算式そのものの乱数。 rand(最小ダメージ×0.95, 最大ダメージ×1.05)。この二つの係数は区間を両側へ押し広げます — 下端はさらに 5% 低く、上端はさらに 5% 高く。
第二層、武器自身の最小・最大。 武器情報に並ぶ二つの数値は、乱数を掛ける前からすでに離れています。
第三層、クリティカル。 これが最も凶悪で、あとで単独に計算します。
前の二層だけ重ねてみます。武器を 900/1000 とすると、
- 抽選の下限 900 × 0.95 = 855
- 抽選の上限 1000 × 1.05 = 1050
- 最高 ÷ 最低 = 1.228
同じスキル、同じ装備、同じかかしで、2発が 22.8% ずれ得ます。 あなたが探しているそのステータスは、2% ぶんかもしれないのに。
何発あれば足りるか
855〜1050 の一様分布とみなすと、平均は 952.5、標準偏差は 195 ÷ √12 = 56.3、変動係数は 5.91% です。
二群の平均を比較するときの標本数の式(信頼度 95%、検出力 80%)はこうです。
片側の標本数 ≈ 2 × (1.96 + 0.84)² × (変動係数 ÷ 見分けたい差)²
代入すると、
- 3% を見分けたい:2 × 7.84 × (5.91 ÷ 3)² = 約 61発(両側で 122発)
- 1% を見分けたい:2 × 7.84 × (5.91 ÷ 1)² = 約 548発(合計およそ 1,100発)
- 0.3% を見分けたい(たとえば除数どうしの差):片側およそ 6,000発
最後の行は正直な悪い知らせです。自宅では絶対に見分けられない差が存在します。 見分けられないと知っていることのほうが、3発叩いて結論を信じることより、はるかに価値があります。
クリティカルは必要な標本を35倍にします
クリティカルは「たまに少し強い」ではありません。分布を二つの山に割る装置です。
クリティカル率 30%、倍率 2.0 としましょう。混ぜたままの倍率の平均は 1.3、標準偏差は √(0.3×0.7×1²) = 0.458、変動係数は 35.2% になります。
標本数は変動係数の二乗に比例します。
(35.2 ÷ 5.91)² ≈ 35.5
さきほどの 61発が 2,160発 に化けます。
ですからステータス検証の第一則は「もっと叩け」ではありません。クリティカルの出た発を抜き出して別集計にせよ、です。二つの山を分ければ変動係数はそれぞれ 5.91% に戻り、必要な標本数も即座に60発台へ戻ります。手間が最も小さく、効き目が最も大きい一手です。
1.99 という歴史的な誤り
初期のコミュニティ計算式は最上位係数を 1.99 と書いていました。後の版が 2 に直し、作者が理由まで説明しています。1.99 は訓練用かかしの防御力を誤って計算したことによる錯覚でした。
覚えておく値打ちがあるのは 0.5% の差ではなく、教訓のほうです。測定台(かかし)の側に、あなたが引き算し忘れた変数が一つ潜んでいると、本物そっくりで間違った定数が出てきて、それが何年も転載され続けます。
かかしに防御力があるのか、クリティカル耐性があるのか、個体ごとに同じなのか。1発目を叩く前に片づけておく項目です。
結論になる測り方
- 同じかかし、同じスキル、同じ立ち位置。 立ち位置がヒット段数を変え、ヒット段数がその先すべてを変えます。
- 片側 最低60発。 「効いているかどうか」だけを知りたいなら少なめでも通りますが、近い二択を比べるつもりなら500発以上を覚悟してください。
- クリティカルは別記録。 必要な標本数を35分の1にする、唯一のただの手順です。
- 一度に変える変数は一つだけ。 韓国側で最も統制の取れた実験(強撃強化と連撃強化を入れ替え、合計を 5,112 に固定)が「ダメージは一の位まで同一」と言い切れたのは、これだけが理由です。
- そもそも測る値打ちがあるかを先に見る。 100 あたりいくらかは除数の表に書いてあります。
| ステータス | 除数 | +100あたり(0起点) | 説明 |
|---|---|---|---|
| 連撃強化 | 8500 | ≈ +1.18% | 対のステータスとプールを共有し、合計のみが影響 |
| 強撃強化 | 8500 | ≈ +1.18% | 対のステータスとプールを共有し、合計のみが影響 |
| 範囲強化 | 8500 | ≈ +1.18% | 対象2体以上でのみ有効 |
| スキル威力 | 8500 | ≈ +1.18% | ダメージ増加バケツ全体に乗算 |
| コンボ強化 | 17500 | ≈ +0.57% | さらにコンボ段階/4を乗算、コンボ100以上で満額 |
| クリティカル | 10000 | ≈ +1.00% | 閉形式:期待ダメージ = 1+クリティカル/10000 |
| 追撃 | 13000 | ≈ +0.77% | 100%ダメージの追加1回分の期待値 |
| 防御力 | 14828 | — | 軽減 = 1 ÷ (1+防御/14828)、ゼロにはならない |
除数は韓国コミュニティ式の定数(独立した2実装で同一)で公式ではありません。「+100あたり」は0起点の限界値で、同じバケツに積むほど単位収益は下がります。ステータス効率
紙の上で 0.4% しかない項目なら、測らないでください。必要な標本数があなたの根気より一桁大きい。
いま何をするか
スクリーンショットで争わないこと。 2枚のあいだは、それだけで 22.8% 開き得ます。その開きは、二人が言い争っているステータスとは何の関係もありません。
「差し替えたら手応えが良くなった」を信じないこと。 22.8% が揺れている前では、その一文に情報量がありません。
足りるまで測るか、測っていないと認めるか。 どちらかです。
覆り得る点も書いておきます。±5% という外側の乱数区間は韓国コミュニティの計算式の最上位式に由来し、その行の信頼度は高と表示されていますが、運営が戦闘の計算式を公開したことは一度もありません。上の標本数はすべて「ダメージが区間内でおおむね一様に分布する」という仮定の上に立っています。実際の分布が正規や三角形なら標準偏差は 195÷√12 より小さくなり、必要な標本数もそれに応じて減ります(結論の向きは変わらず、数字が緩むだけです)。単一スキルのダメージ記録を十分に積み上げて分布の形を描ける人が現れたら、ここの数字はその実測に差し替えます。
