>> 1344あなたの批判はとても筋が通っていると思います。 ただ、期待勝率がモデルの数式的に正しくとも実情とは合致していないことが結局不条理であると言う主張、 "統計的に異常"と私が表現した部分について解釈の違いがあること、 計算式がフェス等とは異なっていると考えられる点については補足させていただきます。
ブキチャレの場合、上位27帯がほぼ常に格下(22前後やそれ以下)とマッチするなら、モデル上の予測勝率Eがすでに0.99以上に張り付いている状況が「普通に」生じるわけで、 そのとき0.994が閾値というのは「実際に維持するための必要勝率」と読めます。 つまり「到達不能」というより「到達は極端に困難だが、極小人口の上位層なら事実上その水準を要求される」という表現が妥当でした。
もっとも、スプラトゥーンは編成事故や初動の事故、一人の戦犯の存在、その他諸々の要因でレート的にたとえば800程度格下でも勝率99%↑は事実上不可能であると解釈しているため、 その点でモデルの求める期待勝率が高すぎるという点については変わりません。
また、私が「統計的に異常」と表現したのは、proper scoring の要件(E=pのとき期待値0)を満たさない更新則という意味でした。 ただし現実には「Eが常に0.99以上になる狭い領域で動いているだけ」で、更新則そのものはフェスや他モードと同じ(対称なElo型)という可能性もあります。 そうであれば「式自体は健全、マッチング分布が原因でE≈1に偏るから実質的に負ドリフトが続く」という説明で済み、モデル自体が破綻しているわけではないのは確かです。 もっとも、レート計算以外の部分が破綻した結果、事実上レート計算も破綻している、という形になるだけではあります。
また、実際にパワー25↑あたりになると顕著なのですが、マッチングする相手がベストナインランキング上位のプレイヤーばかりになるんですよね。 ランキングとか配信だとかで見かける名前ばかりになるので敵でも味方でも至極恐縮なのですが、 その場合、相手が例えばパワー2500程度のブキを持っていることがイカリングで確認できます。 この状態で例えば勝率.994を要求される、すなわちチームのパワー差が900程度あるマッチングが"普通に"発生しているとは考えづらいのです。 というかそんなマッチングが平気で行われているのならマッチングの方がありえないほど狂っています。
その点でフェスなどと同様のGlicko的レーティングシステムあたりを採用していると想定すると、やはり変動値がインフレ抑制、及び下位層へのパワー分配のメカニズム無しでは説明のつかない値になっているのは間違いないと思っています。 数学的な話以外に、各ブキというレートを計算する対象が非常に多くなることから、フェスなどのレーティングシステムとは少し挙動が異なるモデルを採用することに高い合理性があることも根拠の一つです。
不適切なコンテンツとして通報するには以下の「送信」ボタンを押して下さい。 現在このグループでは通報を匿名で受け付けていません。 管理者グループにはあなたが誰であるかがわかります。
どのように不適切か説明したい場合、メッセージをご記入下さい。空白のままでも通報は送信されます。
通報履歴 で、あなたの通報と対応時のメッセージを確認できます。
>> 1344あなたの批判はとても筋が通っていると思います。
ただ、期待勝率がモデルの数式的に正しくとも実情とは合致していないことが結局不条理であると言う主張、
"統計的に異常"と私が表現した部分について解釈の違いがあること、
計算式がフェス等とは異なっていると考えられる点については補足させていただきます。
ブキチャレの場合、上位27帯がほぼ常に格下(22前後やそれ以下)とマッチするなら、モデル上の予測勝率Eがすでに0.99以上に張り付いている状況が「普通に」生じるわけで、
そのとき0.994が閾値というのは「実際に維持するための必要勝率」と読めます。
つまり「到達不能」というより「到達は極端に困難だが、極小人口の上位層なら事実上その水準を要求される」という表現が妥当でした。
もっとも、スプラトゥーンは編成事故や初動の事故、一人の戦犯の存在、その他諸々の要因でレート的にたとえば800程度格下でも勝率99%↑は事実上不可能であると解釈しているため、
その点でモデルの求める期待勝率が高すぎるという点については変わりません。
また、私が「統計的に異常」と表現したのは、proper scoring の要件(E=pのとき期待値0)を満たさない更新則という意味でした。
ただし現実には「Eが常に0.99以上になる狭い領域で動いているだけ」で、更新則そのものはフェスや他モードと同じ(対称なElo型)という可能性もあります。
そうであれば「式自体は健全、マッチング分布が原因でE≈1に偏るから実質的に負ドリフトが続く」という説明で済み、モデル自体が破綻しているわけではないのは確かです。
もっとも、レート計算以外の部分が破綻した結果、事実上レート計算も破綻している、という形になるだけではあります。
また、実際にパワー25↑あたりになると顕著なのですが、マッチングする相手がベストナインランキング上位のプレイヤーばかりになるんですよね。
ランキングとか配信だとかで見かける名前ばかりになるので敵でも味方でも至極恐縮なのですが、
その場合、相手が例えばパワー2500程度のブキを持っていることがイカリングで確認できます。
この状態で例えば勝率.994を要求される、すなわちチームのパワー差が900程度あるマッチングが"普通に"発生しているとは考えづらいのです。
というかそんなマッチングが平気で行われているのならマッチングの方がありえないほど狂っています。
その点でフェスなどと同様のGlicko的レーティングシステムあたりを採用していると想定すると、やはり変動値がインフレ抑制、及び下位層へのパワー分配のメカニズム無しでは説明のつかない値になっているのは間違いないと思っています。
数学的な話以外に、各ブキというレートを計算する対象が非常に多くなることから、フェスなどのレーティングシステムとは少し挙動が異なるモデルを採用することに高い合理性があることも根拠の一つです。