رتبهبندی Massey در دارت
روش Massey با حل یک دستگاه معادلات خطی روی نتایج رودررو، «قدرت پنهان» هر بازیکن را برآورد میکند و برخلاف جدول جوایز (Order of Merit)، دشواری حریفان را بهطور صریح در محاسبه لحاظ میکند [MOD].
۱. مشکل رتبهبندی مبتنی بر جایزه
رتبهبندی رسمی PDC (Order of Merit) مجموع جایزهٔ نقدی دو سال گذشته است. این سنجه شفاف و بیمناقشه است، اما از منظر آماری سه سوگیری دارد:
| سوگیری | توضیح |
|---|---|
| وزندهی رویداد | یک برد در رویداد پرجایزه چند برابر یک برد در Players Championship میارزد، صرفنظر از کیفیت حریف |
| قرعهکشی | بازیکنی که مسیر آسانتری داشته پاداش یکسانی میگیرد |
| تأخیر | پنجرهٔ دوساله، فرم فعلی را دیر بازتاب میدهد |
در ورزشی که بیش از ۹۰٪ مسابقات رتبهبندیشده بهصورت best-of-11 برگزار میشود [AD] — یعنی نمونهای کوچک و پرنویز — این سوگیریها بزرگنمایی میشوند.
۲. منطق Massey
فرض کنید هر بازیکن $i$ یک «رتبهٔ قدرت» $r_i$ دارد. آنگاه اختلاف نتیجه در یک مسابقه باید تقریباً برابر اختلاف قدرت باشد:
با دهها یا صدها مسابقه، دستگاهی بسیار مقید (overdetermined) به دست میآید که با حداقل مربعات حل میشود:
که در آن $M$ ماتریس Massey است: عناصر قطری تعداد مسابقات هر بازیکن، و عنصر $(i,j)$ منفیِ تعداد رویاروییهای $i$ و $j$. بردار $\mathbf{p}$ مجموع حاشیههای نتیجه است. چون $M$ منفرد است، یک سطر با قید $\sum r_i = 0$ جایگزین میشود.
🔵 [MOD] نتیجهٔ کلیدی: رتبهٔ هر بازیکن بهطور خودکار با قدرت حریفانش تعدیل میشود — بردن از یک بازیکن قوی، $r$ را بیش از بردن از بازیکن ضعیف بالا میبرد.
۳. انتخاب «حاشیهٔ نتیجه» در دارت
بزرگترین تصمیم طراحی این است که $d_{ij}$ چه باشد. گزینهها:
| گزینه | مزیت | عیب |
|---|---|---|
| اختلاف لگ (۷–۳) | مستقیم، در دسترس | سقفدار؛ در best-of-11 حداکثر ۶ |
| اختلاف میانگین سهداره | پیوسته، پرداده | با شانس دبل آلوده است |
| اختلاف REAL Average | پیشبینی برنده را ۵۳٪ بهبود میدهد [AD] | محاسبهاش پیچیدهتر است |
| دودویی برد/باخت | ساده | اطلاعات را دور میریزد |
مثال ملموس — فینال جام جهانی PDC 2025: Littler ۷–۳ van Gerwen، میانگین ۱۰۲٫۷۳ در برابر ۱۰۰٫۶۹، چکاوت ۲۵/۴۵ (۵۵٫۵۵٪) در برابر ۱۴/۳۸ (۳۶٫۸۴٪) [AD].
اختلاف لگ ۴ است، اما اختلاف میانگین فقط ۲٫۰۴. کدامیک «حاشیهٔ واقعی» را بهتر نشان میدهد؟ داده میگوید تفاوت اصلی در چکاوت بوده، نه در امتیازگیری — و این دقیقاً چیزی است که سنجهٔ تکبعدی از دست میدهد.
۴. چرا سقفدار بودن مهم است
یک میانگین ۱۵۸٫۶۳ میتواند به ۷۷٫۰۸ ببازد در best-of-11 [AD]. این یعنی رابطهٔ بین «کیفیت اجرا» و «نتیجه» در دارت بهشدت نویزی است. Massey با حداقل مربعات، این نویز را در سراسر شبکهٔ مسابقات میانگینگیری میکند — که دقیقاً نقطهٔ قوت آن است.
اما نویز ساختاری هم وجود دارد که میانگینگیری حذفش نمیکند:
- حرفهایها فقط ۴۰–۴۵٪ ترپل میزنند [AD]
- تنها ~۱۰٪ لگها زیر ۱۲ دارت تمام میشوند [AD]
- در ۳۴ رویداد Players Championship 2025، هیچ بازیکنی با ۱۰۰+ لگ اکثریت لگها را با بریک نبرد؛ تنها ۲ نفر بالای ۷۵٪ Hold داشتند [AD]
۵. مزیت پرتاب نخست بهعنوان «مزیت میزبانی»
در بیسبال و فوتبال، Massey معمولاً یک جملهٔ «مزیت میزبان» دارد. معادل دارتی آن مزیت پرتاب نخست است. دادههای Hold/Break مقیاس آن را نشان میدهند:
| نرخ Hold | نرخ Break متناظر | شکاف |
|---|---|---|
| ۵۰٪ | ~۳۰٪ | ۲۰ واحد |
| ۷۰٪ | ~۴۲٪ | ۲۸ واحد |
منبع: تحلیل دادههای PDC 📊 [AD]. شکاف پایدار ۲۰–۲۸ واحدی یعنی مزیت پرتاب نخست بزرگ و ثابت است و باید بهعنوان یک پارامتر مجزا در مدل وارد شود، نه اینکه در $r_i$ حل شود.
بنچمارک نخبگان: Littler ۷۴٫۸۳٪ / ۴۶٫۲۴٪ · Humphries ۶۹٫۵۸٪ / ۴۴٫۰۱٪ (DartsOrakel، ۱۲ ماهه) [AD].
۶. محدودیتها
⚪ [GAP] هیچ پیادهسازی داوریشدهای از Massey روی دادههای دارت منتشر نشده است. آنچه در این مقاله آمده، انتقال روششناختی از ادبیات رتبهبندی ورزشی است.
⚪ Massey فرض میکند قدرت در طول فصل ثابت است. ظهور سریع بازیکنانی مانند Littler نشان میدهد این فرض در دارت بهسختی برقرار است؛ نسخههای وزندار زمانی لازماند.
⚪ گراف مسابقات باید همبند باشد. اگر دو دستهٔ بازیکن هرگز با هم بازی نکنند (مثلاً مدارهای مختلف)، مقایسهشان بیمعناست.
جمعبندی
- Massey با حل $M\mathbf{r} = \mathbf{p}$ قدرت را از نتایج رودررو استخراج میکند و دشواری حریف را خودکار تعدیل میکند.
- Order of Merit سه سوگیری دارد: وزندهی رویداد، قرعهکشی، و تأخیر دوساله.
- انتخاب حاشیهٔ نتیجه حیاتی است؛ اختلاف لگ در best-of-11 سقفدار است و REAL Average گزینهٔ برتر است.
- مزیت پرتاب نخست باید پارامتر مجزا باشد — شکاف Hold/Break پایدار ۲۰–۲۸ واحد است.
- نویز ذاتی دارت بالاست (۱۵۸٫۶۳ به ۷۷٫۰۸ میبازد)؛ میانگینگیری شبکهای نقطهٔ قوت Massey است.
- ⚪ کاربرد دارتیِ داوریشده وجود ندارد — این یک برنامهٔ پژوهشی باز است.
❓ پرسشهای متداول
Massey با Elo چه فرقی دارد؟ Elo بهروزرسانی متوالی و بازگشتی است؛ Massey کل فصل را یکجا و بهصورت حداقل مربعات حل میکند و نتیجه به ترتیب مسابقات وابسته نیست.
آیا Massey میتواند جایگزین Order of Merit شود؟ از نظر فنی بله، اما رتبهبندی رسمی کارکردهای تجاری و انگیزشی دارد که یک مدل آماری برآورده نمیکند.
چند مسابقه برای پایداری لازم است؟ هرچه گراف رویاروییها متراکمتر باشد بهتر؛ در عمل چند صد مسابقه در یک فصل مدار برای برآورد قابلاتکا مناسب است.
آیا میانگین سهداره ورودی خوبی است؟ ورودی در دسترسی است اما با شانس دبل آلوده؛ REAL Average یا SPI ترجیح دارند.
چرا ماتریس Massey منفرد است؟ چون فقط اختلافها را میسنجد و مبدأ آزاد است؛ قید $\sum r_i = 0$ این ابهام را رفع میکند.
آیا این روش برای لیگهای محلی کاربرد دارد؟ بله و شاید آنجا مفیدتر باشد، چون در لیگهای محلی اختلاف سطح حریفان زیاد و جدول امتیاز خام گمراهکننده است.
📚 منابع
- Baird (2020), Journal of the Operational Research Society 71(6):1020–1037 🔵 [MOD]
- PDC Stats Analysis (2024, 2025) 📊 [AD]
- DartsOrakel 📊 [AD]
- Haugh & Wang (2022), INFORMS Journal on Computing 34(5):2540–2551 🔵 [MOD]
🔗 مطالعهٔ بیشتر
- ۵.۱۰ REAL Average · ۵.۱۳ Hold/Break · ۵.۱۴ شاخص SPI · ۵.۲۳ میانگین ۱۵۸ به ۷۷ میبازد · ۵.۲۷ هیچکس با بریک نمیبرد
جمعآوری شده توسط بابک آقایی | بر پایهٔ سیستم مرجع دانش دارت نسخهٔ ۴.۰ | بازبینی: ۱ اوت ۲۰۲۶