ניתוח 1,795 הגרלות לוטו ישראליות — מה הנתונים מגלים
לקחנו את כל ההגרלות בהיסטוריה של הלוטו הישראלי והעברנו אותן דרך מבחנים סטטיסטיים. הנה מה שהנתונים באמת אומרים.
מסד הנתונים
כל הגרלה מוציאה 6 מספרים מתוך 37. לאורך 1,795 הגרלות, כל מספר אמור להופיע 291.08 פעמים בממוצע (1,795 × 6 ÷ 37). השאלה שלנו: האם זה באמת מה שקורה?
תדירויות מספרים — הכל מתיישר
כשבודקים את תדירות ההופעה של כל מספר, רואים שהם מתכנסים לממוצע. יש סטיות קטנות — מספרים מסוימים הופיעו 280 פעמים ואחרים 305 — אבל הסטיות האלה בתוך הטווח הסטטיסטי הצפוי.
מבחן חי-בריבוע על התפלגות המספרים מראה שאין סטייה מובהקת. כלומר: אין מספר "חם" או "קר" באמת. זה רעש.
יום הגרלה — אין הבדל
בדקנו אם יש הבדל בין הגרלות של יום שלישי לבין הגרלות של שבת. התשובה: לא. אין שום הבדל סטטיסטי. התפלגות המספרים זהה בשני הימים.
הממצא המפתיע — אשכולות גבוה/נמוך
הדבר היחיד שכן מראה מובהקות סטטיסטית הוא ההתקבצות של מספרים גבוהים ונמוכים:
מבחן רצפים (Runs Test):
ציון z: -36.138
p-value: < 0.001
זו מובהקות חזקה מאוד. המשמעות: מספרים גבוהים (19-37) ומספרים נמוכים (1-18) נוטים להתקבץ יחד מהגרלה להגרלה — יותר מהצפוי מהתפלגות אקראית.
בפועל זה אומר: אם ההגרלה האחרונה הכילה רוב מספרים גבוהים, יש סיכוי סטטיסטי גבוה יותר שגם הבאה תכיל רוב גבוהים.
מה זה אומר בפועל?
- אל תרדפו מספרים בודדים — אין מספר חם או קר שיכול לעזור
- כן תסתכלו על הרכב ההגרלה — כמה מספרים גבוהים וכמה נמוכים יצאו
- התאימו את הבחירה שלכם — אם ההגרלה האחרונה הייתה "גבוהה", שקלו לכלול יותר מספרים גבוהים
תזכורת: גם הממצא הסטטיסטי הזה לא מבטיח זכייה. הסיכוי לפרס הראשון נשאר 1:2,324,784. אבל אם כבר בוחרים מספרים — עדיף על בסיס נתונים אמיתיים.