מאיפה מגיעים המספרים
19 מקורות מתועדים אצלנו, ו־7 מהם נקראים באופן שוטף — ריכוזי סקרים, ועדת הבחירות המרכזית, וילקוט הפרסומים לתוצאות המאושרות. כל איסוף נשמר כעותק נושא תאריך, ואיננו דורסים עותקים קודמים.
החלק האחרון חשוב יותר משנדמה. הריכוזים מתקנים את העבר: נתוניו של סקר עשויים להשתנות בהם לאחר הפרסום. שמירת הנתונים המקוריים היא מה שמאפשר לשחזר תחזית שפורסמה באוגוסט, חודשים לאחר מכן, בדיוק מהנתונים שעליהם התבססה.
איך הופכים את הסקרים לברי־השוואה
מכוני הסקרים אינם מסכימים איך לקרוא למפלגה, והמפלגות אינן עומדות במקום. רשימה אחת מגיעה בשלושה איותים שונים; שתיים מתאחדות באמצע מערכת הבחירות, והמכונים משלימים את הפער רק כעבור שבועות. כל רשימה מקבלת אצלנו שם אחיד אחד, איחודים ופילוגים נרשמים עם התרחשותם, וסקר שפורסם בשני כלי תקשורת נספר פעם אחת בלבד.
טעות כאן אינה מרעישה: מפלגה מתפצלת בשקט לשתיים, כל אחת עם מחצית מהתמיכה, ושום דבר בתוצאה אינו נראה שגוי.
צירוף הסקרים
42 הסקרים שמאחורי התחזית הנוכחית מגיעים מ־9 מכוני סקרים. הם מצטרפים לתמונה אחת של מצב המפלגות, וסקרים עדכניים מקבלים בה משקל רב יותר מסקרים ישנים.
אף סקר בודד אינו משנה את התוצאה באופן משמעותי, וזו הכוונה. מספר חריג ממכון אחד הוא בדיוק מה שפותח מהדורת חדשות, ואינו צריך להזיז תחזית; מה שכן מזיז אותה הוא הסכמה בין כמה מכונים.
מן הממוצע אל התחזית
ממוצע אינו תחזית. הוא אומר היכן המפלגות עומדות, לא עד כמה הוא עלול לטעות. לכן אנחנו מריצים סימולציה של הבחירות 20,000 פעמים, וכל הרצה מגרילה תוצאה סבירה אחרת לפי מידת הסטייה של סקרים בעבר.
אחוז החסימה וחלוקת המנדטים מופעלים בתוך כל הגרלה והגרלה, ולא פעם אחת בסוף. זה מה שגורם לחשבון להתנהג כמו במציאות: רשימה שנמצאת שבריר מתחת לקו אינה זוכה בדבר באותה הגרלה, והקולות שקיבלה מיטיבים עם כל רשימה שעברה.
בדיקה מול העבר
מודל שמעולם לא טעה בפומבי הוא מודל שאיש לא בדק. המודל הזה מותאם מחדש מול 8 מערכות בחירות קודמות, ובכל פעם הוא רואה רק את מה שהיה ידוע ערב אותן בחירות.
זה ההבדל בין תחזית לבין סיפור. התאמת מודל לבחירות שתוצאתן כבר ידועה תמיד תיראה מרשימה, והיא אינה אומרת דבר על הבחירות הבאות.
לעומק
החלטות ספציפיות מתועדות ומתפרסמות בזמן אמת.