השיטה: איך נבנה כל מספר באתר

1. משיכה

כל מאגר נמשך ישירות מממשק ה-API של data.gov.il (datastore_search), במלואו, בלי סינון ידני. לכל שורה נשמרים מזהה המשאב (resource_id), מזהה השורה במאגר (_id) ותאריך המשיכה. כך כל ערך בעמוד ניתן לשחזור מול המקור.

2. נרמול

שמות שדות משתנים בין שנים במאגרי הדוחות המבוקרים (רווח מול קו תחתי, "ערך" מול "נתון"). האתר ממפה אותם לסכימה אחת ושומר את השם המקורי. שמות רשויות מאוחדים לפי כתיב מנורמל; קודי הרשות נשמרים כפי שהם.

3. חישוב

משפטי-עובדה בעמודים ("עלה ב-X% בין שנה א לשנה ב", "מקום N מתוך M") הם נוסחאות על שדות מהמאגר, ולא הערכות. אחוז שינוי = (ערך אחרון - ערך קודם) חלקי הערך הקודם. דירוג = מיקום הרשות בסדר יורד של אותו נתון באותה שנה, בין כל הרשויות שיש להן נתון. "לנפש" = הערך חלקי שורת האוכלוסייה באותו מאגר לאותה שנה. מחשבוני המס והביטוח הלאומי משתמשים בקובצי כללים לפי שנת מס, עם קישור למקור הרשמי של כל כלל, ונבדקים מול דוגמאות רשמיות לפני פרסום.

4. עדכון

המאגרים נמשכים מחדש כל לילה ומושווים למצב הקיים. עמוד מסומן כמעודכן רק כשתוכנו השתנה בפועל. תאריך "נמשך ב-" בתחתית כל עמוד הוא תאריך המשיכה האחרון של המאגר.

5. בדיקה

כל לילה נדגמים עמודים ומושווים ערך-ערך מול שורת המקור ב-API. אי-התאמה מסמנת את העמוד לתיקון עד שהמקור או העמוד מתעדכן.

6. תיקונים

מצאת נתון שגוי? בקשת תיקון. אם הטעות במקור הממשלתי, האתר מפנה למאגר ומעדכן אחרי שהמקור עודכן; אם הטעות בעיבוד, היא מתוקנת ונרשמת.

מה האתר לא עושה

לא מצליב מאגרים לזיהוי אדם, לא מציג שמות של בני אדם, לא משתמש בנתונים שאינם ברישיון פתוח, ולא כותב "המלצות".