מתודולוגיה
עמוד זה מתעד כיצד NoCall הופך אלפי דיווחי משתמשים להערכה אמינה עבור כל מספר טלפון. אנו מסבירים את נוסחת ציון הסיכון המדויקת, את רמות הסכנה, איך אנחנו מסווגים קטגוריות, איך פועל ניתוח הבינה המלאכותית שלנו ומאיפה מגיעים הנתונים. אנו מפרסמים את המתודולוגיה הזו כדי שכל אחד יוכל להבין — ולתהות על — ההחלטות שהמערכת מקבלת.
איך מחושב ציון הסיכון
לכל מספר במסד הנתונים שלנו ניתן ציון סיכון בין 0 ל-100. זו אינה שיפוט סובייקטיבי: הציון נגזר מנוסחה דטרמיניסטית שמחושבת מחדש בכל פעם שמגיע דיווח מאושר חדש.
risk = min(100, reports × 5 + (verified ? 30 : 0))
כל דיווח מאושר מוסיף 5 נקודות. אם הצוות שלנו אימת את המספר כספאם מאושר, מתווספות 30 נקודות נוספות. התוצאה לעולם אינה עולה על 100.
גורם האימות קיים כדי להבחין בין מספר עם דיווחים רבים לאחרונה (שעלול להיות תקלה חד-פעמית) לבין מספר שבודק אנושי אישר באופן פעיל כמתעלל. לכן 20 דיווחים לא מאומתים (100 נקודות מדיווחים, מוגבל) ו-14 דיווחים מאומתים (70 + 30) יכולים להגיע לציונים דומים בדרכים שונות.
כאשר מספר נותח על ידי הבינה המלאכותית שלנו ויש לו אותות קהילתיים מאושרים, רמת הסכנה שזוהתה משמשת גם כרף תחתון לציון: מספר שסומן כקריטי לעולם לא יוצג מתחת ל-90, גבוה לא מתחת ל-70, בינוני לא מתחת ל-45 ונמוך לא מתחת ל-20, גם עם מעט דיווחים. כך תבנית הונאה ברורה לא תוערך בחסר רק בגלל שהיא חדשה.
רמות סכנה
מהציון המספרי אנחנו מסווגים כל מספר לאחת מארבע רמות סכנה. אלה אותם מזהים שמסד הנתונים שלנו משתמש בהם באופן פנימי:
Low (bajo)0–39
Few reports or none. The number shows no clear signs of spam activity. It may be a legitimate line or an isolated, unconfirmed report.
Medium (medio)40–59
Several reports received. Caution is advised before answering or calling back. The default value when the signal is ambiguous.
High (alto)60–79
Numerous confirmed reports. High likelihood of aggressive telemarketing or repeated unwanted calls.
Critical (critico)80–100
Number verified as spam or a scam, or identified by the AI as fraud or impersonation. We recommend blocking it immediately.
קטגוריות ספאם
כל דיווח וכל מספר מסווגים לאחת משבע קטגוריות. הקטגוריה קובעת כיצד המספר מוצג במדריך והיא נגזרת גם מהדיווח של המשתמש וגם מהניתוח האוטומטי המאוחר יותר:
- SPAM — Generic, unwanted commercial calls that do not fit a more specific category.
- TELEMARKETING — Telephone sales campaigns, usually telecoms or energy, that persist despite rejection.
- SCAM — Scams and fraud, including identity impersonation (banks, public bodies, fake tech support). The most serious category.
- DEBT — Debt-collection and recovery calls, often aggressive or aimed at the wrong person.
- HARASSMENT — Repeated calls intended to harass, intimidate or deliberately disturb.
- SURVEY — Unsolicited phone surveys, polls and market research.
- OTHER — Any other type of unwanted call that does not fit the above.
ניתוח בינה מלאכותית
מעבר לציון המספרי, עובד בינה מלאכותית מנתח מספרים בהתבסס על תוכן שאושר על ידי הקהילה: התגובות והדיווחים שעברו את הבדיקה. הבינה המלאכותית לעולם לא עובדת עם תוכן שלא אושר, כך שאף תרומה שלא נבדקה לא יכולה להשפיע על הניתוח הציבורי.
עבור כל מספר שנותח, הבינה המלאכותית מייצרת מערך מובנה של מידע המוצג בעמוד המספר:
השדות שהניתוח מייצר הם כדלקמן:
- Description — A natural-language summary of who seems to be behind the number and what they want.
- Complaint patterns — The most repeated complaint reasons across reports (for example, calls at unsociable hours or persistence after refusal).
- Tactics used — The specific techniques detected, such as pressure, false urgency or requests for personal data.
- Sector — The field the activity belongs to (telecoms, energy, debt collection, surveys, etc.).
- Detected company — The company or organisation the number appears to represent or impersonate, when it can be identified.
- Impersonation — An indicator of whether the number pretends to be a legitimate entity (bank, public administration, known brand).
- Recommended action — The final recommendation for the user: block, caution, ignore or safe.
ניתוח זה הוא אינדיקטיבי ומיוצר אוטומטית מתרומות הקהילה; הוא אינו מחליף את שיקול הדעת של המשתמש ואינו מהווה האשמה כלפי חברה מסוימת.
מודרציה: שום דבר לא מתפרסם בלי בדיקה
בקרת איכות היא מוקד המתודולוגיה. דיווחים ותגובות אינם מופיעים במדריך הציבורי ברגע שהם נשלחים: הם נשארים ממתינים עד שמנהל מאשר אותם. רק אז הם נספרים לציון הסיכון, מזינים את ניתוח הבינה המלאכותית והופכים גלויים למשתמשים אחרים.
שער מודרציה זה משרת שתי מטרות: הוא פוסל דיווחים כוזבים או זדוניים לפני שהם משפיעים על המוניטין של מספר, והוא מבטיח שהבינה המלאכותית מנמקת רק על מידע מאומת. מחבר של דיווח ממתין יכול לראות את התרומה שלו, אך אף אחד אחר לא, עד שהיא מאושרת.
מקורות נתונים
ההערכה של כל מספר משלבת שלושה מקורות עצמאיים:
- Community reports — The foundation of everything. Users report numbers from the app and the web, anonymously, with a category and a comment. After moderation, they are the main signal for the score.
- CNMC operator and prefix data — We use public data from the National Commission for Markets and Competition (CNMC) to identify the operator assigned to each numbering block and the line type (mobile, landline, premium rate).
- Company press releases (RSS) — We follow companies' newsrooms via RSS feeds to detect legitimate campaigns and reduce false positives when a real company is running mass communications.