Metodologija
Ta stran opisuje, kako NoCall tisoče uporabniških prijav spremeni v zanesljivo oceno za vsako telefonsko številko. Pojasnimo natančno formulo za oceno tveganja, stopnje nevarnosti, kako razvrščamo kategorije, kako deluje naša analiza z umetno inteligenco in od kod prihajajo podatki. To metodologijo objavljamo, da lahko vsakdo razume — in podvomi v — odločitve, ki jih sprejema sistem.
Kako se izračuna ocena tveganja
Vsaki številki v naši zbirki podatkov dodelimo oceno tveganja med 0 in 100. Ne gre za subjektivno presojo: izhaja iz deterministične formule, ki se ponovno izračuna ob vsaki novi odobreni prijavi.
risk = min(100, reports × 5 + (verified ? 30 : 0))
Vsaka odobrena prijava doda 5 točk. Če je naša ekipa številko preverila kot potrjeno neželeno, se doda dodatnih 30 točk. Rezultat nikoli ne preseže 100.
Faktor preverjanja obstaja zato, da ločimo številko z veliko nedavnimi prijavami (kar bi lahko bil enkraten lažni pozitiv) od številke, ki jo je človeški pregledovalec dejavno potrdil kot zlorabo. Zato lahko 20 nepreverjenih prijav (100 točk iz prijav, omejeno) in 14 preverjenih prijav (70 + 30) dosežeta podobno oceno po različnih poteh.
Ko je naša UI analizirala številko in ima ta odobrene signale skupnosti, zaznana stopnja nevarnosti deluje tudi kot spodnja meja za oceno: številka, označena kot kritična, se nikoli ne prikaže pod 90, visoka pod 70, srednja pod 45 in nizka pod 20, tudi če ima malo prijav. Tako jasno goljufiv vzorec ni podcenjen samo zato, ker je nedaven.
Stopnje nevarnosti
Na podlagi številčne ocene vsako številko razvrstimo v eno od štirih stopenj nevarnosti. To so isti identifikatorji, ki jih naša zbirka podatkov uporablja interno:
Low (bajo)0–39
Few reports or none. The number shows no clear signs of spam activity. It may be a legitimate line or an isolated, unconfirmed report.
Medium (medio)40–59
Several reports received. Caution is advised before answering or calling back. The default value when the signal is ambiguous.
High (alto)60–79
Numerous confirmed reports. High likelihood of aggressive telemarketing or repeated unwanted calls.
Critical (critico)80–100
Number verified as spam or a scam, or identified by the AI as fraud or impersonation. We recommend blocking it immediately.
Kategorije neželenih klicev
Vsaka prijava in vsaka številka je razvrščena v eno od sedmih kategorij. Kategorija določa, kako je številka predstavljena v imeniku, in izhaja tako iz uporabnikove prijave kot iz kasnejše samodejne analize:
- SPAM — Generic, unwanted commercial calls that do not fit a more specific category.
- TELEMARKETING — Telephone sales campaigns, usually telecoms or energy, that persist despite rejection.
- SCAM — Scams and fraud, including identity impersonation (banks, public bodies, fake tech support). The most serious category.
- DEBT — Debt-collection and recovery calls, often aggressive or aimed at the wrong person.
- HARASSMENT — Repeated calls intended to harass, intimidate or deliberately disturb.
- SURVEY — Unsolicited phone surveys, polls and market research.
- OTHER — Any other type of unwanted call that does not fit the above.
Analiza z umetno inteligenco
Poleg številčne ocene proces UI analizira številke na podlagi vsebine, ki jo je odobrila skupnost: komentarjev in prijav, ki so prestali moderiranje. UI nikoli ne dela z neodobreno vsebino, zato noben nepregledan prispevek ne more vplivati na javno analizo.
Za vsako analizirano številko UI ustvari strukturiran nabor informacij, prikazan na strani številke:
Polja, ki jih ustvari analiza, so naslednja:
- Description — A natural-language summary of who seems to be behind the number and what they want.
- Complaint patterns — The most repeated complaint reasons across reports (for example, calls at unsociable hours or persistence after refusal).
- Tactics used — The specific techniques detected, such as pressure, false urgency or requests for personal data.
- Sector — The field the activity belongs to (telecoms, energy, debt collection, surveys, etc.).
- Detected company — The company or organisation the number appears to represent or impersonate, when it can be identified.
- Impersonation — An indicator of whether the number pretends to be a legitimate entity (bank, public administration, known brand).
- Recommended action — The final recommendation for the user: block, caution, ignore or safe.
Ta analiza je informativna in samodejno ustvarjena na podlagi prispevkov skupnosti; ne nadomešča lastne presoje uporabnika niti ne pomeni obtožbe zoper katero koli konkretno podjetje.
Moderiranje: nič se ne objavi brez pregleda
Nadzor kakovosti je osrednji del metodologije. Prijave in komentarji se v javnem imeniku ne pojavijo takoj ob oddaji: ostanejo v čakanju, dokler jih skrbnik ne odobri. Šele takrat se upoštevajo pri oceni tveganja, vplivajo na analizo UI in postanejo vidni drugim uporabnikom.
Ta pregledna ovira ima dva namena: zavrže lažne ali zlonamerne prijave, preden vplivajo na ugled številke, in zagotavlja, da UI sklepa samo na podlagi preverjenih informacij. Avtor čakajoče prijave vidi svoj prispevek, nihče drug pa ne, dokler ni odobren.
Viri podatkov
Ocena vsake številke združuje tri neodvisne vire:
- Community reports — The foundation of everything. Users report numbers from the app and the web, anonymously, with a category and a comment. After moderation, they are the main signal for the score.
- CNMC operator and prefix data — We use public data from the National Commission for Markets and Competition (CNMC) to identify the operator assigned to each numbering block and the line type (mobile, landline, premium rate).
- Company press releases (RSS) — We follow companies' newsrooms via RSS feeds to detect legitimate campaigns and reduce false positives when a real company is running mass communications.