Rileva gli omoglifi in domini, nomi utente e messaggi
Un omoglifo è un carattere che somiglia a un altro più familiare: la а cirillica (U+0430) e la a latina (U+0061) sono identiche nella maggior parte dei font, ma sono punti di codice diversi. Il rilevatore controlla ogni carattere ed elenca ogni sosia con posizione, punto di codice, sistema di scrittura Unicode e il carattere che imita.
Esempio svolto
- Testo inserito
- pаypаl.com / Αdmіn
- Sistemi di scrittura trovati
- latino (Latn), cirillico (Cyrl), greco (Grek)
- Caratteri segnalati
- 4
| Posizione | Carattere | Punto di codice | Sistema di scrittura | Sostituzione | Regola |
|---|---|---|---|---|---|
| 1 | а | U+0430 | cirillico | a | Mappa dei confondibili |
| 4 | а | U+0430 | cirillico | a | Mappa dei confondibili |
| 13 | Α | U+0391 | greco | A | Mappa dei confondibili |
| 16 | і | U+0456 | cirillico | i | Mappa dei confondibili |
- Conserva Unicode leggibile
- paypal.com / Admin
Come funziona
- Ogni carattere viene confrontato con una mappa integrata di sosia comuni in cirillico, greco, varianti latine e a larghezza piena. Una corrispondenza viene segnalata insieme alla lettera, alla cifra o al segno di punteggiatura ASCII imitato.
- I caratteri non presenti nella mappa passano per la normalizzazione Unicode NFKC. Se NFKC li modifica, come accade con le lettere a larghezza piena e le legature come fi, vengono segnalati come forme di compatibilità.
- Le posizioni contano i punti di codice Unicode a partire da 0. Una parola che mescola lettere latine con lettere cirilliche o greche è un forte segnale d'allarme, perché le parole legittime cambiano raramente sistema di scrittura a metà.
La conversione avviene al meglio: i confondibili mappati e il ripiegamento NFKC sono deterministici, ma alcuni Unicode legittimi non verranno contrassegnati.
Il tuo testo
Incolla o digita: i risultati si aggiornano durante la digitazione (leggermente rimbalzato per input lunghi).
18 caratteri analizzati
4 sospetti
Conserva Unicode leggibile
Originale (caratteri sospetti contrassegnati)
I caratteri sospetti nella visualizzazione originale sono sottolineati ed etichettati come “susp”. oltre a evidenziare il colore.
psuspicious character аypsuspicious character аl.com / suspicious character Αdmsuspicious character іn
Output ripulito
Analisi dei caratteri
| Indice (in base 0) | Originale | Sostituzione | Punto di codice | Motivo |
|---|---|---|---|---|
| 0 | p | p | U+0070 | Not flagged as a confusable or compatibility character. |
| 1 | а | a | U+0430 | Non-ASCII confusable mapped to a safer Latin ASCII equivalent. |
| 2 | y | y | U+0079 | Not flagged as a confusable or compatibility character. |
| 3 | p | p | U+0070 | Not flagged as a confusable or compatibility character. |
| 4 | а | a | U+0430 | Non-ASCII confusable mapped to a safer Latin ASCII equivalent. |
| 5 | l | l | U+006C | Not flagged as a confusable or compatibility character. |
| 6 | . | . | U+002E | Not flagged as a confusable or compatibility character. |
| 7 | c | c | U+0063 | Not flagged as a confusable or compatibility character. |
| 8 | o | o | U+006F | Not flagged as a confusable or compatibility character. |
| 9 | m | m | U+006D | Not flagged as a confusable or compatibility character. |
| 10 | U+0020 | Not flagged as a confusable or compatibility character. | ||
| 11 | / | / | U+002F | Not flagged as a confusable or compatibility character. |
| 12 | U+0020 | Not flagged as a confusable or compatibility character. | ||
| 13 | Α | A | U+0391 | Non-ASCII confusable mapped to a safer Latin ASCII equivalent. |
| 14 | d | d | U+0064 | Not flagged as a confusable or compatibility character. |
| 15 | m | m | U+006D | Not flagged as a confusable or compatibility character. |
| 16 | і | i | U+0456 | Non-ASCII confusable mapped to a safer Latin ASCII equivalent. |
| 17 | n | n | U+006E | Not flagged as a confusable or compatibility character. |