Находит то, что не видно глазом: символы нулевой ширины, теговые коды из диапазона U+E0000, которыми можно спрятать в тексте целое сообщение, подменённые буквы и неразрывные пробелы. Показывает каждую находку с кодом и позицией.
Текст не покидает ваше устройство. Проверка идёт прямо в браузере: текст никуда не отправляется.
| Категория | Коды | Чем опасно |
|---|---|---|
| Нулевой ширины | U+200B, U+200C, U+200D, U+2060, U+FEFF | Не видны вообще; ими чаще всего метят текст |
| Теговые символы | U+E0000–U+E007F, U+E01F0–U+E0FFF | Внутри обычной строки прячется целое сообщение |
| Игнорируемые | U+2065, U+FFF0–U+FFF8, U+E0080–U+E00FF | Зарезервированные невидимые коды |
| Non-characters | U+FDD0–U+FDEF, U+xFFFE, U+xFFFF | Стандарт запрещает их в обмене данными |
| Направление текста | U+202A–U+202E, U+2066–U+2069 | Переворачивают вывод: файл.exe выглядит как картинка |
| Пустые заполнители | U+180E, U+3164, U+FFA0, U+115F | Рисуются пустотой, но пробелами не считаются |
| Селекторы вариаций | U+FE00–U+FE0F, U+E0100–U+E01EF | Вне эмодзи используются для стеганографии |
| Подменённые буквы | кириллица, греческий | Домены-двойники и обход фильтров |
Нет. Тут важно разделять две разные вещи. Невидимые символы Unicode — то, что находит этот инструмент, — вставляются редакторами, чат-ботами и иногда специально; они удаляются полностью и проверяемо. А статистические водяные знаки вроде SynthID-Text живут не в символах, а в самом выборе слов: модель при генерации чуть смещает вероятности токенов по секретному ключу. В файле нет ничего, что можно вырезать фильтром. Сломать такую метку можно только переписав текст другой моделью, и даже тогда результат вероятностный. Любой сервис, обещающий «удалить водяной знак ИИ» одной кнопкой, либо делает ровно то же, что и эта страница, либо просто перефразирует текст.
Символ U+200D (zero-width joiner) — одновременно и невидимый символ, и то, на чём держатся составные эмодзи: 👨👩👧 — это три человечка, склеенные двумя такими символами, а 🏳️🌈 — флаг плюс радуга. Он же обязателен в арабской и индийских письменностях. Поэтому такие символы не удаляются вслепую: смотрится, что стоит слева и справа, и если это эмодзи или буквы соответствующего алфавита — символ сохраняется. В отчёте видно, сколько служебных символов оставлено и почему.
Кириллическая «а» и латинская «a» выглядят одинаково, но это разные символы. На этом строятся домены-двойники, обход фильтров и поиска. Инструмент чинит только явные подмены: если чужих букв в слове не больше двух и у каждой есть двойник. Слова, где алфавиты смешаны осмысленно — «СберPay», «ВКонтактеAPI», транслит в именах файлов, — остаются нетронутыми.