👀 Представьте: в чате пишут «Спасибо всем, кто поддержал меня на этой неделе». Обычное, доброе сообщение. А в ответ реплай: «Ну конечно, только твои проблемы тут всех волнуют».
Мата нет, оскорблений нет. Обычный бот по ключевым словам проверит фразу отдельно — и пропустит, ведь сама по себе она нейтральная. Токсичность рождается только в связке с исходным сообщением: это сарказм, обесценивание, издевательский пересказ чужих слов.
Простые боты читают сообщения по одному, как страницы без сюжета. Они не видят, что реплай отвечает конкретному человеку и конкретной мысли.
AiChatModerator анализирует пару «сообщение + ответ» как единый смысловой блок, а не два случайных текста.
ИИ понимает контекст цепочки: кто кому отвечает, о чём был исходный пост, какая эмоция стоит за репликой. И ловит именно ту токсичность, которую невозможно найти по словарю запрещённых слов.