Лид-радар: заказы из Telegram-чатов без ключевых слов
Живой прогон на 1366 реальных сообщениях из двух чатов (Tilda-чат и чат фриланс-подработок, февраль–апрель 2026). Каждое сообщение классификатор разложил на «заказ по нашему профилю», «заказ в другой нише», «спам/самореклама» и «обычное общение». Ниже 78 сообщений из этого прогона. Контакты и ссылки скрыты.
26 → 21сигналов «наш заказ» (p≥0.8) → из них ~21 реальный заказ (≈81%)
240 → ~21срабатываний ключевых слов на тех же сообщениях: точность ≈9%, и 6 из 26 сигналов слова не видят
0.97AUC «наш заказ» на ручной разметке 200 сообщений; при p≥0.8 — 9 из 9 верно
$0.04за 1000 сообщений, 0.3 с на сообщение (Groq: 0.95 с)
Порог удаления: 0.70 ·
Как читать.
Классификатор ничего не пишет: он выбирает из заданных вариантов и выдаёт вероятность. Поэтому его можно прогонять по каждому сообщению каждого чата.
Вкладка «Антиспам»: 44 сообщения из ручной разметки 200. Красная рамка — я пометил как спам. Бледные — ниже порога, остались бы в чате.
Цифры на ручной разметке (200 сообщений, 23 чата, RU/UA/ES/PT/EN): точность по 4 классам Jev 84.5%, Groq gpt-oss-120b 77.5%. Спам: у Jev 6 ложных удалений, у Groq 18.