Локальная модель решений: 243 миллисекунды на CPU и ноль рублей
Модель, которая не пишет текст, а выбирает из вариантов и ставит вероятность. Поставили локально и прогнали на настоящих задачах, а не на демо из документации.
Идея простая: часть работы в продукте — это не «напиши», а «выбери из вариантов». Там, где решение сводится к выбору, генерация текста — лишняя роскошь и лишнее время.
Что поставили
веса: 2,3 ГБ, лицензия Apache 2.0 проверка: работает без интернета после загрузки железо: CPU, инференс без ускорения замер: 6 задач × 3 вопроса = 1,46 с → 243 мс на задачу
Что показал прогон
Прогнали на настоящих задачах из ленты заказов, а не на примерах из документации. Модель уверенно разделила «наше / не наше» и отметила одну заявку как подозрительную по бюджету — это совпало с моей оценкой.
Где это полезно
Не как замена облачным моделям, а как страховка: когда внешний канал недоступен, часть логики продолжает работать локально. Плюс как дешёвый предфильтр — отсеять очевидное до того, как за него заплатишь.
Читайте дальше
Правка есть в базе, а страница отдаёт старое: кэш кода сниппетов
Скрипт под root превратил кэш в чужой — сайт начал отдавать пустые страницы
Новые замеры
Письмо, когда выходит новый замер или разбор поломки. Без рассылок «о нас» и без продаж.