Новости Статьи Авторы О проекте
Инструменты
AI-разбор продаж Стать автором
Новости Инструменты

Счёт за ИИ в 67 раз меньше: разбор миграции с Claude на дешёвую модель

Коротко

На массовых однотипных задачах фронтир-модель часто избыточна: замена на дешёвую модель снизила счёт в 67 раз почти без потери качества. Но нужен слепой тест на реальных примерах и защита от «сжигания» бюджета при сбое.

На Хабре вышел трезвый разбор от команды сервиса JobPath (структурирование вакансий): как они снизили расходы на ИИ, переведя ночную пакетную обработку с Claude Sonnet 3.5 на более дешёвую модель Qwen3.5-Flash. Прогнозные ~$2000 в месяц (важно: именно прогноз, а не уже потраченные деньги) превратились в ~$30 — примерно в 67 раз меньше.

Самое ценное — как проверяли, что клиент не пострадает. Качество оценивал «слепой судья» на базе Claude Opus 4.8: он вслепую сравнивал ответы на 50 реальных продовых вакансиях по полноте, точности, качеству русского языка и обоснованности оценки зарплаты. Средний балл просел с 4,48 до 4,06 из 5, жалоб от пользователей не поступило.

$2000 → $30
прогнозный счёт за месяц до и после (≈67×)
4,48 → 4,06
средний балл качества из 5 в слепой оценке

Отдельный урок — про риск. Ночью у провайдера закончился баланс, но система восприняла сбой оплаты как обычную ошибку и продолжила ретраить — за ночь набежало около 16 000 «заведомо мёртвых вызовов». Денег не списалось (баланс был пуст), но весь батч оказался испорчен. Полный разбор — в статье на Хабре.

Источник: Habr
AI-разбор за 30 секунд
Сверим вашу нишу с внедрениями ИИ в похожие компании и покажем, где утекают заявки — за 30 секунд.
Пройти AI-разбор →
Новости

Новостная редакция llmcase.ru: разбираем новости про ИИ и что это значит для бизнеса в России. Каждая новость — со ссылкой на первоисточник. Больше материалов — в блоге автора.