Принцип, по которому отбирать сценарии
Рабочий критерий один: задача должна быть текстовой, повторяемой и с проверяемым результатом. Если результат легко проверить глазом за секунды — модель подходит. Если цена ошибки высока и проверка занимает столько же, сколько сама работа, — экономии не будет.
Второй критерий — объём. Один ответ в неделю не сэкономит ничего, даже если он идеален. Считать надо на потоке: 50 сообщений в день, 200 карточек товара в месяц, 10 входящих счетов в неделю. Именно поток превращает «интересную игрушку» в экономику.
Начинать с самой сложной задачи — «пусть ИИ ведёт переговоры с клиентами». Сложные задачи требуют дообучения, регламентов и контроля, а окупаются хуже, чем скучная рутина. Правильный первый шаг — самое массовое и самое тупое действие в компании.
12 сценариев и сколько часов они дают
Оценки ниже — оценки по опыту типовой компании 3–15 человек, а не замеры конкретного бизнеса. Диапазон часов показывает, насколько разными бывают процессы. Проверять надо на своих цифрах — методика расчёта в разделе про экономику.
| № | Сценарий | Что делает модель | Модель | Часы/мес (оценка) |
|---|---|---|---|---|
| 1 | Автоответы на Авито, в мессенджерах, в Telegram | Понимает вопрос целиком, а не ищет ключевые слова; отвечает по вашей базе знаний, сложное передаёт человеку | GLM, DeepSeek Flash | 25–48 |
| 2 | Первая линия поддержки | Снимает типовые обращения: статус заказа, сроки, возврат, гарантия | GLM, Qwen | 20–44 |
| 3 | Описания товаров для маркетплейсов | Из характеристик собирает карточку, заголовок и SEO-текст по шаблону площадки | Qwen, DeepSeek Flash | 15–32 |
| 4 | Контент для соцсетей и рассылок | Черновики постов, письма клиентам, анонсы, ответы на отзывы | DeepSeek Flash, GLM | 10–24 |
| 5 | Разбор входящих документов | Счета, накладные, договоры → структурированная таблица; выделение сроков и сумм | Qwen, Kimi | 8–16 |
| 6 | Коммерческие предложения | Собирает КП из вашего прайса и брифа клиента за минуты вместо часа | DeepSeek Pro | 6–13 |
| 7 | Скрининг резюме при найме | Сопоставляет резюме с требованиями и формирует шорт-лист с обоснованием | Qwen, DeepSeek Flash | 6–10 |
| 8 | Регламенты и инструкции | Превращает рассказ сотрудника в инструкцию, чек-лист или памятку | DeepSeek Pro | 5–8 |
| 9 | Тендеры и требования заказчика | Выжимка по документу на 100 страниц: требования, сроки, риски | Kimi, Qwen | 8–15 |
| 10 | Переписка с китайским поставщиком | Перевод CN ↔ RU, сверка условий, понятная сводка по сделке | Qwen | 4–8 |
| 11 | Разбор звонков и переписок | Тональность, частые причины обращений, выявление проблемных мест | DeepSeek Flash | 6–12 |
| 12 | Внутренняя база знаний | Ответ на вопрос «как у нас принято действовать» по регламентам компании | Qwen, GLM | 4–10 |
Автоматизация выгодна не там, где задача умная, а там, где она повторяется сотни раз в месяц и её результат проверяется за пять секунд.
Какую модель под какой сценарий
Модели отличаются не «умом вообще», а профилем: цена, скорость, длина контекста, качество рассуждений. Для малого бизнеса это значит, что одна и та же задача может стоить в разы дешевле при правильном выборе.
| Задача | Что важно | Кого выбрать |
|---|---|---|
| Массовые короткие ответы | Цена за токен, скорость | GLM |
| Рассуждения, нестандартные формулировки | Качество ответа | DeepSeek V4-Pro |
| Рутинные тексты на потоке | Цена при достаточном качестве | DeepSeek V4-Flash |
| Документы, таблицы, перевод с китайского | Длинный контекст, язык | Qwen |
| Документ на сотни страниц в одном запросе | Длина контекста | Kimi |
Практический приём: не привязывайтесь к одной модели в коде. Пусть название модели будет параметром — тогда на изменении условий вендора вы меняете одну строку конфигурации, а не переписываете продукт. Именно на этом строится мультимодельность: один ключ и один адрес API для всех моделей.
Как считать экономику своей компании
Простая формула, которая не врёт: выберите один процесс, замерьте его в часах за месяц, оцените стоимость часа сотрудника и долю операций, которые модель закроет без правок.
| Параметр | Как получить | Пример |
|---|---|---|
| Объём процесса | Сколько операций в месяц | 600 ответов |
| Время на операцию | Хронометраж 10 операций × среднее | 3 мин |
| Всего часов | Объём × время ÷ 60 | 30 ч |
| Доля автоматизации | Сколько операций модель закроет целиком | 60 % |
| Возвращённые часы | Всего часов × доля | 18 ч |
| Стоимость часа | Оклад ÷ рабочие часы | 450 ₽ |
| Эффект в деньгах | Часы × стоимость | 8 100 ₽/мес |
Расходы на токены для такого объёма при коротких ответах — единицы тысяч рублей в месяц, то есть на порядок меньше эффекта. Но помните: экономия появится в отчёте только тогда, когда освободившиеся часы руководство перераспределит. Иначе вы просто получите более расслабленного сотрудника на той же зарплате.
Все цифры выше — оценки по типовым процессам. Реальный эффект зависит от качества ваших регламентов и от того, насколько процесс вообще формализуем. Ставьте эксперимент на одном процессе и замеряйте две недели.
Где ИИ не поможет
Честный список экономит больше денег, чем любой промпт-инженер.
- Юридические и медицинские решения. Модель соберёт информацию и оформит документ, но ответственность за решение не берёт. Финальное слово — за специалистом.
- Финансовый учёт и налоги. Считать налоги «через чат» — плохая идея: ошибка дороже экономии. Модель годится для черновиков и объяснений, не для проводок.
- Ценообразование на живом рынке. Без доступа к вашим свежим данным модель выдаст усреднённую логику и уверенный, но неверный ответ.
- Задачи с личной ответственностью перед клиентом. Переписка, где каждое слово — обязательство, требует человеческого прочтения перед отправкой.
- Персональные данные третьих лиц в промпте. Отправляя чужие ФИО, телефоны и адреса в модель, вы создаёте себе работу по 152-ФЗ. Данные лучше обезличивать до отправки.
С чего начать за две недели
Найдите узкое место
Спросите сотрудников, какое повторяющееся действие раздражает их сильнее всего. Обычно это ответы клиентам или оформление однотипных текстов.
Соберите базу знаний
Выгрузите в один файл: прайс, условия доставки, гарантию, ответы на 20 частых вопросов. Модель без ваших фактов начнёт фантазировать.
Сделайте черновик сценария
Проверьте на 50 реальных обращениях из истории. Считайте долю ответов, которые вы отправили бы клиенту без правок.
Оставьте человека в контуре
Первую неделю сотрудник подтверждает каждый ответ. Это ловит ошибки раньше, чем они станут репутационной проблемой.
Замерьте и решите
Сравните время обработки до и после. Если выигрыш меньше 20 % — меняйте сценарий, а не инструмент.
- Автоматизируйте массовую рутину, а не самое сложное действие в компании.
- Выбирайте модель под задачу: дешёвая модель на потоке даёт больше экономии, чем флагман «на всякий случай».
- Считайте часы, а не «магию»: объём × время × доля автоматизации.
- Оставляйте человека в контуре до тех пор, пока не увидите стабильное качество на реальных данных.
- Держите модель параметром конфигурации — тогда смена вендора не станет переписыванием продукта.