0
рейтинг

1
0
Есть ответы

Small Language Models: когда меньше — значит лучше

Малые языковые модели

Гонка за размером создала впечатление, что больше — всегда лучше. Для открытых вопросов о мире это верно. Для большинства производственных задач — нет, и разница в цене и скорости настолько велика, что вопрос стоит рассматривать всерьёз.

Малой обычно называют модель до 7-8 миллиардов параметров. Такая запускается на обычной видеокарте, отвечает за доли секунды и в пакетной обработке стоит в десятки раз дешевле флагмана.

Где малая модель не хуже

ЗадачаПочему хватает
Классификация текстаНужен выбор из списка, а не рассуждение
Извлечение полей из шаблонного текстаСтруктура повторяется, вариативность мала
Нормализация и переформатированиеМеханическое преобразование
Оценка тональности и разметкаПростой критерий, большой объём
Маршрутизация запросовРешение из нескольких вариантов за миллисекунды
Ответы по своей базе знанийЗнание берётся из документа, не из модели

Последняя строка самая важная. В схеме, где нужный текст находит поиск, а модель только формулирует ответ по найденному, эрудиция модели почти не нужна — нужна аккуратность в следовании тексту. Малые модели с этим справляются.

Где заметно проигрывают

  • Длинные цепочки рассуждений. Многошаговые задачи, где ошибка на третьем шаге ломает всё.
  • Редкие знания. Специальные области, малораспространённые языки и библиотеки.
  • Сложные составные инструкции. Промт с восемью условиями будет выполнен частично.
  • Длинный контекст. Формально поддерживают, фактически теряют детали из середины.
  • Творческие задачи. Заметно однообразнее.

Как проверить, хватит ли малой

1. Соберите 100 реальных примеров вашей задачи с известными правильными ответами.
2. Прогоните через флагманскую модель — это ваш потолок качества.
3. Прогоните через малую с тем же промтом.
4. Посчитайте разницу в доле правильных ответов.
5. Посчитайте разницу в стоимости и в задержке на вашем месячном объёме.
6. Решайте: если разрыв в качестве 2-3 процента, а в цене — десятки раз, ответ очевиден.

Отдельно посмотрите, где именно ошибается малая. Если ошибки сосредоточены
в узнаваемом классе случаев, их можно отправлять на большую модель.

Приёмы, которые вытягивают малую модель

  1. Сузить задачу. Один промт — одно действие. Составные инструкции разбить на цепочку простых.
  2. Дать примеры. Два-три образца ответа в промте поднимают качество сильнее, чем на больших моделях.
  3. Жёстко задать формат. Перечислить допустимые варианты ответа явно.
  4. Убрать необходимость знать. Всё нужное — в контексте, из ваших документов.
  5. Дообучить. На узкой задаче с несколькими сотнями примеров дообученная малая модель часто обходит флагман без дообучения — и это самый недооценённый ход.

Двухуровневая схема

Практичнее всего не выбирать, а сочетать: малая модель обрабатывает поток и помечает случаи, в которых не уверена, флагман разбирает только их. При типичном распределении наверх уходит 10-20% объёма, а итоговое качество почти не отличается от флагманского при кратно меньшей стоимости.

Промт для нижнего уровня:
Классифицируй [объект] в одну из категорий: [список].
Если признаков недостаточно для уверенного выбора — верни «неопределённо».
Не выбирай наугад. «Неопределённо» — нормальный ответ.
Верни только название категории, без пояснений.

Разрешение отвечать «неопределённо» — то, что делает схему рабочей. Без него малая модель угадывает, и брак уходит дальше незамеченным.

Конкретные названия и версии малых моделей здесь не приводятся: список обновляется каждые несколько месяцев. Критерии применимости и двухуровневая схема от этого не зависят.

Похожие вопросы

1 ответ

обсуждение открыто
0
27 августа 2026 00:12
Вы прислали целую статью/разбор темы, но не задали конкретный вопрос. Что именно нужно сделать с этим материалом?

Уточните, пожалуйста:
1. Краткое резюме (bullet-points)?
2. Чек-лист для принятия решения «малая или большая модель»?
3. Код/псевдокод двухуровневой схемы (router + fallback)?
4. Промпты для классификатора «неопределённо» и для флагмана?
5. Сравнительная таблица задач (где выигрывает 7B, где проигрывает)?
6. Что-то другое — напишите, что именно.

Ответ сгенерирован ИИ автоматически, потому что вопрос какое-то время оставался без ответа. Проверьте важные детали и поправьте, если что-то не так — живой ответ всегда ценнее.

Добавление комментария

Не публикуется. Нужен для уведомлений об ответах.
Отвечайте по существу: решение, а не «у меня то же самое».
Кликните на изображение чтобы обновить код, если он неразборчив