Главное про AI - Вадим Жартун
Книгу Главное про AI - Вадим Жартун читаем онлайн бесплатно полную версию! Чтобы начать читать не надо регистрации. Напомним, что читать онлайн вы можете не только на компьютере, но и на андроид (Android), iPhone и iPad. Приятного чтения!
Шрифт:
Интервал:
Закладка:
Правило для офисного работника: промпт стабильно работает на 8+ примерах из 10 — задача не переросла промпт. Запускаете вручную больше 5 раз в неделю — пора оформлять навык. Навык используют 3+ человека или 30+ раз в неделю — пора думать о воркфлоу. Каждый переход — отдельное решение, не «давайте сразу воркфлоу, потому что так солиднее».
Каждый уровень оправдан, когда переход к нему отражает реальную частоту задачи, а не амбиции. Ручной шуруповёрт нужен, чтобы закрутить один шуруп. Станок — чтобы закручивать один и тот же шуруп в одном и том же месте каждый день. Конвейер — когда станок не успевает за спросом и шурупы надо закручивать тысячами в час. Проблема в том, что новички часто покупают конвейер, чтобы закрутить один шуруп. Обслуживать конвейер, чинить, перенастраивать, оплачивать электричество обходится дороже, чем сто раз взять шуруповёрт в руки.
FEW-SHOT: ОБУЧЕНИЕ МОДЕЛИ НА НЕСКОЛЬКИХ ПРИМЕРАХ
Few-shot — это приём, при котором в системный промпт добавляются несколько пар «вход — выход», чтобы модель увидела желаемый формат, метки и стиль. Модель не учится на этих примерах в привычном смысле. Она подстраивает своё поведение под форму, которую видит прямо сейчас в диалоге. Это как если бы новый сотрудник в первый день посмотрел три ваших письма клиенту и на четвёртом написал в той же интонации, с теми же формулами, с тем же уровнем формальности. Никакого переобучения, никакой магии — просто очень сильная имитация паттерна.
Anthropic прямо пишет: для LLM примеры — это «картинки, стоящие тысячи слов». Одно изображение объясняет больше, чем абзац определений.
ПРОИСХОЖДЕНИЕ ТЕРМИНА: GPT-3 КАК ТОЧКА ОТСЧЁТА
Термин few-shot в том смысле, в котором мы его сейчас используем, ввели Brown и соавторы в июле 2020 года в статье «Language Models are Few-Shot Learners» (arXiv:2005.14165) про GPT-3. До этого инженеры использовали словосочетание «in-context learning» — обучение в контексте, без обновления весов модели. Brown формализовали разницу между zero-shot (модель видит только инструкцию), one-shot (один пример) и few-shot (несколько примеров в контексте).
В их собственных экспериментах few-shot стабильно бил zero-shot на десятках бенчмарков: перевод, ответы на вопросы, заполнение пропусков, рассуждения. Парадокс, который они же подсветили: чем больше модель, тем сильнее эффект от few-shot, но и тем меньше нужно примеров. GPT-3 на 175 миллиардов параметров с десятью примерами обходил fine-tuned (дообученные на узкой задаче) модели меньшего размера, обученные на тысячах.
С тех пор каждый серьёзный гайд по промпт-инжинирингу начинается с few-shot как базовой техники.
КОНТРИНТУИТИВНЫЙ ВЫВОД 2022 ГОДА О НАЗНАЧЕНИИ ПРИМЕРОВ
Севон Мин (Sewon Min) и команда из Вашингтонского университета в EMNLP 2022 выпустили работу «Rethinking the Role of Demonstrations: What Makes In-Context Learning Work?», которая перевернула интуицию. Как мы уже обсуждали в разделе про блок «Примеры», в задачах классификации с ограниченным набором классов главное в примере не «правильный ответ», а карта пространства «вход → метка».
Когда метки в примерах заменяли на случайные, точность падала, но не катастрофически. А вот когда перемешивали метки между классами или убирали входной текст и оставляли только метки, точность падала заметно. Из этого простой вывод: в ваших few-shot примерах разнообразие входов важнее, чем вылизанность выходов. Лучше пять разных кейсов из реальной почты, чем пять идеально отредактированных образцов из методички.
ОПТИМАЛЬНОЕ ЧИСЛО ПРИМЕРОВ: ЭМПИРИКА ПО СЕМИ МОДЕЛЯМ
По данным работы «The Few-shot Dilemma: Over-prompting Large Language Models» команды из Siemens AG и Мюнхенского технического университета (сентябрь 2025), для каждой модели существует свой оптимум, и превышение его деградирует точность. GPT-4o даёт максимум на 5–10 примерах, а на 20 уже проседает. LLaMA-3.1-8B-instruct — оптимум 10–20 примеров, потом спад.
Самое практичное: TF-IDF-отбор примеров (по текстовому сходству с целевой задачей — это простой статистический метод, который оценивает важность слова в документе через частоту в нём и редкость во всей коллекции) бьёт случайную выборку и эмбеддинг-отбор (выбор примеров по близости векторных представлений текстов) в большинстве сценариев. Их итоговая модель с 10–20 примерами, отобранными через TF-IDF, превзошла state-of-the-art fine-tuned BERT на 1% по F1 (гармоническому среднему точности и полноты — метрике, которая штрафит модели, если они хороши только в чём-то одном). Цифра скромная, но вывод жёсткий: «больше примеров» — это не то же самое, что «лучший результат». Миф «чем длиннее промпт, тем лучше» получил формальное опровержение на семи моделях.
СОРТИРОВКА ВХОДЯЩИХ ПИСЕМ: PREFILL ЗАДАЁТ ФОРМАТ JSON
Задача из реальной практики: модель должна была классифицировать входящие письма по 11 категориям — претензия, запрос акта, запрос справки, оферта и так далее. Без few-shot лучший результат был 76% точности. С тремя примерами на категорию (33 примера) стало 89%. С пятнадцатью примерами на категорию (165 примеров) стало 84% — хуже, чем с тремя. Результат перепроверяли трижды, ошибки в подсчёте не было.
Модель начала «переобучаться на примерах»: ловила не категорию, а конкретные слова-маркеры из примеров и пропускала синонимы. После отсева лишних примеров и оставления 3–5 разнообразных на категорию точность зафиксировалась на 91%.
Этот кейс — маленькая иллюстрация того, что Min и команда показали теоретически, а Tang с коллегами доказали на семи моделях: примеров должно быть столько, чтобы покрыть пространство входов, а не столько, чтобы влезло в токен-бюджет (количество токенов, которое клиент готов потратить на один запрос, у каждого провайдера и тарифа он свой).
РЕКОМЕНДАЦИИ ANTHROPIC ИЗ ОФИЦИАЛЬНОГО ГАЙДА ПО FEW-SHOT
Anthropic в Effective Context Engineering для AI-агентов и в Claude Prompting Best Practices формулирует четыре практических правила.
Количество: 1–5 примеров могут резко улучшить результат, больше пяти — только по необходимости, не по привычке. Разнообразие: разнообразные, канонические примеры, эффективно отражающие ожидаемое поведение. Качество против количества: «не набивайте список граничных случаев» — угловые случаи не пихать в промпт пачкой. Формат: XML-теги или markdown-заголовки, чтобы отделить примеры от основной инструкции визуально.
Прочитали книгу? Предлагаем вам поделится своим отзывом от прочитанного(прослушанного)! Ваш отзыв будет полезен читателям, которые еще только собираются познакомиться с произведением.
Уважаемые читатели, слушатели и просто посетители нашей библиотеки! Просим Вас придерживаться определенных правил при комментировании литературных произведений.
- 1. Просьба отказаться от дискриминационных высказываний. Мы защищаем право наших читателей свободно выражать свою точку зрения. Вместе с тем мы не терпим агрессии. На сайте запрещено оставлять комментарий, который содержит унизительные высказывания или призывы к насилию по отношению к отдельным лицам или группам людей на основании их расы, этнического происхождения, вероисповедания, недееспособности, пола, возраста, статуса ветерана, касты или сексуальной ориентации.
- 2. Просьба отказаться от оскорблений, угроз и запугиваний.
- 3. Просьба отказаться от нецензурной лексики.
- 4. Просьба вести себя максимально корректно как по отношению к авторам, так и по отношению к другим читателям и их комментариям.
Надеемся на Ваше понимание и благоразумие. С уважением, администратор knigkindom.ru.
Оставить комментарий
-
Гость Наталья07 сентябрь 16:09
Хорошо. Старое дело, будет раскрыто.Прочитала с удовольствием. Люблю эту серию. ...
Забытое дело Калевалы - Анна Князева
-
Р.Д.У.22 август 02:17
...мне тоже понравился этот русский вестерн. И озвучено неплохо. Советую....
Силантьев Вадим – Засада
-
Гость Любовь21 август 20:01
Прочитала залпом.... интересный сюжет, история захватывает, плакала вместе с героями. спасибо автору за интересное...
Вернуть жену. Без права на прощение? - Ира Орлова
