Главное про AI - Вадим Жартун
Книгу Главное про AI - Вадим Жартун читаем онлайн бесплатно полную версию! Чтобы начать читать не надо регистрации. Напомним, что читать онлайн вы можете не только на компьютере, но и на андроид (Android), iPhone и iPad. Приятного чтения!
Шрифт:
Интервал:
Закладка:
Токенизация — процесс разбиения текста на токены перед подачей в модель. См. главу 1.
Трансформер (transformer) — архитектура нейросети, придуманная в 2017 году (статья «Attention Is All You Need»); основа всех современных LLM. Ключевое свойство — параллелизуемость на видеокартах благодаря self-attention. См. главу 1.
Цепочка рассуждений (CoT, chain-of-thought) — техника, при которой модель явно показывает промежуточные шаги рассуждения. См. главу 2.
Эмерджентность (emergence) — кажущиеся резкие скачки в способностях модели при увеличении размера; Стэнфордская работа Schaeffer, Miranda и Koyejo показала, что «скачки» могут быть артефактом способа измерения и при смене метрики зависимость становится гладкой («мираж эмерджентности»). См. главу 1.
ГЛОССАРИЙ: АНГЛОЯЗЫЧНЫЕ ТЕРМИНЫ И АББРЕВИАТУРЫ
AGI (Artificial General Intelligence) — гипотетический уровень AI, способный решать любые интеллектуальные задачи на уровне человека или выше; в 2026 году не достигнут. См. главу 15.
ATLAS — Adversarial Threat Landscape for AI Systems; матрица угроз MITRE для AI-систем (по аналогии с MITRE ATT&CK для кибербезопасности); каталог тактик и техник атак на ML-системы. См. главу 16.
BANI — Brittle, Anxious, Non-linear, Incomprehensible; фреймворк описания мира после пандемии COVID-19 (2020), пришедший на смену VUCA; используется в обсуждениях внедрения AI в условиях неопределённости. См. главы 14, 15. CFG — Classifier-Free Guidance; метод в диффузионных моделях, при котором сила следования текстовому промпту управляется отдельным параметром guidance_scale (обычно 5–15). См. главу 10.
CoT (Chain-of-Thought) — см. «Цепочка рассуждений». См. главу 2.
CPU (Central Processing Unit) — центральный процессор; в книге обсуждается в контексте запуска локальных моделей. См. главу 5.
CUDA — язык программирования и платформа для вычислений на GPU, выпущенная NVIDIA в 2007 году; на нём написан код AlexNet, разрезавший нейросеть между двумя GTX 580. См. главу 1.
EU AI Act — закон Европейского союза об искусственном интеллекте, вступивший в силу в 2024 году с поэтапным применением до 2026–2027 годов. См. главу 17.
centaur-модель — модель сотрудничества человека и AI, в которой человек ставит вопрос и принимает финальное решение, а AI делает черновой обзор и поиск; термин из шахмат 1998 года (Каспаров, Advanced Chess). См. главу 3. VUCA — Volatility, Uncertainty, Complexity, Ambiguity; фреймворк описания нестабильного мира (1990-е, военная академия США); в 2020-е годы дополнен BANI. См. главы 14, 15. few-shot prompting — техника промптинга, при которой в запрос включается 2–5 примеров «вопрос-ответ» для управления форматом и тоном ответа модели. См. главы 2, 6.
fine-tuning — дообучение модели на собственных парах «вопрос-ответ» с подкруткой её внутренних весов; самая дорогая из трёх операций адаптации (промпт, RAG, дообучение). См. главы 2, 5.
FP16 — 16-битное число с плавающей точкой; формат хранения весов модели, дающий компромисс между точностью и памятью; половинная точность относительно FP32. См. главу 5.
GGUF — формат квантованных весов модели, используемый llama.cpp и Ollama; единый формат для распространения локальных моделей с разными уровнями квантования. См. главу 5.
GPU (Graphics Processing Unit) — графический процессор; основное железо для запуска современных моделей. См. главу 5.
GSM8K (Grade School Math 8K) — бенчмарк из 8,5 тысячи математических задач школьного уровня; классический тест на цепочку рассуждений. См. главу 4.
HumanEval — бенчмарк для оценки способности модели писать код; используется OpenAI и другими лабораториями. См. главу 4.
image-in (vision-in) — способность модели распознавать картинку, приложенную к сообщению; один из двух модов мультимодальности. См. главу 1.
image-out — способность модели генерировать картинку прямо в чате без отдельного сервиса; почти всегда означает гибридную архитектуру. См. главу 1.
KV-кэш — Key-Value cache; механизм кэширования ранее вычисленных проекций self-attention для ускорения генерации; основной потребитель VRAM при длинных контекстах. См. главы 4, 5.
llama.cpp — C++ реализация инференса LLaMA-моделей; поддерживает квантование (GGUF) и запуск на CPU/GPU на пользовательском железе. См. главу 5.
LLM (Large Language Model) — большая языковая модель; класс нейросетей на архитектуре трансформер, обученных на терабайтах текста предсказывать следующий токен. Основа современных AI-чатботов. См. главу 1.
LLM01 — код уязвимости в OWASP Top 10 for LLM (Prompt Injection); атака, при которой вредоносные инструкции встраиваются в пользовательский ввод и переопределяют поведение модели. См. главу 16.
LLM04 — код уязвимости в OWASP Top 10 for LLM (Model Denial of Service); атака, при которой специально сконструированный запрос заставляет модель потреблять аномально много ресурсов. См. главу 16.
LoRA (Low-Rank Adaptation) — метод тонкой настройки модели через обучение матриц малого ранга; позволяет адаптировать большую модель с минимальными затратами памяти. См. главу 5.
MCP (Model Context Protocol) — открытый протокол подключения AI-агентов к внешним инструментам и данным; разработан Anthropic, принят индустрией в 2024–2025 годах. См. главу 7.
MITRE ATT&CK — база знаний MITRE о тактиках и техниках кибератак; в AI-контексте — модельный фреймворк для классификации атак на AI-системы (ATLAS). См. главу 16.
MMLU (Massive Multitask Language Understanding) — бенчмарк из ~16 тысяч вопросов по 57 академическим предметам; стандарт для оценки общей эрудиции модели. См. главу 4.
MoE (Mixture of Experts) — архитектура, при которой модель состоит из нескольких специализированных подмоделей и для каждого токена выбирается своя; снижает стоимость инференса без потери качества. См. главу 1.
MVP — Minimum Viable Product; минимально жизнеспособный продукт; в AI-контексте — пилотная версия AI-решения для проверки гипотезы перед полноценным внедрением. См. главу 14.
NANDA — MIT NANDA (Networked Agents Deciding AI); проект MIT по исследованию реального состояния AI-пилотов в компаниях; в отчёте 2025 года зафиксировал 95% AI-пилотов без ROI. См. главы 8, 14, 15.
NPU — Neural Processing Unit; выделенный процессор на устройстве для ускорения AI-инференса (Apple Neural Engine, Qualcomm Hexagon); снижает энергопотребление AI-задач на устройстве. См. главы 9, 15.
Ollama — инструмент для запуска открытых моделей на локальной машине; один из трёх стеков (Ollama, vLLM, llama.cpp), обсуждаемых в главе 5. См. главу 5.
on-prem (on-premises) — локальная установка модели на серверах компании; для российских моделей часто единственный способ соответствия ФЗ-152. См. главу 1.
OOM — Out Of Memory; ошибка нехватки памяти GPU при попытке загрузить или обработать слишком большую модель или батч; ключевое ограничение для локальных моделей. См. главу 5.
OWASP Top 10 for LLM — ежегодный список 10 главных уязвимостей LLM-приложений по версии OWASP; включает prompt injection, insecure output handling, training data poisoning, model denial of service и другие. См. главу 16.
pass@k — метрика качества генерации кода: доля задач, для которых хотя бы одно из k сгенерированных решений проходит тесты. См.
Прочитали книгу? Предлагаем вам поделится своим отзывом от прочитанного(прослушанного)! Ваш отзыв будет полезен читателям, которые еще только собираются познакомиться с произведением.
Уважаемые читатели, слушатели и просто посетители нашей библиотеки! Просим Вас придерживаться определенных правил при комментировании литературных произведений.
- 1. Просьба отказаться от дискриминационных высказываний. Мы защищаем право наших читателей свободно выражать свою точку зрения. Вместе с тем мы не терпим агрессии. На сайте запрещено оставлять комментарий, который содержит унизительные высказывания или призывы к насилию по отношению к отдельным лицам или группам людей на основании их расы, этнического происхождения, вероисповедания, недееспособности, пола, возраста, статуса ветерана, касты или сексуальной ориентации.
- 2. Просьба отказаться от оскорблений, угроз и запугиваний.
- 3. Просьба отказаться от нецензурной лексики.
- 4. Просьба вести себя максимально корректно как по отношению к авторам, так и по отношению к другим читателям и их комментариям.
Надеемся на Ваше понимание и благоразумие. С уважением, администратор knigkindom.ru.
Оставить комментарий
-
Гость Наталья07 сентябрь 16:09
Хорошо. Старое дело, будет раскрыто.Прочитала с удовольствием. Люблю эту серию. ...
Забытое дело Калевалы - Анна Князева
-
Р.Д.У.22 август 02:17
...мне тоже понравился этот русский вестерн. И озвучено неплохо. Советую....
Силантьев Вадим – Засада
-
Гость Любовь21 август 20:01
Прочитала залпом.... интересный сюжет, история захватывает, плакала вместе с героями. спасибо автору за интересное...
Вернуть жену. Без права на прощение? - Ира Орлова
