KnigkinDom.org» » »📕 Главное про AI - Вадим Жартун

Главное про AI - Вадим Жартун

Книгу Главное про AI - Вадим Жартун читаем онлайн бесплатно полную версию! Чтобы начать читать не надо регистрации. Напомним, что читать онлайн вы можете не только на компьютере, но и на андроид (Android), iPhone и iPad. Приятного чтения!

1 ... 92 93 94 95 96 97 98 99 100 101
Перейти на страницу:

Шрифт:

-
+

Интервал:

-
+

Закладка:

Сделать
1.

Токенизация — процесс разбиения текста на токены перед подачей в модель. См. главу 1.

Трансформер (transformer) — архитектура нейросети, придуманная в 2017 году (статья «Attention Is All You Need»); основа всех современных LLM. Ключевое свойство — параллелизуемость на видеокартах благодаря self-attention. См. главу 1.

Цепочка рассуждений (CoT, chain-of-thought) — техника, при которой модель явно показывает промежуточные шаги рассуждения. См. главу 2.

Эмерджентность (emergence) — кажущиеся резкие скачки в способностях модели при увеличении размера; Стэнфордская работа Schaeffer, Miranda и Koyejo показала, что «скачки» могут быть артефактом способа измерения и при смене метрики зависимость становится гладкой («мираж эмерджентности»). См. главу 1.

ГЛОССАРИЙ: АНГЛОЯЗЫЧНЫЕ ТЕРМИНЫ И АББРЕВИАТУРЫ

AGI (Artificial General Intelligence) — гипотетический уровень AI, способный решать любые интеллектуальные задачи на уровне человека или выше; в 2026 году не достигнут. См. главу 15.

ATLAS — Adversarial Threat Landscape for AI Systems; матрица угроз MITRE для AI-систем (по аналогии с MITRE ATT&CK для кибербезопасности); каталог тактик и техник атак на ML-системы. См. главу 16.

BANI — Brittle, Anxious, Non-linear, Incomprehensible; фреймворк описания мира после пандемии COVID-19 (2020), пришедший на смену VUCA; используется в обсуждениях внедрения AI в условиях неопределённости. См. главы 14, 15. CFG — Classifier-Free Guidance; метод в диффузионных моделях, при котором сила следования текстовому промпту управляется отдельным параметром guidance_scale (обычно 5–15). См. главу 10.

CoT (Chain-of-Thought) — см. «Цепочка рассуждений». См. главу 2.

CPU (Central Processing Unit) — центральный процессор; в книге обсуждается в контексте запуска локальных моделей. См. главу 5.

CUDA — язык программирования и платформа для вычислений на GPU, выпущенная NVIDIA в 2007 году; на нём написан код AlexNet, разрезавший нейросеть между двумя GTX 580. См. главу 1.

EU AI Act — закон Европейского союза об искусственном интеллекте, вступивший в силу в 2024 году с поэтапным применением до 2026–2027 годов. См. главу 17.

centaur-модель — модель сотрудничества человека и AI, в которой человек ставит вопрос и принимает финальное решение, а AI делает черновой обзор и поиск; термин из шахмат 1998 года (Каспаров, Advanced Chess). См. главу 3. VUCA — Volatility, Uncertainty, Complexity, Ambiguity; фреймворк описания нестабильного мира (1990-е, военная академия США); в 2020-е годы дополнен BANI. См. главы 14, 15. few-shot prompting — техника промптинга, при которой в запрос включается 2–5 примеров «вопрос-ответ» для управления форматом и тоном ответа модели. См. главы 2, 6.

fine-tuning — дообучение модели на собственных парах «вопрос-ответ» с подкруткой её внутренних весов; самая дорогая из трёх операций адаптации (промпт, RAG, дообучение). См. главы 2, 5.

FP16 — 16-битное число с плавающей точкой; формат хранения весов модели, дающий компромисс между точностью и памятью; половинная точность относительно FP32. См. главу 5.

GGUF — формат квантованных весов модели, используемый llama.cpp и Ollama; единый формат для распространения локальных моделей с разными уровнями квантования. См. главу 5.

GPU (Graphics Processing Unit) — графический процессор; основное железо для запуска современных моделей. См. главу 5.

GSM8K (Grade School Math 8K) — бенчмарк из 8,5 тысячи математических задач школьного уровня; классический тест на цепочку рассуждений. См. главу 4.

HumanEval — бенчмарк для оценки способности модели писать код; используется OpenAI и другими лабораториями. См. главу 4.

image-in (vision-in) — способность модели распознавать картинку, приложенную к сообщению; один из двух модов мультимодальности. См. главу 1.

image-out — способность модели генерировать картинку прямо в чате без отдельного сервиса; почти всегда означает гибридную архитектуру. См. главу 1.

KV-кэш — Key-Value cache; механизм кэширования ранее вычисленных проекций self-attention для ускорения генерации; основной потребитель VRAM при длинных контекстах. См. главы 4, 5.

llama.cpp — C++ реализация инференса LLaMA-моделей; поддерживает квантование (GGUF) и запуск на CPU/GPU на пользовательском железе. См. главу 5.

LLM (Large Language Model) — большая языковая модель; класс нейросетей на архитектуре трансформер, обученных на терабайтах текста предсказывать следующий токен. Основа современных AI-чатботов. См. главу 1.

LLM01 — код уязвимости в OWASP Top 10 for LLM (Prompt Injection); атака, при которой вредоносные инструкции встраиваются в пользовательский ввод и переопределяют поведение модели. См. главу 16.

LLM04 — код уязвимости в OWASP Top 10 for LLM (Model Denial of Service); атака, при которой специально сконструированный запрос заставляет модель потреблять аномально много ресурсов. См. главу 16.

LoRA (Low-Rank Adaptation) — метод тонкой настройки модели через обучение матриц малого ранга; позволяет адаптировать большую модель с минимальными затратами памяти. См. главу 5.

MCP (Model Context Protocol) — открытый протокол подключения AI-агентов к внешним инструментам и данным; разработан Anthropic, принят индустрией в 2024–2025 годах. См. главу 7.

MITRE ATT&CK — база знаний MITRE о тактиках и техниках кибератак; в AI-контексте — модельный фреймворк для классификации атак на AI-системы (ATLAS). См. главу 16.

MMLU (Massive Multitask Language Understanding) — бенчмарк из ~16 тысяч вопросов по 57 академическим предметам; стандарт для оценки общей эрудиции модели. См. главу 4.

MoE (Mixture of Experts) — архитектура, при которой модель состоит из нескольких специализированных подмоделей и для каждого токена выбирается своя; снижает стоимость инференса без потери качества. См. главу 1.

MVP — Minimum Viable Product; минимально жизнеспособный продукт; в AI-контексте — пилотная версия AI-решения для проверки гипотезы перед полноценным внедрением. См. главу 14.

NANDA — MIT NANDA (Networked Agents Deciding AI); проект MIT по исследованию реального состояния AI-пилотов в компаниях; в отчёте 2025 года зафиксировал 95% AI-пилотов без ROI. См. главы 8, 14, 15.

NPU — Neural Processing Unit; выделенный процессор на устройстве для ускорения AI-инференса (Apple Neural Engine, Qualcomm Hexagon); снижает энергопотребление AI-задач на устройстве. См. главы 9, 15.

Ollama — инструмент для запуска открытых моделей на локальной машине; один из трёх стеков (Ollama, vLLM, llama.cpp), обсуждаемых в главе 5. См. главу 5.

on-prem (on-premises) — локальная установка модели на серверах компании; для российских моделей часто единственный способ соответствия ФЗ-152. См. главу 1.

OOM — Out Of Memory; ошибка нехватки памяти GPU при попытке загрузить или обработать слишком большую модель или батч; ключевое ограничение для локальных моделей. См. главу 5.

OWASP Top 10 for LLM — ежегодный список 10 главных уязвимостей LLM-приложений по версии OWASP; включает prompt injection, insecure output handling, training data poisoning, model denial of service и другие. См. главу 16.

pass@k — метрика качества генерации кода: доля задач, для которых хотя бы одно из k сгенерированных решений проходит тесты. См.

1 ... 92 93 94 95 96 97 98 99 100 101
Перейти на страницу:
Отзывы - 0

Прочитали книгу? Предлагаем вам поделится своим отзывом от прочитанного(прослушанного)! Ваш отзыв будет полезен читателям, которые еще только собираются познакомиться с произведением.


Уважаемые читатели, слушатели и просто посетители нашей библиотеки! Просим Вас придерживаться определенных правил при комментировании литературных произведений.

  • 1. Просьба отказаться от дискриминационных высказываний. Мы защищаем право наших читателей свободно выражать свою точку зрения. Вместе с тем мы не терпим агрессии. На сайте запрещено оставлять комментарий, который содержит унизительные высказывания или призывы к насилию по отношению к отдельным лицам или группам людей на основании их расы, этнического происхождения, вероисповедания, недееспособности, пола, возраста, статуса ветерана, касты или сексуальной ориентации.
  • 2. Просьба отказаться от оскорблений, угроз и запугиваний.
  • 3. Просьба отказаться от нецензурной лексики.
  • 4. Просьба вести себя максимально корректно как по отношению к авторам, так и по отношению к другим читателям и их комментариям.

Надеемся на Ваше понимание и благоразумие. С уважением, администратор knigkindom.ru.


Партнер

Новые отзывы

  1. Гость Наталья Гость Наталья07 сентябрь 16:09 Хорошо. Старое дело, будет раскрыто.Прочитала с удовольствием. Люблю эту серию. ... Забытое дело Калевалы - Анна Князева
  2. Р.Д.У. Р.Д.У.22 август 02:17 ...мне тоже понравился этот русский вестерн. И озвучено неплохо. Советую.... Силантьев Вадим – Засада
  3. Гость Любовь Гость Любовь21 август 20:01 Прочитала залпом.... интересный сюжет, история захватывает, плакала вместе с героями. спасибо автору за интересное... Вернуть жену. Без права на прощение? - Ира Орлова
Все комметарии
Новое в блоге