KnigkinDom.org» » »📕 Главное про AI - Вадим Жартун

Главное про AI - Вадим Жартун

Книгу Главное про AI - Вадим Жартун читаем онлайн бесплатно полную версию! Чтобы начать читать не надо регистрации. Напомним, что читать онлайн вы можете не только на компьютере, но и на андроид (Android), iPhone и iPad. Приятного чтения!

1 ... 18 19 20 21 22 23 24 25 26 ... 101
Перейти на страницу:

Шрифт:

-
+

Интервал:

-
+

Закладка:

Сделать
ответов, чат-ботов, bulk-операций. Alice AI LLM — лидер SLAVA с фокусом на разговорных ассистентах. С июля 2025 года «Чат с Алисой» в режиме Pro и рассуждения бесплатен для пользователя — это меняет экономику для b2c-сценариев.

Kandinsky — отдельная ветка моделей Сбера для генерации изображений и видео, не часть GigaChat, но встроенная в его интерфейс. Актуальная линейка — Kandinsky 5.0 (ноябрь 2025), три модели: Image Lite (универсальная, HD-картинки), Video Pro (10-секундные видео в разных форматах), Video Lite (2 миллиарда параметров, оптимизирован под скорость), все с открытыми весами. Что Kandinsky умеет по делу: генерация иллюстраций для презентаций и соцсетей, доработка изображений (inpainting — дорисовка части картинки по маске), генерация видео до 10 секунд по текстовому описанию или по стартовому кадру. Разрешение — от SD (720×576) до HD (1280×720). По независимым тестам, Kandinsky 5.0 Lite по качеству превосходит предыдущее поколение, но по детализации и фотореализму уступает Midjourney v6 и DALL-E 3. Это рабочий инструмент для офисных задач, а не конкурент топовым западным генераторам. Исторически Kandinsky — одна из первых публичных мультимодальных моделей на кириллице: с 2022 года поддерживает русскоязычные промпты на уровне, где западные генераторы требовали английского. Для офиса это и есть преимущество.

ОТКРЫТАЯ ВЕТКА РАЗРАБОТКИ

Параллельно с коммерческими GigaChat и YandexGPT в России развивается открытая ветка — модели с публичными весами, которые можно запустить локально или дообучить под себя. Открытые семейства: Saiga (на основе Llama, instruction-tuning на русском), Vikhr (на основе Mistral с усиленным вниманием к русской морфологии), T-pro 2.0 (гибридная модель рассуждения от Тинькофф; препринт опубликован в декабре 2025), RuadaptQwen (Qwen3 с расширенным русским словарём). Все опубликованы на Hugging Face.

Смысл открытой ветки: компания, которой нужно запустить LLM на своём сервере (по требованию импортозамещения, по соображениям безопасности, по экономии), получает готовую модель с крепкой русской базой. Тинькофф в T-pro 2.0 приводит цифры: их токенизатор даёт 0,45 токенов на слово на типичном русском новостном корпусе против 0,65 у GigaChat 2 Max. Это 30% экономии на обработке при том же качестве. Для пакетной обработки документов такая разница — десятки тысяч рублей в месяц.

ЮРИДИЧЕСКИЙ КОНТЕКСТ: «СВОЙ» ИИ ПО ТРЕБОВАНИЮ РЕГУЛЯТОРА

С 1 января 2025 года в России действует прямой запрет на использование иностранного ПО на значимых объектах критической информационной инфраструктуры (КИИ). Он оформлен Указом Президента РФ от 30 марта 2022 года № 166 (о запрете использования иностранного ПО на объектах КИИ) и Указом от 1 мая 2022 года № 250 (о дополнительных мерах по импортозамещению). Это означает, что банки, госкорпорации, операторы связи, энергетики, транспортники обязаны перейти на отечественные решения.

AI-модели в указах № 166 и № 250 прямо не упомянуты. Формально это требование к программному обеспечению, и LLM в нём — серая зона. Поэтому компании должны сами оценивать риски и консультироваться с регулятором (Минцифры, ФСТЭК) для разъяснения применимости к своим сценариям. Параллельно работает реестр отечественного ПО (Минцифры), куда попадают сертифицированные продукты, и требования ФЗ-152 «О персональных данных», которые для гостайны и критической инфраструктуры исключают передачу данных на зарубежные серверы без жёстких процедур.

GigaChat и YandexGPT включены в реестр. У YandexGPT есть сертификат ISO/IEC 42001 (по заявлению Яндекса — первый среди российских AI-сервисов). Для компании, которая работает с персональными данными, государственной тайной или просто входит в список КИИ, использование западной модели в облаке — не вопрос цены. Это вопрос допуска.

Из общедоступных данных: модели с большой долей русскоязычных данных в обучении (YandexGPT 5.1 Pro, GigaChat 2 Max, Alice AI LLM) лучше работают с бытовым русским, но уступают западным моделям в сложных reasoning-задачах на русском. Западные модели с большим контекстом (Claude Opus 4.7, GPT-5.5) компенсируют недостаток данных в обучении через длинный контекст, в который можно загрузить всю переписку. Это работает, только если у вас есть что загружать (корпоративный контекст) и если API разрешает.

РОССИЙСКИЕ МОДЕЛИ ПРОТИВ ЗАПАДНЫХ: СПОРНАЯ ТЕРРИТОРИЯ

Четыре места, где разрыв объективен.

1: Универсальные знания о мире: GigaChat Ultra в режиме рассуждения в собственных тестах Сбера проседает на точных расчётах. Заявление Яндекса о превосходстве YandexGPT 5.1 Pro над GPT-4.1 (упомянуто выше) не имеет независимого подтверждения.

2: Кодинг: на SWE-bench и Terminal-Bench лидеры — Claude Opus 4.7 (82% на SWE-bench Verified на 1 мая 2026) и GPT-5.5. GigaChat с YandexGPT в этих рейтингах не участвуют, и независимых данных по их кодинг-способностям на уровне сложных задач нет. Для типовых задач (шаблонный код, объяснение существующего, мелкий рефакторинг) российские модели работают. Для серьёзной инженерной работы — нет.

3: Мультиязычность: российские модели обучены преимущественно на русском и английском. На других языках (китайский, хинди, арабский) они проседают. Qwen3, DeepSeek V3, GPT-5.5, Gemini 3.1 Pro здесь сильнее. Если в команде есть потребность в третьем-четвёртом языке, российская модель её не закрывает.

4: Экосистема инструментов: у OpenAI и Anthropic развитые SDK (наборы для разработчиков), плагины, встроенные функции, MCP-серверы (протокол подключения внешних инструментов к модели, Model Context Protocol), широкая база разработчиков. У GigaChat с YandexGPT экосистема беднее, и часть интеграций приходится писать руками. Это не недостаток самих моделей. Это сетевой эффект, который набирается годами.

Все четыре разрыва возвращают к одному вопросу: какая модель закрывает мою задачу дёшево и быстро, и как я это измерю. Дальше — про скорость и цену, потому что именно они определяют итоговую стоимость выбора, даже если сама модель уже найдена.

СКОРОСТЬ, ЦЕНА И СКРЫТЫЕ ОСИ ВЫБОРА МОДЕЛИ

Когда пользователь жалуется, что «модель тормозит», он имеет в виду одно из двух, и это два разных решения. TTFT (Time To First Token) — время от отправки запроса до получения первого токена ответа. Для чат-бота, ассистента, оператора поддержки это критичная метрика: 1,5 секунды тишины в диалоге воспринимаются как «бот завис». TPS (Tokens Per Second) — скорость выдачи токенов после первого. Для длинных ответов (5 000+ токенов) это критично: разница между 50 и 200 t/s — разница между «20 секунд и ждём» и «3 минуты и уходим пить чай».

Лидеры по TTFT, по данным Artificial Analysis: Nova Micro (0,3 с), Llama 4 Scout (0,33 с), Gemini 2.0 Flash (0,34 с). Reasoning-модели (Claude Opus 4.x, GPT-5.5) — 0,5–1,5 с, потому что «думают» перед ответом.

Лидеры по TPS, по Vellum Leaderboard: Llama 4 Scout (2 600 t/s), Llama 3.3 70B (2 500 t/s), Llama 3.1 8B (1 800 t/s). Reasoning-модели — 50–70 t/s.

Путать

1 ... 18 19 20 21 22 23 24 25 26 ... 101
Перейти на страницу:
Отзывы - 0

Прочитали книгу? Предлагаем вам поделится своим отзывом от прочитанного(прослушанного)! Ваш отзыв будет полезен читателям, которые еще только собираются познакомиться с произведением.


Уважаемые читатели, слушатели и просто посетители нашей библиотеки! Просим Вас придерживаться определенных правил при комментировании литературных произведений.

  • 1. Просьба отказаться от дискриминационных высказываний. Мы защищаем право наших читателей свободно выражать свою точку зрения. Вместе с тем мы не терпим агрессии. На сайте запрещено оставлять комментарий, который содержит унизительные высказывания или призывы к насилию по отношению к отдельным лицам или группам людей на основании их расы, этнического происхождения, вероисповедания, недееспособности, пола, возраста, статуса ветерана, касты или сексуальной ориентации.
  • 2. Просьба отказаться от оскорблений, угроз и запугиваний.
  • 3. Просьба отказаться от нецензурной лексики.
  • 4. Просьба вести себя максимально корректно как по отношению к авторам, так и по отношению к другим читателям и их комментариям.

Надеемся на Ваше понимание и благоразумие. С уважением, администратор knigkindom.ru.


Партнер

Новые отзывы

  1. Гость Наталья Гость Наталья07 сентябрь 16:09 Хорошо. Старое дело, будет раскрыто.Прочитала с удовольствием. Люблю эту серию. ... Забытое дело Калевалы - Анна Князева
  2. Р.Д.У. Р.Д.У.22 август 02:17 ...мне тоже понравился этот русский вестерн. И озвучено неплохо. Советую.... Силантьев Вадим – Засада
  3. Гость Любовь Гость Любовь21 август 20:01 Прочитала залпом.... интересный сюжет, история захватывает, плакала вместе с героями. спасибо автору за интересное... Вернуть жену. Без права на прощение? - Ира Орлова
Все комметарии
Новое в блоге