Создатель ChatGPT: История Сэма Альтмана - Кич Хэйги
Книгу Создатель ChatGPT: История Сэма Альтмана - Кич Хэйги читаем онлайн бесплатно полную версию! Чтобы начать читать не надо регистрации. Напомним, что читать онлайн вы можете не только на компьютере, но и на андроид (Android), iPhone и iPad. Приятного чтения!
Шрифт:
Интервал:
Закладка:
Брокман установил маркерную доску между диваном и обеденным столом, и команда шагнула в неизвестность. Первым ориентиром стал игровой агент DeepMind, способный обучаться непосредственно на пикселях экрана, демонстрируя перспективность комбинирования глубоких нейронных сетей с алгоритмом обучения с подкреплением. Нейросеть умела находить закономерности в пикселях. Алгоритм создавал систему вознаграждений, но не давал информации о том, как их получить. Нейронной сети предстояло самостоятельно расшифровать закономерности таким образом, чтобы получить вознаграждение. Она делала ошибки, иногда случайно находила вознаграждение, а затем анализировала свои действия, чтобы понять, что привело к успеху. В итоге нейросеть смогла превзойти человека-игрока в Breakout, Fishing Derby, Kung-Fu Master и даже в Montezuma’s Revenge[241].
Еще осенью, во время однодневной поездки в Напу, когда Альтман приглашал в команду новых сотрудников, у Карпатого родилась идея расширить площадку для экспериментов ИИ-агента от аркадных игр Atari 1970-х годов до всего, что происходит на экране современного компьютера. В конце концов, и там, и там просто пиксели. Почему бы не создать универсального агента, который мог бы стать «человеком за компьютером»? Эта идея вылилась в проект, который они назвали Universe. Но задача оказалась чрезмерно масштабной. Тем временем Заремба предложил альтернативу: создать инструменты для обучения с подкреплением, своего рода «тренажерный зал» (Gym), где могли бы проходить эксперименты с системой вознаграждений. «По сути, это лишь инфраструктура, которая облегчает жизнь исследователям, работающим над обучением с подкреплением», – объяснял Карпатый.
«Мы поставили перед собой цель – сделать что-то интересное и значимое в области обучения с подкреплением, – говорил Суцкевер. – Нам нужно доказать свою состоятельность. Срочно создать что-то заметное, заявить о себе миру, наделать шума – иначе вся затея могла закончиться ничем. Поэтому у нас возникло огромное желание быстро выдать какой-то значимый результат, и не так уж важно, какой именно».
Этот проект научил Брокмана некоторым базовым вещам о взаимоотношениях между исследователями в области ИИ и программистами-разработчиками, которым приходится сотрудничать при создании и обучении ИИ-моделей – как архитекторы и строители вместе возводят дом. Разработку Gym в OpenAI поручили двум исследователям и двум программистам, но такая форма сотрудничества доводила Брокмана до белого каления. «Разработчики уходили программировать, потом возвращались, целый день демонстрировали результаты на моем телевизоре и вчетвером часами обсуждали каждую строчку кода, – рассказывал он. – Это становилось просто невыносимо». Не выдержав черепашьего темпа, он взял проект в свои руки. «В итоге я стал работать в тесной связке с одним из наших исследователей. Я предлагал ему четыре-пять разных идей. Он говорил, что четыре из них – полная ерунда, и я отвечал: “Отлично, именно это мне и нужно было услышать”. В итоге мы генерировали идеи, а человек с хорошим профессиональным чутьем их оценивал». Брокман стремился к тому, чтобы в лаборатории одинаково ценили и программистов-практиков, и теоретиков-исследователей, не отдавая предпочтения ни тем ни другим.
Пока команда OpenAI нащупывала свой путь, DeepMind продолжал демонстрировать устрашающую мощь. С тех пор как в 1997 году Deep Blue от IBM победил чемпиона мира по шахматам Гарри Каспарова[242], исследователи ИИ гадали, сколько времени пройдет, прежде чем машины смогут одолеть человека в древней и невероятно сложной игре го. Количество возможных ходов для двух игроков на доске 19×19 превышало вычислительные возможности любого существующего компьютера. Даже с учетом всех последних достижений в области нейронных сетей большинство экспертов полагало, что на это потребуется как минимум еще десятилетие. Но в конце января 2016 года, когда OpenAI еще не отработала и месяца, DeepMind опубликовал статью в Nature (Демис Хассабис, руководитель компании, предпочитал публиковаться именно в престижных научных журналах). Объявлялось, что их система ИИ под названием AlphaGo в октябре прошлого года в закрытом матче победила бывшего чемпиона Европы по го.
Эта новость встревожила Маска. В феврале он написал Альтману и Брокману письмо, в котором доказывал, что компании необходимо «сделать все возможное, чтобы привлечь лучших специалистов. Давайте поднимем ставки. Если в какой-то момент придется пересмотреть зарплаты нынешних сотрудников – не проблема. Либо мы привлечем лучших в мире, либо DeepMind нас размажет. А если они победят, это будет катастрофа, учитывая их философию “один разум, чтобы править всеми”. Очевидно, что они добились серьезного прогресса, – и неудивительно, с таким-то уровнем профессионалов»[243].
В марте 200 миллионов зрителей по всему миру следили за тем, как AlphaGo – ставшая еще умнее за прошедшие полгода – побеждает чемпиона мира по го Ли Седоля. Сооснователь Google Сергей Брин и генеральный директор Эрик Шмидт лично прилетели в Сеул поддержать творение своей компании. В одной из пяти партий ход, принесший AlphaGo победу, был настолько необычен, что комментаторы поначалу приняли его за ошибку, – черный камень, словно случайно помещенный в пустую часть доски, вдали от основного сражения. «Это не человеческий ход, – с восхищением сказал в интервью Wired Фань Хуэй, которого AlphaGo победила в октябре. – Потрясающе красиво»[244]. Эта резонансная победа позволила DeepMind наглядно продемонстрировать всему миру: AGI может оказаться не такой уж далекой перспективой.
OpenAI и так не сомневалась в этом, но их собственные попытки пойти по стопам DeepMind и создать агента, способного планировать и действовать, пока не приносили результатов. Особенно обидно было Суцкеверу, который до своего ухода из Google работал над го-проектом, став соавтором одной из статей, которые привели к созданию AlphaGo. Карпатый планировал создать среду для обучения с подкреплением, в которой ИИ-агент тренировался бы кликать мышью и нажимать клавиши, получая «награды» за правильные действия – и стремясь эти награды заработать.
Прочитали книгу? Предлагаем вам поделится своим отзывом от прочитанного(прослушанного)! Ваш отзыв будет полезен читателям, которые еще только собираются познакомиться с произведением.
Уважаемые читатели, слушатели и просто посетители нашей библиотеки! Просим Вас придерживаться определенных правил при комментировании литературных произведений.
- 1. Просьба отказаться от дискриминационных высказываний. Мы защищаем право наших читателей свободно выражать свою точку зрения. Вместе с тем мы не терпим агрессии. На сайте запрещено оставлять комментарий, который содержит унизительные высказывания или призывы к насилию по отношению к отдельным лицам или группам людей на основании их расы, этнического происхождения, вероисповедания, недееспособности, пола, возраста, статуса ветерана, касты или сексуальной ориентации.
- 2. Просьба отказаться от оскорблений, угроз и запугиваний.
- 3. Просьба отказаться от нецензурной лексики.
- 4. Просьба вести себя максимально корректно как по отношению к авторам, так и по отношению к другим читателям и их комментариям.
Надеемся на Ваше понимание и благоразумие. С уважением, администратор knigkindom.ru.
Оставить комментарий
-
Гость Любовь11 август 19:22
Очень интересный сюжет, история захватывает..... оторваться от чтения было трудно....прочитала залпом...
Декретный отпуск для шпионки - Тори Озолс
-
Габриэль07 август 18:22
..рад, что наткнулся на этого автора - интересные и информационные у него исторические повести...
Силантьев Вадим – Засада
-
Гость Гость07 август 18:17
..запись /озвучка/ не самая лучшая, но сам вестерн произвёл хорошее впечатление...
Силантьев Вадим - Форт Росс 3
