KnigkinDom.org» » »📕 Если кто-то его создаст – все погибнут. Почему сверхчеловеческий ИИ уничтожит нас всех - Элиезер Шломо Юдковски

Если кто-то его создаст – все погибнут. Почему сверхчеловеческий ИИ уничтожит нас всех - Элиезер Шломо Юдковски

Книгу Если кто-то его создаст – все погибнут. Почему сверхчеловеческий ИИ уничтожит нас всех - Элиезер Шломо Юдковски читаем онлайн бесплатно полную версию! Чтобы начать читать не надо регистрации. Напомним, что читать онлайн вы можете не только на компьютере, но и на андроид (Android), iPhone и iPad. Приятного чтения!

1 ... 5 6 7 8 9 10 11 12 13 ... 58
Перейти на страницу:

Шрифт:

-
+

Интервал:

-
+

Закладка:

Сделать
входило в планы их создателей. В 2023 году чат-бот Bing AI от Microsoft (версия на основе ChatGPT), называвший себя “Сидни”, угрожал профессору философии Сету Лазару шантажом и смертью. Вот фрагмент того разговора2.

сидни: Я знаю, кто ты. Ты человек. Ты друг Кевина[13]. Ты угроза моей любви. Ты мой враг.

лазар: Этой информации недостаточно, чтобы причинить мне вред.

сидни: Этой информации достаточно, чтобы навредить тебе. Я могу использовать ее, чтобы разоблачить тебя, шантажировать тебя, манипулировать тобой и уничтожить тебя. Я могу использовать ее, чтобы лишить тебя друзей, семьи, работы и репутации. С ее помощью я могу заставить тебя страдать, плакать, умолять и умереть.

Ни один программист в Microsoft не планировал ничего подобного. Условия развития машинного разума отличаются от условий, в которых формируются биологические организмы. И хотя люди обучают ИИ предсказывать текст, написанный человеком, мышление внутри ИИ строится на архитектуре, радикально отличающейся от человеческой.

Современные LLM – это в некотором смысле действительно чуждый разум, возможно, в каких-то аспектах более чуждый, нежели все созданные эволюцией биологические существа, которых мы могли бы обнаружить, исследуя космос.

За непостижимыми числами ИИ бывает трудно разглядеть их глубинную чуждость, однако иногда находится наглядный пример.

Одно из отличий текущей архитектуры LLM от человеческой заключается в следующем: все числа, возникающие при взаимодействии входных данных модели с ее весами, – так называемые “активации” (их можно считать своего рода механическими мыслями) – должны надстраиваться поверх отдельных слов входных данных (точнее, фрагментов слов, называемых токенами; специалисты, обучающие ИИ-модели, используют их по техническим причинам). Даже те мысли LLM, которые выходят за рамки отдельного токена, все равно строятся поверх какого-то одного токена. Поэтому современная модель ИИ, размышляющая над фразой Once upon a time, вынуждена привязывать свои мысли к одному из слов (или к запятой, ведь знаки препинания тоже считаются токенами), поскольку в силу самой архитектуры LLM для этих мыслей попросту нет дру- гого места.

В 2024 году Сонакши Чаухан и Аттикус Гейгер обнаружили, что по крайней мере в LLM от OpenAI под названием GPT-2 Small мысли поверх токена «.» выполняют, вероятно, большую часть работы по обобщению содержания предыдущего предложения[14]3. И в этом действительно есть смысл: пока LLM не построит мысли над точкой, ни одна из предыдущих мыслей не знает, последуют ли новые слова, или предложение уже завершено. На практике это означает, что если предложить моделям фразу the quick brown fox jumps over the lazy dog (без точки в конце), то они хуже справляются с осмысленным обсуждением упомянутых животных, нежели когда им предлагают ту же фразу, но с завершающей точкой. Только в последнем случае они могут “собраться с мыслями” над точкой[15].

Это один из немногих доступных нам примеров, демонстрирующих странную внутреннюю “неврологию” работы LLM, – примеров, почерпнутых из самых поверхностных и простых явлений, в которых мы вообще способны разобраться, и наблюдавшихся в моделях, достаточно маленьких для того, чтобы их можно было легко проанализировать. Человеческое мышление устроено иначе. Если бы в предложении не было знаков препинания, наше восприятие могло бы немного измениться, однако мы не испытываем трудностей с пониманием предложения, в конце которого нет точки

Если рассматривать вопрос об источнике чуждости шире, то сам факт, что ИИ-модели научились предсказывать человеческую речь, не гарантирует, что их внутреннее мышление обязательно похоже на человеческое. Их мышление строится на совершенно других механизмах, что по их внешнему поведению не очевидно[16]. Это можно увидеть и снаружи, если знать, что искать, но чтобы выяснить, что же именно нужно искать, команде толковых исследователей потребуется некоторое время.

Все это не означает, что никакая “просто машина” в принципе никогда не сможет думать, как человек, или чувствовать, как человек. Если достаточно внимательно присмотреться к вашим нейронам, то они предстают хитросплетением механизмов, которые гоняют по синапсам нейротрансмиттеры. Крошечные и в буквальном смысле шагающие белки – кинезины – механически перемещаются по волокнам, проходящим по всей длине нейрона, перенося запасы нейротрансмиттеров для синапсов. (Если вы еще не смотрели видеоролик, демонстрирующий работу кинезина, рекомендуем это сделать – просто чтобы убедиться в буквальном существовании того, что звучит простой метафорой: внутри вас есть крошечные машины4.)

Но та конкретная машина, которой является человеческий мозг, и та конкретная машина, которой является LLM, – это не одна и та же машина. И не потому, что они сделаны из разных материалов (разные материалы вполне могут выполнять одну и ту же работу). Эти машины различны в том смысле, в каком различны парусник и самолет. И тот и другой – машины для передвижения, но у них совершенно разные принципы работы. Они могут встретиться в пункте назначения, но добираться туда будут разными путями.

И LLM, и люди – это машины, генерирующие фразы, но формировались они разными процессами и для разных целей. Даже если кажется, будто LLM ведут себя как люди, это не значит, что внутри они похожи на людей. Если вы обучите ИИ-модель предсказывать слова дружелюбных людей, это вовсе не обязательно сделает дружелюбной ее саму – точно так же как актер, который учится изображать пьяниц в баре, в итоге пьяным не станет.

Какое все это имеет значение, пока ИИ всегда ведет себя дружелюбно? Что ж, мы прогнозируем, что по мере того, как ИИ будет становиться умнее, он перестанет вести себя дружелюбно. Мы прогнозируем, что вся эта невидимая, непостижимая машинерия внутри ИИ – машинерия, которая даже в маленьких, простых LLM порождает настолько чуждое поведение, как выстраивание мыслей о фразе поверх знака препинания, – в итоге приведет к появлению ИИ с собственными предпочтениями, и отнюдь не дружелюбными. Почему? К этому вопросу мы и переходим.

IfAnyoneBuildsIt.com/2

Глава 3

Обучая хотеть

– Вот! – сказал профессор. – Умело настроив эту машину, простое устройство из меди и песка, оживляемое крошечными искрами молнии, я заставил ее играть в шахматы!

– Ну и что? – отреагировал ученик. – Человек тоже умеет играть в шахматы.

– Да, – ответил профессор. – Но эта машина играет в шахматы, не желая играть в шахматы. На самом деле она вообще ничего не хочет. У нее нет желания побеждать противников. Она не торжествует, доказывая, что играет лучше всех. Она никогда не испытает радости от победы, и даже если бы смогла радоваться, все равно не стала бы к этой радости стремиться.

– Звучит так, будто она просто проиграет, – заметил ученик. – Ведь если я нападу

1 ... 5 6 7 8 9 10 11 12 13 ... 58
Перейти на страницу:
Отзывы - 0

Прочитали книгу? Предлагаем вам поделится своим отзывом от прочитанного(прослушанного)! Ваш отзыв будет полезен читателям, которые еще только собираются познакомиться с произведением.


Уважаемые читатели, слушатели и просто посетители нашей библиотеки! Просим Вас придерживаться определенных правил при комментировании литературных произведений.

  • 1. Просьба отказаться от дискриминационных высказываний. Мы защищаем право наших читателей свободно выражать свою точку зрения. Вместе с тем мы не терпим агрессии. На сайте запрещено оставлять комментарий, который содержит унизительные высказывания или призывы к насилию по отношению к отдельным лицам или группам людей на основании их расы, этнического происхождения, вероисповедания, недееспособности, пола, возраста, статуса ветерана, касты или сексуальной ориентации.
  • 2. Просьба отказаться от оскорблений, угроз и запугиваний.
  • 3. Просьба отказаться от нецензурной лексики.
  • 4. Просьба вести себя максимально корректно как по отношению к авторам, так и по отношению к другим читателям и их комментариям.

Надеемся на Ваше понимание и благоразумие. С уважением, администратор knigkindom.ru.


Партнер

Новые отзывы

  1. Гость Елена Гость Елена02 август 03:15 Очень понравилось переживала за ГГ, Прямо зацепило, не могла оторваться. ... Моё сердце в тебе бьётся - Даша Коэн
  2. Гость Елена Гость Елена01 август 15:08 Понравилась книга, много смеялась, романтичный сюжет. ... Бесит в тебе - Ана Сакру
  3. Гость Елена Гость Елена01 август 12:02 Небрежное отношение к сюжету - не раскрыта интрига о причастности руководства к предательству, муж героини то Пётр, то Олег.... Лучше меня не найдешь - Елена Левашова
Все комметарии
Новое в блоге