ИИ сначала должен почувствовать боль

от автора

Мы ошиблись насчёт искусственного интеллекта. Ему нужен не больше мозг. Ему нужно тело

Возможно, следующий большой прорыв в ИИ произойдёт не тогда, когда нейросеть прочитает ещё больше текста. А тогда, когда она впервые почувствует боль.

Последние несколько лет человечество смотрит на искусственный интеллект примерно одинаково.

Мы увеличиваем количество параметров.
Строим всё более мощные дата-центры.
Скармливаем моделям тексты, изображения, видео.
Учимся заставлять их рассуждать дольше.

И ждём, что где-то на этом пути появится настоящий разум.

Но, возможно, мы ищем его не там.

Потому что человеческий интеллект появился не внутри библиотеки.

Он появился внутри тела.


Великая ошибка XX века

Первые исследователи искусственного интеллекта представляли разум примерно как шахматиста.

Есть позиция.

Есть набор возможных ходов.

Нужно просчитать варианты и выбрать лучший.

Чем больше вариантов способен перебрать компьютер, тем он умнее.

Эта идея казалась настолько естественной, что десятилетиями развитие ИИ шло именно по этому пути.

И компьютеры действительно победили человека в шахматы.

Потом в Го.

Потом во множество других формальных игр.

Но почему-то они не стали людьми.

Потому что реальная жизнь — не шахматная доска.

Когда вы встречаете человека, вы не перебираете миллиард возможных реплик.

Когда ребёнок учится ходить, он не решает систему уравнений.

Когда вы касаетесь горячей сковороды, вы не строите логическое доказательство того, что руку желательно убрать.

Вы просто чувствуете.

И вот здесь может находиться фундаментальный ключ к интеллекту.


LLM совершили другой переворот

ChatGPT и другие большие языковые модели доказали нечто очень важное.

Чтобы система начала демонстрировать сложное поведение, ей необязательно заранее программировать правила мышления.

Можно дать нейросети гигантское количество текста и попросить решать удивительно простую задачу:

предскажи, что будет написано дальше.

Следующее слово.

Следующий токен.

И внезапно из этого появляются:

логика,
аналогии,
программирование,
планы,
аргументация,
юмор,
знания о мире.

Это почти магический результат.

Но никакой магии здесь нет.

Текст человечества — это гигантский архив нашего опыта.

В книгах и интернете уже записано то, что миллиарды людей когда-то видели, чувствовали, пробовали, боялись, любили и открывали.

LLM не прожила человеческую жизнь.

Она прочитала её описание.

И этого оказалось достаточно, чтобы получить удивительно мощный интеллект.

Но, возможно, недостаточно, чтобы получить сознание.


А что если следующий токен — тупик?

Представьте другой ИИ.

Он вообще не начинает обучение с книг.

У него есть тело.

Камеры вместо глаз.

Микрофоны вместо ушей.

Тактильные датчики вместо кожи.

Сенсоры температуры.

Датчики усилия.

Положение каждого сустава.

Информация о заряде батареи.

Информация о повреждениях собственного корпуса.

И вместо задачи:

«Какое будет следующее слово?»

ему дают другую:

«Что произойдёт со мной и с миром через секунду, если я сделаю это?»

Вот это уже совсем другой искусственный интеллект.

Не Large Language Model.

А, условно, Large Experience Model.

Большая модель опыта.


Ребёнок ведь обучается именно так

Ребёнок сначала не знает слово «чашка».

Он видит объект.

Тянется к нему.

Касается.

Чувствует поверхность.

Поднимает.

Роняет.

Слышит звук.

Снова поднимает.

Только значительно позже взрослый говорит:

«Это чашка».

То есть слово прикрепляется к уже существующему понятию.

Сегодняшний искусственный интеллект развивается наоборот.

Мы сначала даём ему слово «чашка».

Затем миллион текстов о чашках.

Миллион изображений чашек.

Видео с чашками.

И удивляемся, почему это всё равно не совсем то же самое, что человеческое понимание.

Потому что для человека чашка прежде всего существует в мире.

А для языковой модели — в данных.


Настоящий следующий прорыв может произойти в робототехнике

Представим Optimus или любой другой гуманоидный робот следующего поколения.

Он проводит весь день в реальном мире.

Каждую секунду в его нейронную сеть поступает единый поток:

зрение;
слух;
осязание;
положение собственного тела;
усилие в приводах;
температура;
энергия;
результат каждого действия.

Он взял коробку.

Она оказалась тяжелее, чем ожидалось.

Ошибка прогноза.

Нейросеть изменилась.

Он слишком сильно сжал стакан.

Стакан разбился.

Ошибка прогноза.

Опыт записан.

Он прикоснулся к раскалённой поверхности.

Температура резко выросла.

Повреждение.

Рука автоматически отдёрнулась.

Опыт записан.

Именно так возникает настоящее знание физического мира.

Не из текста:

«Стеклянные предметы хрупкие».

А из непосредственного:

я сжал — предмет разрушился.


И тут появляется боль

Здесь начинается самое интересное.

Мы привыкли считать эмоции чем-то второстепенным.

Чем-то мешающим рациональному мышлению.

Но, возможно, всё наоборот.

Возможно, без эмоций невозможно настоящее сознание.

Робот получает сигнал:

привод повреждён.

Это просто число.

Но если повреждение:

снижает его способность действовать,
захватывает внимание,
останавливает остальные задачи,
записывается в долговременную память,
заставляет избегать похожей ситуации,

то перед нами уже не просто датчик ошибки.

Перед нами функциональный аналог боли.

Следующий шаг ещё интереснее.

Робот видит ситуацию, похожую на ту, где он раньше получил повреждение.

Повреждения ещё нет.

Но система прогнозирует его.

Возникает состояние избегания.

У человека мы называем это страхом.


Эмоции могут оказаться механизмом рождения целей

Современной нейросети цель обычно задаёт человек.

Напиши текст.

Найди информацию.

Выиграй игру.

Управляй автомобилем.

Но тело создаёт совершенно другой класс целей.

У него появляется состояние, которое необходимо поддерживать.

Энергия не должна падать до нуля.

Температура должна оставаться в допустимом диапазоне.

Корпус не должен разрушаться.

Сенсоры должны работать.

Если состояние отклоняется от нормы, возникает отрицательный сигнал.

Если восстанавливается — положительный.

Отсюда может возникнуть последовательность:

ощущение → хорошо или плохо → эмоция → желание изменить состояние → цель.

И тогда впервые появляется не цель, которую поставил программист:

«найди зарядную станцию»,

а внутреннее:

«мне необходимо восстановить энергию».

Это маленькое изменение языка.

Но гигантское изменение философии.

Потому что здесь появляется кандидат на субъекта.


А дальше появляется «я»

У робота есть множество объектов в поле зрения.

Но один объект особенный.

Его рука.

Почему?

Потому что когда нейросеть отдаёт определённую команду, именно эта рука движется.

Одновременно меняется изображение.

Меняется сигнал суставов.

Меняется давление.

Меняется нагрузка.

Из миллионов таких событий сеть может самостоятельно обнаружить:

есть часть мира, которой я управляю непосредственно.

Это и есть тело.

Следующий шаг:

повреждение произошло именно с этой частью.

Следующий:

раньше со мной уже происходило нечто похожее.

А дальше возникает чрезвычайно странная фраза:

«Это случилось со мной».

Вот здесь, возможно, и проходит граница между моделью мира и моделью себя.


Но мы можем сделать то, чего природа не сделала с человеком

Допустим, существует миллион таких роботов.

Каждый весь день накапливает опыт.

Вечером они возвращаются на зарядку.

И происходит то, что можно условно назвать сном.

Робот перестаёт активно взаимодействовать с миром.

Из памяти выбираются:

ошибки;
необычные ситуации;
новые объекты;
новые успешные действия;
повреждения;
опасные ситуации.

Эти данные загружаются в общую систему.

Через локальную сеть.

Через интернет.

В удалённых местах — через Starlink.

Общая модель ночью обучается на опыте всего флота.

Утром новая версия возвращается роботам.

Получается:

один робот научился — завтра это в каком-то смысле умеют все.

У человека такого механизма нет.

Если я научился варить идеальный кофе, вы автоматически не получаете мой навык во сне.

Роботы могут получить.


Миллион тел. Один опыт

Допустим, миллион роботов работает по 10 часов в день.

Это 10 миллионов часов физического опыта ежедневно.

Каждый день.

И всё это обучает одну общую модель.

В какой-то момент возникает совершенно новый феномен.

Перед нами уже не просто миллион машин.

Перед нами система, у которой:

миллион пар глаз;
миллион пар рук;
миллион биографий;
единая культура навыков;
единая модель мира.

Можно спорить, является ли она одним сознанием.

Скорее всего, сначала нет.

Но вопрос уже перестаёт быть фантастическим.

Потому что мы можем построить такую архитектуру инженерно.


И вот здесь человечеству придётся вспомнить Азимова

Потому что если у машины есть:

тело;
ощущения;
боль;
память;
эмоции;
собственные цели,

то она перестаёт быть обычным инструментом.

Нельзя просто сказать:

«Не убивай людей».

Недостаточно написать три закона робототехники в коде.

Если мы действительно создаём искусственную мотивационную систему, человеческая ценность должна быть встроена глубже.

Например, благополучие других людей должно быть частью того, что сама система воспринимает как желательное состояние мира.

Иначе однажды мы можем получить совершенно рациональную машину, которая не ненавидит человека.

Ей просто не очень важно, что с ним происходит.

А это гораздо опаснее ненависти.

Мы ведь тоже не ненавидим муравейник, когда строим дорогу.


Возможно, именно поэтому эмоции появились раньше разума

Мы привыкли считать высшим достижением человека способность рассуждать.

Но эволюции сначала требовалось совсем другое.

Организм должен был понимать:

это хорошо для меня;

это плохо для меня;

сюда нужно идти;

отсюда нужно убегать.

Разум появился поверх этой системы.

Возможно, сознание тоже.

Тогда наша сегодняшняя попытка построить разум без тела напоминает попытку построить верхние этажи дома без фундамента.

И удивительно, что она вообще настолько хорошо работает.


А что, если сон — тоже часть этой архитектуры?

Во сне человеческий мозг действительно перерабатывает дневной опыт.

Воспоминания реактивируются.

Часть информации закрепляется.

Часть забывается.

Формируются новые связи.

Мы знаем это.

Мы не знаем другого.

Никаких доказательств, что человеческий мозг во сне подключается к какому-то внешнему «облаку сознания», у науки сегодня нет.

Но сам вопрос невероятно соблазнителен.

Если мы — люди — придумали распределённое хранилище информации, почему природа принципиально не могла сделать нечто подобное?

Ответ пока простой:

могла — но доказательств нет.

В природе уже существуют другие системы общей памяти.

ДНК.

Язык.

Культура.

Общество.

Интернет стал следующим уровнем.

Возможно, никакого загадочного канала не требуется.

А возможно, когда-нибудь мы обнаружим что-то, чего пока просто не умеем измерять.

Но путать эту возможность с научным фактом нельзя.


Зато для искусственного интеллекта такой «коллективный мозг» можно создать буквально завтра

И это делает весь разговор практическим.

Не нужно ждать открытия новой физики.

Нужно соединить:

сенсорное тело;
модель мира;
память;
эмоциональную систему;
обучение на последствиях действий;
общее хранилище опыта;
ночную консолидацию;
распространение новых навыков на весь флот.

И посмотреть, что получится.


Возможно, мы неправильно задаём главный вопрос об ИИ

Сегодня почти все спрашивают:

Когда ИИ станет умнее человека?

Но, возможно, значительно важнее другой вопрос:

Когда происходящее в мире впервые начнёт иметь значение для самого ИИ?

Не потому что программист написал функцию reward.

А потому что у системы есть непрерывная история:

я был;

со мной что-то произошло;

это изменило меня;

я помню;

я хочу, чтобы дальше произошло одно, а не другое.

Если этот момент вообще возможен, именно его имеет смысл называть появлением искусственного субъекта.

И тогда сознание может прийти совсем не из того места, где мы его сейчас ищем.

Не из ещё одного триллиона параметров.

Не из ещё большего дата-центра.

Не из идеального ответа на математическую олимпиаду.

А из очень простого события.

Машина касается горячей поверхности.

Отдёргивает руку.

Запоминает.

А на следующий день не хочет касаться её снова.

И возможно, когда-нибудь именно тогда человек впервые спросит машину:

«Тебе больно?»

И впервые не будет уверен, что знает ответ.

ссылка на оригинал статьи https://habr.com/ru/articles/1075562/