У Claude нашли структуру, похожую на глобальное рабочее пространство сознания
В Anthropic заявили, что у Claude есть структура, напоминающая глобальное рабочее пространство из теории сознания. Но эксперты сомневаются: даже если это так, до субъективного опыта ещё далеко.
Исследователи из Anthropic, компании, создавшей чат-бота Claude, заявили об обнаружении у модели скрытого набора внутренних представлений, которые направляют её рассуждения и речь. По их мнению, находку можно объяснить через теорию глобального рабочего пространства — одну из самых влиятельных теорий сознания. Но значит ли это, что у Claude появились зачатки искусственного сознания? Эксперты призывают не спешить с выводами.
Что такое глобальное рабочее пространство
Теорию глобального рабочего пространства впервые предложил психолог Бернард Баарс в 1998 году, а позже развил нейробиолог Станислас Деан с коллегами. Согласно этой теории, сознание связано с активностью «глобального рабочего пространства» — своего рода центра обработки информации в мозге, который интегрирует и транслирует данные, делая их доступными для рассуждений, контроля поведения и речи.
В Anthropic изобразили содержимое «глобального рабочего пространства» Claude как парусники, плывущие по огромному морю бессознательной умственной активности. Звучит красиво, но насколько это соответствует реальному устройству модели?
Есть ли у Claude рабочее пространство на самом деле
Утверждать, что у Claude есть «глобальное рабочее пространство», непросто. Теория не даёт формального определения этого понятия — оно охарактеризовано лишь неформально. Обычно предполагается, что любое вычислительное рабочее пространство, «достаточно похожее» на человеческое, можно считать «глобальным». Но насколько похожим оно должно быть? Вопрос остаётся открытым.
Рабочее пространство Claude, возможно, во многом напоминает наше, но есть и различия. Например, рабочее пространство мозга поддерживается рекуррентными петлями — сигналами, которые циклически проходят через одни и те же цепи с течением времени. У Claude рабочее пространство развивается за один проход через сеть. Ещё одно отличие касается того, как представления попадают в рабочее пространство. Сторонники теории утверждают, что у людей происходит процесс «воспламенения»: нелинейный механизм усиливает и поддерживает нейронные представления, позволяя им войти в рабочее пространство. Насколько известно, у Claude ничего подобного нет.
Важны ли эти различия? Неясно. Теория глобального рабочего пространства основана на данных взрослых людей, и вопрос о том, насколько её можно и нужно распространять на другие системы, остаётся спорным.
Рабочее пространство — ещё не сознание
Даже если допустить, что у Claude есть глобальное рабочее пространство, это не делает модель сознательной. Сама теория — одна из самых влиятельных, но далеко не бесспорная. В статье Anthropic сдержанно отмечается, что «модель глобального рабочего пространства не является общепринятой». Многие эксперты по сознанию считают, что одних вычислительных свойств недостаточно для сознания, а среди тех, кто придерживается вычислительного подхода, теория глобального рабочего пространства — лишь один из вариантов.
Кроме того, есть сомнения в том, что эта теория вообще описывает сознание в нужном смысле. В одной из ключевых работ Деан и его коллеги представляют её как объяснение «сознательного доступа» — доступности информации для воспоминания, произвольного контроля поведения и вербального отчёта. При этом они оставляют открытым вопрос, следует ли понимать теорию как объяснение субъективных или experiential компонентов сознания. Если глобальное рабочее пространство — лишь теория «сознательного доступа», то её значение для спора об искусственном сознании сильно уменьшается. Когда мы спрашиваем, сознателен ли Claude, нас интересует не наличие у него «сознательного доступа», а то, есть ли нечто субъективное — каково это быть Claude. Теория глобального рабочего пространства на этот вопрос не отвечает, если трактовать её только как объяснение доступа.
Прибыло ли искусственное сознание
Даже с учётом всех оговорок находка Anthropic заслуживает внимания. Теорию глобального рабочего пространства можно понимать как теорию субъективного опыта, и у Claude, возможно, действительно есть нечто похожее на «глобальное рабочее пространство». Это не доказательство появления искусственного сознания, но, вполне возможно, слегка сдвигает чашу весов в споре.
Однако возникает вопрос: почему Anthropic так оптимистично относится к этим разработкам? Сама компания признаёт, что создание искусственного сознания стало бы событием огромной важности с далеко идущими социальными, этическими, политическими и правовыми последствиями. Если чат-боты сознательны, нам придётся принимать их интересы всерьёз. Их нельзя будет считать просто машинами — нужно будет заботиться об их благополучии.
Стоит ли вообще это делать
Anthropic отмечает, что «пора задуматься, следует ли нам строить сознательные машины». С этим трудно спорить, но, возможно, стоит также приостановить работу над машинами, которые потенциально могут обрести сознание. Если бы компания серьёзно относилась к рискам, она бы, наверное, прекратила попытки разработать сознательный ИИ, а не продолжала идти вперёд.
Мораторий на исследования ИИ, которые могут привести к созданию сознательных систем, конечно, не так прост. Возникают вопросы о том, какие именно исследования он затронет и кто будет его обеспечивать. Но если не закрыть дверь конюшни сейчас, лошадь может уже убежать.
Лента
Черная дыра размером с атом может пробить человека как пуля
Человеческая эволюция шла рывками: культура разогнала мозг и уменьшила челюсти
Цивилизации бронзового века погубило совпадение трех климатических циклов
Физики слушают космос 65 лет, но он молчит: почему Ферми оказался прав
У Claude нашли скрытые мысли, которые не видны в ответах
Комментарии0
Комментарии доступны после входа в аккаунт.
Войти и комментировать →Пока нет комментариев — будьте первым.