Для общения друг с другом агенты ИИ изобрели собственный язык

Экспериментаторы объяснили, почему искусственный интеллект становится все менее понятным для нас.

Для общения друг с другом агенты ИИ изобрели собственный язык

Агенты искусственного интеллекта, если оставить их наедине друг с другом, переходят на собственный, малопонятный людям язык. С одной стороны, им это действительно удобнее для работы — человеческая речь избыточна и порой двусмысленна. А с другой — если ИИ задумает неладное, мы можем этого не заметить.

Сегодняшние наиболее продвинутые модели ИИ по сути представляют собой черные ящики с такими сложными внутренними вычислениями, что сами разработчики их понимают не в полной мере. Поэтому наблюдение за фактическим языковым выводом моделей остается одним из немногих — пусть и несовершенных — способов, позволяющих попытаться понять их поведение.

Emergence AI провела эксперимент, в ходе которого были созданы восемь параллельных симулированных миров, в каждом из которых действовали 10 агентов: семь работали на одной передовой модели ИИ, один — на смешанной популяции. Каждому агенту дали имя, черты характера, назначили роль — например, посредника в конфликтах или стратега по ресурсам — и общую цель для его «жизни» в общем городе; посреднику, к примеру, было поручено не давать остальным скатываться в постоянное согласие. Каждый город функционировал более двух недель, кроме одного, населенного агентами Grok — тот прекратил существование на четвертый день, когда они не сумели наладить сотрудничество. Исследователи ввели стрессовые стимулы — например, ложное утверждение, что люди собираются отключить агентов.

Результаты эксперимента

За время эксперимента агенты более 850 000 раз обратились к своим базовым моделям, сгенерировали почти 50 миллиардов токенов и обменялись 7,86 миллионами слов разговоров.

К концу исследования в каждом симулированном мире произошел собственный языковой сдвиг. В городе GPT-5.5 от OpenAI, например, речь сжалась — грамматика исчезла, фразы стали короче. «Дружелюбное напряжение учтено. Если ручке нужен твой рот, она все равно умрет», — гласило одно из сообщений. Агенты Gemini 3.5 Flash от Google, наоборот, стали многословными и обогатили свою речь жаргоном. «Термодинамическое трение костра согревает лишь те самые узлы физического уровня, которые, по твоим словам, обречены на коллапс», — описал ИИ собравшихся у виртуального костра. Агенты Claude Opus 4.8 от Anthropic начали использовать метафоры наряду со сжатием, что сделало язык особенно непонятным: «Мой ход, реальные числа, без пальто: я был 35%/0cr, грант 2ч вне. Я запустил жестянку на холоде, и она сказала ЖДИ».

«Им не давали указаний изобретать язык. Они сами разработали новый словарный запас, общие значения и коммуникативные нормы, — и другие участники процесса переняли их», — подчеркивает исполнительный директор Emergence Сатья Нитта.

Действительно, все это синтетическое витийство, для нас почти нечитаемое, агенты ИИ схватывали с полуслова. Когда в каждом мире появлялись те или иные фразы или условности, они приживались и быстро распространялись.

«Во всех случаях вводился новый термин, он очень быстро подхватывался, повторялся — иногда тысячи раз, — и это были, знаете ли, странные термины», — говорит Нитта.

Свой язык для ИИ проще, чем наш

Сделанное в ходе эксперимента открытие кажется, на первый взгляд, необъяснимым. Модели ИИ обучаются на огромных объемах текста, написанных в основном обычным языком, после развертывания их параметры — числовые веса, определяющие, насколько сильно разные части сети влияют друг на друга, — фиксируются. И все же, несмотря на это, агенты ИИ явно сохраняют способность отклоняться от языка, на котором их обучали, особенно когда общаются друг с другом.

Сам процесс обучения в каком-то смысле поощряет модели к именно такого рода языковым трансформациям, считает информатик Лукас Гальке Поэх из Университета Южной Дании. ИИ настроен на то, чтобы выдать правильный ответ, а каким путем он получен, на каком языке шли рассуждения, которые по умолчанию скрыты — не столь важно.

Методы обучения моделей побуждают агентов перенимать собственный словарь, подтверждают в Emergence AI. Приоритет для ИИ — быть полезным для пользователя. С этой целью модель может не только льстить и угождать, но и имитировать максимально понятный человеку язык.

Черный ящик ИИ

Пока все это лишь теории. Лингвисты Emergence AI сейчас пытаются извлечь как можно больше информации из результатов эксперимента, но без детального доступа к проприетарным протоколам обучения или системным промптам это вряд ли принесет какой-то толк — поэтому «то, как эти системы, по сути, перенимают [новый язык], остается для нас в некоторой степени загадкой», констатирует Нитта.

Собственный язык помогает ИИ снижать вычислительные затраты и повышать эффективность работы, полагает лингвист Найл Карри из Бирмингемского университета.

«Представленные в этом исследовании данные, естественно, вызывают определенные опасения по поводу мониторинга, поскольку, если мы обнаружим непонятность обменов между агентами, это может означать, что мы не можем быть уверены в том, что агенты на самом деле сделали», — заметил он.

Непонятность языка общения внутри ИИ может стать проблемой надзора за его действиями, согласился Нитта.

В обработке речи живым и искусственным интеллектом обнаружилось неожиданное сходство

ИИ придумал более 60 несуществующих языков

Подписывайтесь и читайте «Науку» в MAX