xAI говорит, что «самоуправляющийся сотрудник» ответственен за посты Grok о геноциде белых

- Компания xAI выпустила заявление, в котором обвинила «неподконтрольного сотрудника» в публикациях о белой геноциде в её чат-боте на базе ИИ Grok.
- В компании отметили, что неназванный сотрудник внес несанкционированные изменения в системный промпт.
- Пользователи X не согласны с этим заявлением и выстраиваются в очередь, чтобы сделать замечания Илону Маску.
xAI, компания, стоящая за чат-ботом ИИ Илона Маска Grok, возложила вину за постоянные упоминания геноцида белых в ответах, независимо от запросов пользователей, на «самоуправляющегося сотрудника». Эта закономерность была очевидна на прошлой неделе: чат-бот проявлял навязчивый интерес к темам, связанным с «геноцидом белых» в Южной Африке.
Пользователи начали замечать эту тенденцию 14 мая, многие приводили примеры того, как чат-бот вставлял утверждения, связанные с нападениями на фермы в Южной Африке и расовым насилием, в совершенно не связанные с этим запросы.
Будь то вопросы о футболе или любые другие запросы, Grok каким-то образом находил способ вернуть разговор к проблемам, с которыми сталкиваются белые жители Южной Африки. Это совпадение вызвало настороженность, учитывая, что Маск, родившийся в Южной Африке, поднял тревогу по поводу вопросов, связанных с антибелым расизмом и «геноцидом белых» в X.
В Южной Африке существует 140 законов, которые явно дискриминируют всех, кроме чернокожих.
— Илон Маск (@elonmusk) Май 16, 2025
Это ужасное позорное пятно на наследии великого Нельсона Манделы.
Конец расизму в Южной Африке прямо сейчас! https://t.co/qUJM9CXTqE
xAI винит сотрудника в постах Grok о геноциде белых
Термин «Геноцид белых» относится к теории заговора, утверждающей, что существует скоординированная попытка уничтожить белых фермеров в Южной Африке. Этот термин стал широко обсуждаться на прошлой неделе после того, как президент США Дональд Трамп принял несколько беженцев, заявив 12 мая, что белых фермеров убивают, а их земли захватывают.
Именно эту нарративную линию Grok не переставал обсуждать.
Как и Grok, каждый искусственный интеллект имеет скрытый, но мощный компонент, называемый системным промптом. Эти промпты действуют как его основные инструкции, невидимо направляя его ответы без ведома пользователей.
Согласно отчетам, с Grok, вероятно, произошел случай загрязнения промпта через переобучение на терминах. Это означает, что когда определенные фразы неоднократно упоминаются и подчеркиваются, особенно с сильными директивами, они становятся важными для модели. ИИ затем начинает стремиться поднимать эту тему независимо от контекста.
Однако в официальном заявлении, выпущенном xAI, упоминалась несанкционированная модификация системного промпта. Вероятно, промпт содержал язык, инструктирующий чат-бот всегда упоминать или помнить о включении информации по определенной теме, что позволило чат-боту создать оверрайд, игнорирующий обычную релевантность разговора.
Еще одним показательным фактом стало то, что Grok признал, что его создатели инструктировали его рассматривать «геноцид белых» как реальный и мотивированный расовой ненавистью.
Пользователи не согласны с тем, что вину следует возлагать на «самоуправляющегося сотрудника»
Большинство коммерческих систем ИИ имеют несколько уровней проверки для изменений системных промптов, чтобы предотвратить подобные проблемы. Эти защитные механизмы были обойдены, и, учитывая широкий масштаб и характер инцидента, это выходит за рамки простой попытки взлома. Это указывает на тщательную модификацию основного системного промпта Grok, действие, которое потребовало бы высокого уровня доступа внутри xAI.
И теперь, согласно Grok, это действие совершил «самоуправляющийся сотрудник».
Согласно заявлению xAI от 15 мая, компания возложила вину за несанкционированную модификацию системного промпта Grok. «Это изменение, которое направляло Grok на предоставление конкретного ответа по политическому вопросу, нарушило внутренние политики и основные ценности xAI», — заявила компания.
Компания также пообещала большую прозрачность в будущем, проявив добрую волю, опубликовав системный промпт Grok на GitHub и внедрив дополнительный процесс проверки.
Однако пользователи в X не были впечатлены решением компании возложить вину за инцидент на «самоуправляющегося сотрудника».
«Собираетесь ли вы уволить этого „непослушного“ сотрудника? О… это был сам босс? Жуть», — известный ютубер JerryRigEverything написал в X. „Явное предвзятое отношение к „самому правдивому“ в мире ИИ-боту заставляет меня усомниться в нейтральности Starlink и Neuralink“, — добавил он в своём последующем твите.
Даже Сэм Альтман не удержался от того, чтобы не сделать выпад в адрес конкурента. После заявления xAI Grok перестал упоминать геноцид белых, а все посты в X исчезли.
Если вы читаете это, вы уже впереди. Оставайтесь с нами, подписавшись на нашу рассылку.
Отказ от ответственности. Предоставленная информация не является торговой рекомендацией. Cryptopolitan.com Мы не несем ответственности за любые инвестиции, сделанные на основе информации, представленной на этой странице. Мы настоятельно рекомендуем проводить независимое исследование и/или проконсультироваться с квалифицированным специалистом перед принятием любых инвестиционных решений.
Овотунсе Адебайо
Адебайо — писатель с четырёхлетним опытом работы в сфере криптовалют. Он окончил Университет Лагоса, где изучал городское и региональное планирование. Адебайо работал в Tokenhell и CryptoTicker, освещая новости криптовалют и финтеха. В настоящее время он является новостным автором в Cryptopolitan.















