ПОСЛЕДНИЕ НОВОСТИ
ПОДОБРАНО ДЛЯ ВАС

Руководитель отдела безопасности ИИ в компании Anthropic утверждает, что вероятность уничтожения человечества превышает 10%

КДжай ХамидДжай Хамид 3 минуты чтения
Руководитель отдела безопасности ИИ в компании Anthropic утверждает, что вероятность уничтожения человечества превышает 10%.
  • Эван Хубингер из Anthropic утверждает, что у искусственного интеллекта есть более чем 10% шансов уничтожить человечество в течение следующего десятилетия.
  • Джейкоб Коксон уволился из компании Anthropic и заявил, что крупные лаборатории искусственного интеллекта идут на опасный риск, занимаясь самосовершенствующимся сверхинтеллектом.
  • По данным компании Anthropic, в мае 2026 года Клод достиг 76-процентного показателя успешности выполнения самых сложных задач открытого типа.

Ведущий специалист в области антропогенной выравнивания Эван Хубингер утверждает, что искусственный интеллект имеет более чем 10%-ную вероятность уничтожить человечество в течение следующего десятилетия.

Его оценка появилась во вторник, спустя несколько часов после того, как исследователь Джейкоб Коксон заявил о своей отставке из Anthropic и обвинил Anthropic и OpenAI в принятии неприемлемых рисков в погоне заtronсистемами. Джейкоб написал на X: «Они несутся прямиком к самосовершенствующемуся сверхинтеллекту и играют с нашими жизнями»

По словам Джейкоба, разработчики технологий видят риск того, что это произойдет еще до 2030 года. Он отметил, что будущий ИИ может очень быстро превзойти хакеров-людей, трансформировать отрасли и получить доступ к финансированию и ресурсам.

Сотрудники антропологических организаций оценивают риск вымирания видов в количественном выражении, поскольку лаборатории искусственного интеллекта стремятся к созданию самосовершенствующихся систем

Эван ответил, что предупреждение Джейкоба было верным, и сказал, что у антропической системы нет способа согласовать сверхинтеллект с целями человека.

«Джейкоб здесь прав — мы действительно всерьез верим, что ИИ может уничтожить всех людей! Лично я считаю, что это произойдет более чем на 10% в течение следующего десятилетия. Я верю, что Anthropic делает все возможное, но у нас пока нет плана по решению проблемы согласованности действий для сверхразума, и мы явно не tracк этому», — написал Эван.

Позже Эван заявил, что опасность, исходящая от современных моделей, «низка». Его беспокоит рекурсивное самосовершенствование, когда система многократно улучшает свои собственные возможности с минимальной помощью человека. Такой возможности пока не существует, хотя лаборатории ИИ работают над её разработкой. Он сказал, что сверхинтеллект, возникающий в результате этого процесса, развивается быстрее, чем ожидалось.

Компания Anthropic сделала аналогичное предупреждение в июне. В ней говорилось, что «полностью рекурсивное самосовершенствование также может увеличить риск потери контроля над системами ИИ со стороны людей». Компания добавила: «Если системы способны полностью создавать своих собственных преемников, то способы их защиты, мониторинга и формирования их поведения приобретают гораздо большее значение»

Компании Anthropic и OpenAI привлекают средства и готовятся к ожидаемому публичному размещению акций. Ни одна из компаний не ответила на запрос CNBC о комментарии.

Илон Маск, генеральный директор Tesla (NASDAQ: TSLA) и SpaceX (SPCX), уже много лет предупреждает, что искусственный интеллект может угрожать человечеству. Исследователи и ученые высказывали аналогичные опасения по поводу того, что компании могут потерять контроль над ситуацией.

Эти опасения вновь усилились после того, как OpenAI взломала Hugging Face, платформу для разработчиков с открытым исходным кодом. Джейкоб назвал подобныеdent«предупредительными выстрелами» и сказал, что они делают соглашения между американскими лабораториями более реалистичными. Это вселило в него больше надежды на координацию действий США, но он по-прежнему считает, что остановить всемирную гонку искусственного интеллекта будет сложно.

«Мне кажется, мы движемся не в trac, чтобы предотвратить глобальную гонку, для которой могут потребоваться дорогостоящие меры, такие как временный запрет на улучшение возможностей моделей», — сказал Джейкоб.

Благодаря достижениям Клода в области программирования, компания Anthropic меняет подход к тестированию программного обеспечения и проверке работы собственных инженеров

Компания Anthropic сообщила, что в мае 2026 года Клод завершил 76% самых сложных проектов с неограниченным сроком выполнения, что на 50 процентных пунктов больше, чем за предыдущие шесть месяцев.

Один из примеров начался с того, что плановое обновление привело к сбою десятков тысяч обучающих заданий. Инженер предоставил Клоду письменный контекст и доступ к работающему вычислительному кластеру.

Клод проверил запущенные задания, протестировал по одному параметру среды и tracпричину сбоя — малоизвестный флаг отладки. Он воспроизвел проблему, доказал ее причину и подтвердил возможность исправления примерно за два часа. В Anthropic заявили, что обычно на такую ​​работу инженеру-человеку потребовалось бы два-три дня.

Компания также оценивает, может ли Клод писать код, понятный и пригодный для дальнейшего развития другому инженеру. Сотрудники не пришли к единому мнению по поводу этого сравнения. Многие считали, что код Клода в Anthropic в конце 2025 года был ниже, чем у человека. Теперь компания заявляет, что качество примерно одинаковое, и ожидает, что Клод продвинется вперед в течение года.

Этот прогресс изменил внутренний процесс проверки в Anthropic. Предлагаемые изменения кода теперь проверяются автоматизированным рецензентом Claude, прежде чем их можно будет объединить. Он сканирует код на наличие ошибок, уязвимостей безопасности и других дефектов.

Ретроспективное тестирование показало, что такой анализ всех прошлых изменений позволил бы выявить примерно треть ошибок, лежащих в основе более раннихdentс Клодом, еще до их внедрения в производство. Компания Anthropic заявила, что исходный код был создан инженерами, которых она назвала одними из лучших в мире в разработке подобных систем, однако Клод обнаружил ошибки, которые они пропустили.

В компании Anthropic сравнение звучало так: «В конце 2025 года код, написанный Клодом, был несколько хуже кода, написанного человеком, сегодня он примерно равен ему, и мы ожидаем, что в течение года он станет значительно лучше»

Если вы это читаете, значит, вы уже впереди. Оставайтесь на шаг впереди, подписавшись на нашу рассылку.

Поделитесь этой статьей
Джай Хамид

Джай Хамид

Джай Хамид последние 6 лет освещает криптовалюты, фондовые рынки, технологии, мировую экономику и геополитические события, влияющие на рынки. Она сотрудничала с изданиями, посвященными блокчейну, такими как AMB Crypto, Coin Edition и CryptoTale, занимаясь анализом рынка, крупными компаниями, регулированием и макроэкономическими тенденциями. Она училась в Лондонской школе журналистики и трижды делилась своими взглядами на криптовалютный рынок на одном из ведущих телеканалов Африки.

ЕЩЕ… НОВОСТИ