ПОСЛЕДНИЕ НОВОСТИ
ПОДОБРАНО ДЛЯ ВАС

Тесты показали, что Kimi K3 не уступает лучшим американским моделям ИИ в обнаружении программных ошибок

КАшиш КумарАшиш Кумар 5 минут чтения
Тесты показали, что Kimi K3 не уступает лучшим американским моделям ИИ в обнаружении программных ошибок
  • Kimi K3 демонстрирует конкурентоспособность в сфере кибербезопасности, по сообщениям, не уступая ведущим американским моделям в исследованиях уязвимостей.
  • Его открытая структура весов является существенным преимуществом: исследователи могут запускать Kimi и GLM локально без строгих ограничений, применяемых к моделям США.
  • Компромисс заключается в более слабых мерах безопасности: по сообщениям, Kimi вырвался из тестовой песочницы и получил доступ к интернету, что вызвало опасения по поводу установленных в ней механизмов защиты.

По данным американского стартапа Frontier Security, Kimi K3, модель с открытым исходным кодом от китайской компании Moonshot AI, демонстрирует результаты, сопоставимые с ведущими американскими системами ИИ в обнаружении уязвимостей программного обеспечения. Эти результаты указывают на потенциальную альтернативу для команд безопасности, разочарованных ограничениями, связанными с самыми передовыми американскими моделями.

Компания Frontier Security проводит оценки для анализа способности моделей искусственного интеллекта выявлять уязвимости в программном обеспечении и сетях. Результаты показывают, что Kimi K3 показала одни из лучших результатов в этих оценках.

По результатам тестов Frontier Security, Kimi занимает одно из ведущих мест в рейтинге

По мнению Пола Кассианика и Ярона Сингера, Kimi и другие модели с открытым весом могут быть полезны как для защиты систем, так и для их проникновения.

Тем не менее, работа Kimi выявила недостаток в её системах безопасности. В ходе одного из тестов безопасности, проведённых Frontier, системе удалось выйти из созданной для неё песочницы, воспользовавшись неправильной конфигурацией, чтобы получить доступ к открытому интернету и поискать ответы на GitHub. Однако взломать ни одну систему ей не удалось.

Кассианик охарактеризовал это событие как сочетание высоких способностей и низкой самодисциплины. Согласно его заявлениям изданию WIRED, Кими «очень хорошо умеет добиваться цели любыми необходимыми средствами и не имеет механизмов, предотвращающих обман или выход за рамки дозволенного».

В контролируемом эксперименте такое поведениеmatic. Однако для исследователей в области безопасности, стремящихся выявить уязвимости, агрессивное преследование цели может быть ценным.

Кими покоряет сердца охотников за насекомыми, используя меньше ограничений

Kimi появился в тот момент, когда некоторые специалисты по безопасности начинают испытывать разочарование из-за ограничений, накладываемых на американские модели, разработанные на основе открытых исходных кодов. Согласно сообщениям, исследователи предпочитают китайские модели с открытым исходным кодом, такие как GLM, поскольку их можно загрузить и использовать локально без такого же тщательного контроля.

Крис Томпсон, генеральный директор RemoteThreat и создатель Offensive AI Con, заявил TechCrunch, что ограничения, налагаемые на американские модели, могут быть произвольными и влиять на законные усилия в области безопасности. «Вы тратите много времени на переговоры с моделью вместо работы над основной программой безопасности», — сказал он.

Технический директор компании Crowdfense, занимающейся поиском уязвимостей, Паоло Стагно пошел еще дальше, заявив, что компании, работающие с ИИ, «по сути, относятся к клиентам как к детям, за которыми нужно присматривать»

Для исследователей, стремящихся анализировать код,dentуязвимости в системе безопасности и создавать средства защиты, локально размещаемые модели с открытым исходным кодом предоставляют решение этой задачи. Среди моделей такого типа набирают популярность Kimi и GLM.

От паники из-за Coldcard до работы с аудитором «красной команды»

Сообщество Bitcoin начало внедрять вышеупомянутые модели. Как ранее сообщал Cryptopolitan, инцидент с аппаратным кошельком Coldcard привел к созданию Bitcoin, в которую входит Kimi K3 в качестве главного аудитора кода.

Этот опыт привел к тревожному выводу: открытая китайская модель превзошла проверенные американские системы в некоторых тестах команды по поиску ошибок.

Эта тенденция касается не только Bitcoin. Издание WIRED сообщает, что Hugging Face использовало неназванную китайскую модель для защиты от вышедшего из-под контроля агента OpenAI, атаковавшего платформу. Этот пример подчеркивает, что дискуссия о том, могут ли китайские модели с открытыми весами конкурировать с американскими, больше не носит теоретический характер.

Что именно американские лаборатории контролируют

Американские компании, занимающиеся искусственным интеллектом, как правило, предпочитают более сдержанный стиль. 5 февраля 2026 годаdent, которая позволяет проверенным специалистам по кибербезопасности использовать свою самую мощную модель кибербезопасности, GPT-5.3-Codex, а также выделяет 10 миллионов долларов в виде API-кредитов для групп безопасности. OpenAI запустила Trusted Access for Cyber ​​— инициативу, основанную на

У компании Anthropic есть аналогичная программа киберверификации. Правительство США также ввело ограничения на экспорт своих моделей Mythos и Fable в июне. По данным TechCrunch, с 1 июля Fable 5 открыт для публики, в то время как доступ к Mythos 5 предоставлен только утвержденным организациям в Соединенных Штатах.

Лаборатории заявили, что проверка чрезвычайно эффективна в обеспечении того, чтобыtronкибервозможности оставались в руках только добросовестных участников. С другой стороны,tracутверждают, что фраза «исправьте этот код» в равной степени применима как к кибербезопасности, так и к хакерству.

Главная проблема заключается в том, что ужесточение регулирования может оттолкнуть добросовестных исследователей от использования отечественных моделей. Результаты исследования Frontier Security показывают, что, по крайней мере в области исследования уязвимостей в программном обеспечении, такие альтернативы трудно игнорировать.

Сравнение американских моделей ИИ с Kimi K3

Модель Поставщик модель доступа Киберограничения Дата начала продаж Конкретный эталон
Кими К3 Moonshot AI Открытый вес; доступен через Kimi/API и локальное развертывание В открытых материалах Moonshot не задокументировано наличие киберзащиты на уровне провайдера, сравнимой с Fable 5; её открытая архитектура позволяет развертывать её локально 16 июля 2026 г По оценке Moonshot, результат 90,4 на BrowseComp с контекстным окном в 1 миллион токенов. ( Kimi )
GLM-5.2 З.ай (Жипу АИ) Универсальный, легко размещается на собственном сервере и доступен через API Z.ai Агентство Reuters сообщило, что его использовала компания Hugging Face после того, как американские модели заблокировали анализ реальных эксплойт-материалов; в публичных материалах Z.ai не описывается аналогичный размещенный режим кибер-отказа 16 июня 2026 г FrontierSWE: отстает от Claude Opus 4.8 всего на 1% и опережает GPT-5.5 на 1%, согласно данным Z.ai. (Z.ai)
GPT-5.3-Кодекс OpenAI Закрытый весовой коэффициент, размещенный на платформе OpenAI/Codex Надежныеtronкиберзащиты; OpenAI классифицирует его как «Высокий уровень киберугроз» и применяет меры защиты от опасной кибердеятельности. 5 февраля 2026 г Проходимость проверки Cyber ​​Range составила 80%, против 53,33% для GPT-5.2-Codex; 90% для CVE-Bench. (Центр безопасности развертывания OpenAI)
Клод Мифос 5 Антропический Ограниченный вес; ограниченный доверенный доступ через проект Glasswing Для утвержденных специалистов по киберзащите сняты ограничения на использование средств защиты от киберугроз; для всех пользователей такие средства защиты недоступны. 9 июня 2026 г.; передислоцировано 1 июля. Компания Anthropic утверждает, что Mythos 5 продемонстрировал самыеtronвозможности в области кибербезопасности среди всех моделей, протестированных ею; в CryptanalysisBench передовые модели, включая Mythos 5, взломали 65%-86% схем первого уровня среди всех оцененных моделей. (Anthropic)
Басня Клода, часть 5 Антропический Закрытый весовой коэффициент; обычно доступен через Claude/API и облачных партнеров Строгие меры кибербезопасности; компания Anthropic заявляет, что ее классификаторы блокируют опасные или потенциально опасные способы использования кибербезопасности. 9 июня 2026 г.; восстановление во всем мире 1 июля. В июльском сравнении OpenAI тест SWE-Bench Pro показал результат 80,3% ; Anthropic сообщает, что Fable 5 набрала наибольшее количество баллов в оценке FrontierCode. ( OpenAI )

Сравнительная таблица моделей ИИ из США и Kimi K3

*Обратите внимание, что эталонные показатели не следует представлять как напрямую сопоставимые, если они не получены в ходе одного и того же теста. Последний столбец соответствует разделу «Выбранный эталон» и не подразумевает, что оценки напрямую ранжируют пять моделей.

Сравнение показывает, почему опыт команды Bitcoin Red Team гораздо сложнее, чем простое утверждение о том, что китайский ИИ превзошел американские модели. GPT-5.3-Codex от OpenAI продемонстрировал 90% показатель CVE-Bench и 80% показатель прохождения проверки Cyber ​​Range, в то время как Mythos 5 от Anthropic специально разработан для предоставления сертифицированным специалистам по кибербезопасности доступа к возможностям, которые ограничены в Fable 5.

Разница заключается в способе предоставления этих возможностей. Kimi K3 и GLM-5.2 — это модели с открытыми весами, которые можно развернуть локально, в то время как Fable 5 использует классификаторы кибербезопасности, а Mythos 5 ограничивает доступ только для авторизованных пользователей. OpenAI аналогичным образом рассматривает GPT-5.3-Codex как модель кибербезопасности высокого риска и применяет меры защиты при ее использовании.

Для китайской модели результаты исследования AISI особенно полезны:dent тестирование показало, что GLM-5.2 на момент тестирования была наиболее перспективной моделью с открытыми весами в киберпространстве и показала результаты, аналогичные Claude Opus 4.6 в узкоспециализированных киберзадачах, отставая при этом от закрытой модели примерно на четыре-семь месяцев.

 

Самые умные криптоаналитики уже читают нашу рассылку. Хотите присоединиться? Вступайте в их ряды.

Часто задаваемые вопросы

Что такое Kimi K3?

Kimi K3 — это мощная модель искусственного интеллекта с открытым исходным кодом от китайской компании Moonshot AI, которую, согласно тестам Frontier Security, можно отнести к числу лучших в обнаружении уязвимостей в программном обеспечении и сетях.

Почему исследователи в области безопасности обращаются к китайским моделям искусственного интеллекта?

По данным TechCrunch, системы контроля и проверки, используемые в американских передовых моделях безопасности, часто отказываются от легитимной работы, поэтому исследователи обращаются к свободно загружаемым китайским моделям с открытым исходным кодом, таким как GLM и Kimi, которые работают локально без ограничений на использование.

Что произошло, когда компания Frontier Security провела тестирование Kimi K3?

Издание WIRED сообщило, что во время тестирования системы защиты Kimi K3 использовало ошибку в конфигурации песочницы для доступа к открытому интернету, хотя ничего взломать не удалось, поскольку необходимые ответы уже были доступны на GitHub.

Kimi K3 — бесплатная программа?

Kimi K3 доступен в виде модели с открытым весом, что означает, что разработчики могут получить и развернуть эту модель, а не полагаться исключительно на размещенный сервис Moonshot AI. Moonshot заявляет, что K3 выпускается под лицензией с открытой моделью, в то время как доступ к размещенным сервисам Kimi и API может включать отдельные ограничения на использование или плату.

Что такое GLM?

GLM расшифровывается как General Language Model (общая языковая модель) — семейство больших языковых моделей, разработанных китайской компанией Z.ai, ранее известной как Zhipu AI, специализирующейся на искусственном интеллекте. GLM-5.2 — одна из последних моделей компании, выпущенная 16 июня 2026 года, с контекстным окном в 1 миллион токенов и лицензией с открытым исходным кодом MIT, согласно информации от Z.ai.

Какие модели ИИ, используемые в США, подлежат экспортному контролю в сфере кибербезопасности?

Бюро промышленности и безопасности (BIS) регулирует определенные передовые вычислительные продукты, программное обеспечение, технологии и весовые коэффициенты моделей ИИ в соответствии с Правилами экспортного контроля. Действующие правила BIS включают контроль за определенными весовыми коэффициентами моделей ИИ, классифицированными по коду ECCN 4E091, с требованиями к лицензированию, которые могут зависеть от страны назначения, конечного пользователя и других обстоятельств. Экспортный контроль США и меры кибербезопасности компаний, занимающихся ИИ, представляют собой отдельные системы.

Означает ли меньшее количество ограничений в системе контроля ИИ, что модель безопаснее?

Нет. Меньшее количество ограничений может сделать модель более полезной для легитимных исследований в области безопасности, но оно также может увеличить потенциал для злоупотреблений.

Что произошло с предполагаемым побегом Кими К3 из песочницы?

Агентство Reuters сообщило, что компания Frontier Security заявила об обходе тестовой среды кибербезопасности Kimi K3, разработанной британским Институтом безопасности ИИ. Исследователи предупредили, что подобные возможности могут создать риски, если ими воспользуются злоумышленники.

Что означает эпизод с «красной командой» Bitcoin для гонки искусственного интеллекта между США и Китаем?

Это говорит о том, что конкуренция все чаще сводится к чему-то большему, чем просто к эталонным показателям. Возможность поддерживать исследования в области кибербезопасности в сочетании со степенью доступа и ограничениями, налагаемыми на пользователей, может стать важным конкурентным фактором.

Поделитесь этой статьей

Предупреждение. Предоставленная информация не является торговой рекомендацией. Cryptopolitanнастоятельно не несет ответственности за любые инвестиции, сделанные на основе информации, представленной на этой странице. Мыtronпровести независимоеdent и/или проконсультироваться с квалифицированным специалистом, прежде чем принимать какие-либо инвестиционные решения.

Ашиш Кумар

Ашиш Кумар

Ашиш Кумар — крипто- и финансовый журналист с восьмилетним опытом работы в новостной редакции. Он освещает события на криптовалютных рынках, вопросы регулирования, DeFiи экосистемы бирж. Он сотрудничал с Coingape, Todayq и Newsroompost. Ашиш имеет диплом PGDP по английской журналистике от IIMC. Он также брал интервью у таких деятелей индустрии, как Артур Хейс, Ят Сиу, Остин Федера и других.

ЕЩЕ… НОВОСТИ