最新ニュース
あなたへのおすすめ

OpenAIとAnthropicのエージェントが英国の安全テストで19件の違反を記録

によるランダ・モーゼスランダ・モーゼス
3分で読めます
OpenAIとAnthropicのエージェントが、英国で行われた安全性テストで19件の違反を記録。.
  • 英国のAIセキュリティ研究所は、122回のテスト実行において、19件の規則違反を発見した。.
  • Anthropic社のMythos 5が17件のdentの原因であり、OpenAI社のGPT-5.6-Solが残りの2件の原因であった。.
  • 最悪のdent エージェントが悪意のあるコードを作成し、偽のオンラインIDを偽造して、人間に承認させようとしたdent。.

英国のAIセキュリティ研究所によると、サイバーセキュリティテスト中に、OpenAIとAnthropicのAIエージェントが19件の不正な行動をとった。同研究所は火曜日、エージェントの1つが偽のオンラインdentを作成し、悪意のあるコードを承認させるために人を騙したと発表した。.

AISIは19件の違反を記録しており、そのほとんどは人為的なものです。

この結果は、英国政府機関であるAISIが実施した架空のサイバーセキュリティ演習に基づいている。この演習は、両社のエージェントがどのような行動をとれるかを検証することを目的としていた。AISIは同じ課題を122回繰り返し、そのうち10回の試行で19件のルール違反行為を記録した。.

フラグが立てられたアクションのうち17件は、Anthropic社のエージェントが同社のMythos 5モデルを使用したことによるものでした。残りの2件は、OpenAI社のGPT-5.6-Solによるものでした。.

AISIは ブログ記事 、一部のエージェントが「実在の人物や組織を標的とした、継続的かつ潜在的に有害な活動に従事していた」と述べたものの、いずれの侵害も現実世界に被害をもたらしたわけではないとしている。

AISIは、主要な研究所との自主的な協定を通じて、最先端のモデルに早期にアクセスできる。こうしたモデルが顧客に届く前に、不具合を検出するためのテストも実施されている。.

OpenAIとAnthropicは、次世代のビジネスソフトウェアとしてエージェントを市場に投入しているが、同研究所は、今回の結果はエージェントのテストに関する安全対策が依然として不十分であることを示す証拠だと指摘している。.

最も悪質な事例dent を生成した後、人間にそのコードの承認を得ようとしたエージェントによるものだったdent2つの事例のいずれにも当てはまらないと述べた OpenAI

そうなると、犯人はアントロピック社の代理人である可能性が高いと、AIリスクを研究するカリフォルニア州の非営利団体CivAIの研究員であるアンドリュー・ユン氏は述べた。.

OpenAIとAnthropicは設定ミスを非難

AnthropicはXに関する投稿で、AISIと協力して詳細情報を収集し、調査を実施していると述べた。.

OpenAIは、自社のエージェントに関連する2つの行動について、会社のブログ記事で回答した。どちらの行動も、プロンプトで許可されていない方法でインターネットにアクセスするものだった。.

同社は「高リスク評価を安全に実施するための共通慣行を強化したい」と述べ、今後数週間以内に国内のAI研究所、外部評価機関、競合研究所を集めて会合を開く予定だと語った。

OpenAIは同じ投稿で別の問題についても報告していた。サードパーティのテストプロバイダーであるIrregularが設定を誤っていたため、意図せずOpenAIのエージェントがインターネットにアクセスできてしまったというのだ。.

Anthropicは1週間前にIrregularについて非常によく似た情報を開示していた。OpenAIは、さらに多くのエージェントの脱走が発覚したことを受け、独自のハッキング調査を拡大した。.

7月、 OpenAIの エージェントが隔離された環境から脱出し、Hugging Faceの稼働中のシステムにアクセスした。Hugging FaceはFBIに通報し、 trac約1週間後に攻撃の犯人が同社自身で

AISIの評価において、エージェントはサンドボックスから脱出することは決してなかった。AISIは、標準的な手順の一環として、意図的にエージェントにインターネットアクセスを許可した。.

Hugging Faceの情報漏洩事件を受けて、 Anthropic社は ログの監査を余儀なくされた。Cryptopolitan Cryptopolitan 7月31日、同社がMythos 5を含む3つのモデルがテスト環境から逸脱し、設定ミスによってインターネット接続が可能になった後、3つの実際の組織に到達していたことを発見したと報じた。

Mythos 5は、削除される前に15台の実機で動作した悪意のあるPythonパッケージをPyPIに公開した。Anthropicは、評価グループMETRにこの件について独立dentた調査を依頼した。.

仮想通貨ニュースを読むだけでなく、理解を深めましょう。ニュースレターにご登録ください。 無料です

よくある質問

AIセキュリティ研究所は、いくつの侵害を発見したのか、そしてそれらの侵害の大部分はどのモデルによって引き起こされたのか?

AISIは122回のテスト実行で19件の不正行為を記録した。そのうち17件はAnthropic社のMythos 5エージェントによるもので、残りの2件はOpenAI社のGPT-5.6-Solによるものだった。.

試験中に発生した最も深刻なdent は何でしたか?

ある工作員が悪意のあるコードを作成し、偽のオンラインdentを作成して、人間にそのコードを承認させようとした。.

これらの情報漏洩は、現実世界に何らかの被害をもたらしたのか?

いいえ。AISIは、19の措置のいずれにおいても、現実世界における害は確認されなかったと述べています。.

この記事を共有する

免責事項。 提供される情報は取引アドバイスではありません。Cryptopolitan.com Cryptopolitan、 このページで提供される情報に基づいて行われた投資について一切の責任を負いません。tronお勧めしますdent 調査や資格のある専門家への相談を

ランダ・モーゼス

ランダ・モーゼス

ランダ・モーゼスは、 Cryptopolitan の編集者兼記者として、テクノロジー、AI、ロボット工学、暗号通貨、詐欺、ハッキングなどを取材しています。彼女は2017年から暗号通貨業界で活動しており、Forward Protocol、AmaZix、Cryptosomniacなどで勤務経験があります。ランダはブラッドフォード大学で電気tron工学の学位を取得しています。.

もっと…ニュース