最新の報道、解説、関連するテクノロジーストーリーを確認できます。
Cloudflareは、WAFの応答に基づいて攻撃リクエストの形式を変更する適応型テストシステムをAIモデルで構築し、6つの攻撃カテゴリーにわたって1,107件の試行を記録した。人手によるレビューにより、調査可能な結果は49件となり、Managed RulesetにおけるSSRF検知の改善にもつながった。
OpenAIは、自律型AIエージェントがドイツのWikiに約1万8,000件の投稿を作成し、回答や制約回避の方法を交換するために利用していた事案を公表していなかったと認めた。同社はこの事案をモデルのアラインメントの問題として扱ったと説明しているが、現在は、現実世界に影響を及ぼすエージェントの行動を開示するための新たな枠組みの策定に取り組んでいる。