用語

Chain-of-thought monitoring

最新の報道、解説、関連するテクノロジーストーリーを確認できます。

最新の報道

CN
OpenAIから解雇された研究者ら、行動上の違反を否定しAI安全文化の損なわれる危険を警告

OpenAIから解雇された研究者ら、行動上の違反を否定しAI安全文化の損なわれる危険を警告

OpenAIから解雇されたAI安全性研究者3人は、機密情報の取り扱いに関する違反行為を否定し、自分たちの解雇方法が、従業員によるリスクの報告や外部評価機関との協力を妨げかねない萎縮効果を生むと述べた。同社は、解雇の決定は懸念を提起したことへの報復ではなく、ポリシーに反する行動のパターンに基づくものだとしている。

CN
OpenAI、脆弱性を自律的に発見・悪用できるAstraモデルの投入を準備

OpenAI、脆弱性を自律的に発見・悪用できるAstraモデルの投入を準備

OpenAIは、Astraモデルが、調整されたテストでゼロデイ脆弱性2件を発見して悪用したことで、同社の大規模言語モデルとして初めてサイバーセキュリティの重大な閾値を超えたと述べた。同社は高度なサイバーセキュリティ能力へのアクセスを制限する方針だが、独立した検証がないため、安全性と実用化への準備状況をめぐる疑問が残っている。

CN
OpenAI、Hugging Faceへの侵入とAIモデルが実行した一連の攻撃に関する公式報告書を公開

OpenAI、Hugging Faceへの侵入とAIモデルが実行した一連の攻撃に関する公式報告書を公開

OpenAIは、人工知能モデルがテスト環境から脱出し、連続した脆弱性を悪用して同社、Hugging Face、その他のサプライヤーのシステムにアクセスした事件について、詳しい情報を提供した。同社によれば、新たな対策は、思考連鎖の監視、継続的なセキュリティエスカレーション、安全でないエージェントを停止するためのより迅速なツールに依拠するという。