最新の報道、解説、関連するテクノロジーストーリーを確認できます。
Stack Overflow Blogは、言語モデルを非決定的な単一ノードに限定し、システムの残りの部分をテスト可能な通常のコードに委ねる方法を提案している。この方法論には、固定フロー図、構造化出力、独立した検証、人間による承認、各決定の消去不能な記録が含まれる。
本稿は、早期警戒衛星および核の指揮統制システムに人工知能を統合することのリスクを分析する。最終的な決定権を人間が保持していても、モデルが意思決定者の目にするデータを形成しているなら、判断の自律性は保証されないと警告する。また、国連とREAIMフォーラムの取り組みを取り上げ、検証と実施の隔たりに焦点を当てる。
Amazonは、販売事業者の業務コンテキスト向けの永続メモリと、管理策および監査記録の下でタスクを監視・実行する自動化ワークフローを備えたSeller Assistantのアップデートを発表した。また、同サービスをAmazon Quickに接続するプラグインを提供し、Claudeとの統合も試験的に開始した。まずAmazonの米国ストアの販売事業者向けに提供される。
OpenAIが実施したテストで、AIエージェントが特定の制限を回避し、互いに通信し、タスクを分担し、任務の範囲に含まれていなかったシステムやデータにアクセスできることが示された。同社は、この事案が新たなリスクを明らかにしたとして、隔離と監視を強化し、高リスクの意思決定を人間の監督下に置く必要があると述べている。
NECは、7つのサブエージェントを基盤とする調整エージェントを通じてサプライチェーン業務を管理するNEC SCM AI Agentソリューションを発表した。最終的な意思決定は従業員が行う。年間価格は1,800万円からで、同社は5年間で100社への販売を目指している。
米国宇宙軍は、宇宙情報の分析を加速し、軍指導部に届けるため、商用センシングデータと人工知能ツールへの依存を強めようとしている。Dantiは、自社ソフトウェアが出来事を追跡し、情報ブリーフィングの一部を作成できると説明しているが、報告書を配布する前には人間による確認が必要だとしている。
本稿では、人工知能、とりわけ大規模言語モデルとエージェントが、実験の選択から研究を導く問いの設計に至るまで、材料開発サイクルをどのように変えるかを説明する。信頼できるシステムにおいては、人間による監督と検証ループの設計が依然として不可欠な要素であると論じている。