Grok Bot Galaxyと名付けられた実験では、AIエージェントが、コード作成や文章生成といった単独の作業にとどまらず、72時間でゼロからスタートアップの設立に参加できるかを検証する。原資料によると、実験は9月15日にサンフランシスコで始まり、2026年9月17日まで続く。作業の各段階はライブ配信される。
実験にはSpaceXAIが参加し、Grok Botチームの3人のメンバー、Matt Palmer、Lauren Tan、Roshan Sadananiが率いる。既存の製品やアイデアから始めるのではなく、主催者によれば、チームは特定の会社名、製品、最終的な事業構想がない、ほぼ白紙の状態から開始した。
ソフトウェアの作成から会社の機能運営まで
この検証の中心となるのは、AIエージェントに複数の役割を分担させ、人間が意思決定と監督を担うことだ。実験が対象とする一連の流れには、アイデアの決定、事業計画の策定、製品の開発とエンジニアリング、さらに販売、マーケティング、カスタマーサービス、アフターセールスへの移行が含まれる。
公開されたアジェンダには、エンジニアリングと開発、プロダクトマネジメント、会社設立、セールスエンジニアリング、販売、SDRによる営業開発、カスタマーサービス、マーケティングオペレーション、マーケティング、アフターセールスのセッションが含まれている。したがって問われているのは、Grok Botがプログラムを生成できるかだけではなく、スタートアップ内部で相互に関連する機能を担うチームとしてエージェントを活用できるかどうかでもある。
チームは初日に何を達成したのか?
初日の詳細によると、チームはプロジェクトの範囲を絞り込む前に複数の方向性を議論し、アイデアの創出、計画策定、製品構築にGrok Botを利用した。その後、開発環境と実際のソフトウェアプロジェクトの構築に移り、長大な理論上の計画作成に時間を費やすよりも、迅速なプロトタイプの構築を優先した。
短い期限内で構築・検証できる製品を探す過程では、レストラン業界向けのツールやソリューションの提供に関連するアイデアも浮上した。しかし、原資料は、そのアイデアが完成した製品や利用可能なサービスへと発展したことを示す最終的な結果を提示していない。
構築から市場へ
2日目のプログラムは、セールスエンジニアリング、販売、見込み顧客の開拓、カスタマーサービスなど、販売と事業開発に充てられた。この段階が重要なのは、評価の焦点が、エージェントがソフトウェアを構築できるかどうかから、料金を支払う顧客を特定し、その顧客に製品の価値を説明し、顧客に到達し、さらに関係を維持できるかどうかへ移るためだ。
3日目は、最終発表Final Showcaseに先立ち、マーケティングオペレーションとアフターセールスに充てられた。そのため、実験の評価は、チームが実際に何を発表するかにかかっている。すなわち、利用可能な製品と見込み顧客を持つ会社なのか、それともプロトタイプとインターフェース、限定的なマーケティング体験なのかという点だ。
なぜこの検証が重要なのか?
この実験の意義は、AIエージェントを単一の技術的作業ではなく、相互に関連する一連の事業上・実行上の意思決定に直面させる点にある。ただし、実験は公表された72時間という期間に限定されており、利用可能な資料は、品質、コスト、ローンチ後の製品性能について独立した測定結果を示していない。そのため、最終発表で目に見える成果が得られたとしても、それだけでエージェントが会社設立において完全な人間のチームを代替できることを証明するには不十分である。