Grok Bot Galaxy adını taşıyan deney, yapay zekâ ajanlarının yalnızca kod yazma veya metin oluşturma gibi tekil görevlerle sınırlı kalmak yerine, 72 saat içinde sıfırdan bir girişim kurmaya katılma kapasitesini test ediyor. Kaynak metne göre deney 15 Eylül'de San Francisco'da başladı ve çalışma aşamalarının canlı yayınıyla 17 Eylül 2026'ya kadar devam ediyor.
Deneye SpaceXAI şirketi katılıyor ve deneyi Grok Bot ekibinden Matt Palmer, Lauren Tan ve Roshan Sadanani yönetiyor. Organizatörler, hazır bir ürün veya fikirle yola çıkmak yerine ekibin belirli bir şirket adı, ürün ya da nihai ticari tasarım olmadan, neredeyse boş bir sayfadan başladığını belirtti.
Yazılım yazmaktan şirket işlevlerini yürütmeye
Temel test, insanların kararlar ve denetimden sorumlu olmaya devam ettiği bir ortamda yapay zekâ ajanlarına birden fazla rol dağıtılmasına dayanıyor. Deneyin hedeflediği süreç; fikrin belirlenmesini, iş planının hazırlanmasını, ürünün geliştirilmesini ve mühendisliğini, ardından satış, pazarlama, müşteri hizmetleri ve satış sonrası çalışmaları kapsıyor.
Açıklanan programda mühendislik ve geliştirme, ürün yönetimi, girişim kurma, satış mühendisliği, satış, SDR iş geliştirme, müşteri hizmetleri, pazarlama operasyonları ile pazarlama ve satış sonrası oturumları yer alıyor. Böylece ortaya atılan soru yalnızca Grok Bot'un bir program üretip üretemeyeceğiyle sınırlı kalmıyor; ajanların bir girişim içinde birbirine bağlı işlevleri yerine getiren bir ekip olarak kullanılıp kullanılamayacağını da kapsıyor.
Ekip ilk gün ne yaptı?
İlk günün ayrıntılarına göre ekip, projenin kapsamını daraltmadan önce çeşitli yönleri tartıştı ve fikir üretme, planlama ve ürün oluşturma için Grok Bot'u kullandı. Ardından bir geliştirme ortamı ve gerçek bir yazılım projesi oluşturmaya geçti; uzun ve teorik bir plan hazırlamaya zaman ayırmak yerine hızlı bir prototip geliştirmeyi tercih etti.
İşe yarayacak ve kısa süre içinde test edilebilecek bir ürün arayışı sırasında restoran sektörüne araçlar ve çözümler sunma fikri de ortaya çıktı. Ancak metin, bu fikrin tamamlanmış bir ürüne veya kullanıma hazır bir hizmete dönüştüğünü kanıtlayan nihai bir sonuç sunmuyor.
Geliştirmeden pazara
Programın ikinci günü, satış mühendisliği, satış, potansiyel müşteri geliştirme ve müşteri hizmetleri de dahil olmak üzere satış ve iş geliştirmeye ayrıldı. Bu aşama önemli; çünkü değerlendirmeyi ajanların yazılım geliştirme becerisinden, ödeme yapacak müşteriyi belirleme, ürünün değerini ona açıklama, ona ulaşma ve ardından ilişkiyi sürdürme becerisine taşıyor.
Üçüncü gün ise nihai Final Showcase sunumundan önce pazarlama operasyonları ve satış sonrası çalışmalara ayrıldı. Bu nedenle denemenin değerlendirilmesi, ekibin gerçekte ne sunacağına bağlı: Kullanılabilir bir ürüne ve potansiyel müşterilere sahip bir şirket mi, yoksa bir prototip, arayüz ve sınırlı bir pazarlama deneyimi mi?
Bu test neden önemli?
Deneyin önemi, yapay zekâ ajanlarını tek bir teknik görevle değil, birbirine bağlı bir ticari ve operasyonel kararlar zinciriyle karşı karşıya getirmesinde yatıyor. Bununla birlikte deney, ilan edilen 72 saatlik süreyle sınırlı ve mevcut materyal kalite, maliyet veya ürünün piyasaya sürüldükten sonraki performansına ilişkin bağımsız ölçümler sunmuyor. Bu nedenle yalnızca nihai sunumda görülen sonuç, ajanların şirket kurma sürecinde eksiksiz bir insan ekibinin yerini alabileceğini kanıtlamaya yetmiyor.