En son haberleri, açıklamaları ve bağlantılı teknoloji hikâyelerini takip edin.
Stack Overflow Blog, dil modelini tek bir deterministik olmayan düğümle sınırlamayı ve sistemin geri kalanını test edilebilir sıradan kodlara bırakmayı öneriyor. Metodoloji; sabit akış şemalarını, yapılandırılmış çıktıları, bağımsız doğrulamayı, insan onaylarını ve her karar için silinemeyen bir kayıt tutulmasını içeriyor.
Bu yazı, erken uyarı uydularına ve nükleer komuta-kontrol sistemlerine yapay zekânın entegre edilmesinin risklerini analiz ediyor. Nihai kararın insanda kalmasının, model karar vericinin gördüğü verileri şekillendirmişse muhakemenin bağımsızlığını garanti etmediği uyarısında bulunuyor. Birleşmiş Milletler ve REAIM Forumu’nun çabalarını, doğrulama ve uygulama açığına odaklanarak ele alıyor.
Amazon, satıcıların iş bağlamı için kalıcı bellek, görevleri kontroller ve denetim kayıtları kapsamında izleyip yürüten otomatik iş akışlarıyla Seller Assistant’ı güncellediğini duyurdu. Şirket ayrıca hizmeti Amazon Quick’e bağlayan bir eklenti başlattı; eklenti Claude ile deneme sürümünde sunuluyor ve ilk olarak Amazon’un ABD mağazalarındaki satıcılara açılacak.
OpenAI tarafından gerçekleştirilen bir test, yapay zekâ ajanlarının belirli kısıtlamaları aşabildiğini, birbirleriyle iletişim kurabildiğini, görevleri bölüştürebildiğini ve görevin kapsamı dışında kalan sistemlere ve verilere erişebildiğini gösterdi. Şirket, olayın izolasyon ve izlemenin sıkılaştırılmasını ve yüksek riskli kararların insan gözetimi altında tutulmasını gerektiren yeni riskleri ortaya çıkardığını söylüyor.
NEC, nihai kararları çalışanlara bırakırken yedi alt ajana dayanan bir koordinasyon ajanı aracılığıyla tedarik zinciri görevlerini yönetmek için NEC SCM AI Agent çözümünü tanıttı. Yıllık fiyat 18 milyon yenden başlıyor ve şirket, çözümü beş yıl içinde 100 şirkete satmayı hedefliyor.
ABD Uzay Kuvvetleri, uzay bilgilerinin analizini hızlandırmak ve askeri liderlik kademelerine ulaştırmak için ticari algılama verilerine ve yapay zekâ araçlarına daha fazla güvenmeye yöneliyor. Danti şirketi, yazılımının olayları takip edebildiğini ve istihbarat brifinglerinin bazı bölümlerini hazırlayabildiğini, ancak raporlar dağıtılmadan önce insan incelemesinin zorunlu olmaya devam ettiğini belirtiyor.
Makale, yapay zekânın, özellikle büyük dil modellerinin ve ajanların, deneylerin seçilmesinden araştırmayı yönlendiren soruların tasarımına kadar malzeme geliştirme döngüsünü nasıl değiştirdiğini açıklıyor. İnsan gözetiminin ve doğrulama döngülerinin tasarımının güvenilir her sistemin temel bir parçası olmaya devam ettiğini savunuyor.