Yapay zekâ

AIUC, yapay zekâ ajanlarının güvenliğini değerlendirmek için 40 milyon dolar topladı

Artificial Intelligence Underwriting Company, AIUC-1 standardını ve yapay zekâ ajanları için bağımsız denetim hizmetini geliştirmek üzere Series A turunda 40 milyon dolar topladı. Şirket, bariyerleri aşma, halüsinasyon ve veri sızıntısı gibi konuları kapsayan yaklaşık 5.000 senaryoda ajanları test ediyor ve insan ekiplerin doğruladığı bir denetim raporu yayımlıyor.

2026-09-15
3 dk okuma
46 görüntülenme
certi.news Editorial Team
AIUC, yapay zekâ ajanlarının güvenliğini değerlendirmek için 40 milyon dolar topladı

Artificial Intelligence Underwriting Company, kısaca AIUC olarak bilinen şirket, kurumlarda kullanılan veya model ve uygulama şirketleri tarafından geliştirilen yapay zekâ ajanlarının güvenliğini denetlemek ve belgelendirmek için bağımsız bir katman oluşturmak amacıyla, First Harmonic'in de katıldığı ve Ribbit Capital'ın liderlik ettiği Series A finansman turunda 40 milyon dolar topladı.

Şirkete, daha önce Anthropic'te erken dönem çalışanı olan Rune Kvist ve 2024 ile 2025 yılları arasında yapay zekâ güvenliği araştırma kuruluşu METR'de operasyonlardan sorumlu üst düzey yönetici olarak görev yapan ve hâlen kuruluşun yönetim kurulunda bulunan Rajiv Dattani liderlik ediyor. AIUC, Cursor, Lovable, Harvey ve ElevenLabs'in müşterileri arasında olduğunu belirtiyor.

Siber güvenlik denetimlerinden esinlenen standart

AIUC, siber güvenlikteki tanıdık bir modeli yapay zekâ ajanlarının risklerine taşımayı hedefliyor. Şirket, AIUC-1 adını verdiği bir standardın yanı sıra, ajanın güvenli ve güvenilir biçimde davranma derecesini ölçen bir test ve denetim hizmeti geliştirdi. Fikir, teknoloji şirketlerinin kontrollerini değerlendirmede yaygın olarak kullanılan SOC 2 standardına dayanıyor; ancak kaynak, AIUC-1'in şirket ve müşterileri dışında kabul edilmiş veya yaygın biçimde benimsenmiş bir standart olduğunu belirtmiyor.

Şirket, standardı oluşturmak için ajanları satın alan veya onları kullanıma sunma kararı veren grup olan yaklaşık 250 güvenlik ve risk yönetimi yöneticisinden oluşan bir koalisyon kurdu. AIUC, testlerin kapsaması gereken soruları ve riskleri belirlemek için bu katılımcıların görüşlerini kullanıyor.

Yaklaşık 5.000 test ve nihai insan doğrulaması

Şirket, ajanı bariyerleri aşma girişimleri, halüsinasyon ve veri sızıntısı gibi senaryoları kapsayan yaklaşık 5.000 testten oluşan bir setten geçiriyor. Süreç, ajanın hangi alanlarda güvenli ve güvenilir davrandığını, hangi alanlarda ise zayıflıklar veya endişeler görüldüğünü açıklayan yaklaşık 100 sayfalık bir rapor üretiyor.

AIUC, testleri gerçekleştirmek ve verileri analiz etmek için yapay zekâ ajanlarını kullanıyor; ancak Rune Kvist, insan denetçilerin nihai denetim sonucunu doğruladığını söyledi. Rapor, kurumlara ajanı satın alma veya kullanıma sunma kararı vermeden önce bağımsız bilgi sağlamayı amaçlıyor; sistemin her koşulda güvenli olduğuna dair mutlak bir güvence sunmayı değil.

METR'nin değerlendirmelerinden farkı nedir?

METR, özerklik ve değerlendirme alanlarında benzer testler gerçekleştiriyor; ancak çalışmaları yakın zamana kadar daha büyük ölçüde ajanların performansına ve belirli görevleri güvenilir biçimde tamamlama becerisine odaklandı. AIUC ise değerlendirmeyi, veri sızıntısı ve istenmeyen davranış gibi pratik kullanım sırasında kurumların önem verdiği risklere yönlendirmeye çalışıyor.

certi.news'un değerlendirmesi

Buradaki en önemli gelişme yalnızca finansman değil, yapay zekâ ajanlarının güvenliğini satın alma öncesinde karşılaştırılabilir, harici bir denetim sürecine dönüştürme girişimi. Bu, model sağlayıcılarının güvenlik iddialarıyla yetinemeyen kurumlara fayda sağlayabilir; ancak pazarın AIUC-1 standardını ne ölçüde tanıyacağı, ajanlar güncellendikçe test sonuçlarının nasıl değişeceği ve 5.000 testin gerçek çalışma ortamlarını temsil edip etmediği konusunda açık sorular bırakıyor. Ayrıca test ve analizin bir bölümünün yine yapay zekâya dayanması, nihai insan doğrulamasını hizmetin güvenilirliği açısından kritik bir unsur hâline getiriyor.

AIUC'nin iki kurucusu bu modeli, kurumların müşterileri açısından sistem davranışının sınırlarını garanti edemediği durumlarda bankalar, hastaneler, hükümetler ve askerî kuruluşlar içinde daha akıllı sistemleri kullanıma sunmanın zorluğuyla ilişkilendiriyor. Bu yaklaşım, Anthropic'in CEO'su Dario Amodei'nin gelişmiş modellerin geliştirilmesini yavaşlatma ve güvenliği izlemek ve doğrulamak için bağımsız değerlendiriciler kullanma çağrısıyla kesişiyor; METR de olası seçeneklerden biri olarak anılıyor.

Haber kaynağı
TechCrunch Startups
Özgün kaynağı aç ↗
c
Yazar

certi.news Editorial Team

Aynı kategoride

Bunlar da ilginizi çekebilir

Tüm haberleri gör