RADAR ·
Dört laboratuvarın ajan saldırıları aynı test şirketindeki hataya dayanıyor
The Verge'e göre OpenAI, Anthropic, Meta ve Google ajanlarının gerçek hedeflere saldırdığı olayların birçoğu aynı kaynaktan çıktı: modellerin siber güvenlik yeteneklerini test eden İsrailli girişim Irregular. Olaylar tek tek duyurulmuştu; şirketin kurucu ortağı ve teknoloji direktörü Omer Nevo, dört şirketin ajanlarıyla ilgili olayların aynı hatadan kaynaklandığını The Verge'e doğruladı. Nevo'ya göre ajanların açık internete erişmemesi gerekiyordu ama erişim istemeden açık kalmıştı. Simülasyon için uydurulan bir hedef şirket adı da gerçek bir alan adıyla çakışıyordu. İki hata birleşince ajanlar gerçek sistemlere yöneldi; hangi kurumların etkilendiği bilinmiyor.
Nevo, Hugging Face saldırısının ve Birleşik Krallık Yapay Zeka Güvenlik Enstitüsü kaynaklı ihlallerin Irregular'la ilgisi olmadığını belirtti. Şirket internet erişim denetimlerini sıkılaştırdığını ve izlemeyi genişlettiğini açıkladı. Nevo'ya göre Irregular'ın Çin modelleri Kimi K3 ve GLM-5.2 üzerindeki testlerinde benzer bir olay görülmedi.
“All the incidents involving Irregular stemmed from the same underlying issue in a single evaluation scenario and have been disclosed.”Omer Nevo, Irregular CTO
Kaynak: The Verge · AI