Çin’in Z.ai’sı, GLM-5.3 ile Mythos 5’e Yaklaşıyor, ABD’ye Yakınlaşıyor
Z.ai, bugün açıkladığı raporunda, açık kaynaklı GLM-5.3 modelinin yazılım açıklarını tespit etme testlerinde Anthropic’in Mythos 5 modeline yaklaştığını bildirdi. Yani, Çinli girişim, Batılı geliştiricilerin ilgisini çeken bir konumda kendini bir kez daha gösterdi.
CyberGym testinde GLM-5.3, kodları inceleme, güvenlik açıklarını tespit etme ve doğrulama kabiliyetiyle yüzde 84,5 puan aldı; Mythos 5 ise yüzde 83,8 puanla geride kaldı. Bu sonuçlar bağımsız kaynaklarca teyit edilmedi ama kesinlikle göz dolduruyor.
ExploitBench testinde ise GLM-5.3 yüzde 54,4, Mythos 5 ise yüzde 78,0 puanla öne çıktı. Yani, saldırı geliştirme yeteneği bakımından Mythos hâlâ üstünlük sağlıyor.
Zaman bazlı testlerde GLM-5.3 iki saatte 105, altı saatte 130 saldırı geliştirdi; Mythos 5 ise aynı sürelerde sırasıyla 181 ve 247 görev tamamladı. Bu rakamlar, Çinli modelin hızını gösterirken Mythos’un daha yüksek performansını da ortaya koyuyor.
Anthropic, siber güvenlik korumaları kaldırılmış Claude Fable 5 modeli olan Mythos’u yalnızca denetim geçiren kuruluşlara sunuyor. Bu kısıtlamalar, yazılım açıklarını bulma ve kullanma kabiliyetine sahip yapay zekâların hem savunuculara yardım edebileceği hem de saldırganların işini kolaylaştırabileceği endişesinden kaynaklanıyor. Z.ai, güvenlik değerlendirmelerini tamamlayıp koruma katmanlarını güçlendirdikten sonra GLM-5.3’ü iki hafta içinde kamuya açacağını duyurdu. Modelin en hassas siber güvenlik fonksiyonları ise “güvenilir erişim” programı aracılığıyla yalnızca doğrulanmış kullanıcılara açık olacak.
Şirket, riskli talepleri tarayan, modeli denetleyen ve zararlı görevleri reddeden çeşitli koruma katmanları eklediğini açıkladı. Ancak eleştirmenler, model başka birinin eline geçip değiştirilebildiğinde bu önlemlerin zorlaşacağını savunuyor. Z.ai, bu adımı Mythos’un temsil ettiği kısıtlı erişim modeline meydan okuma olarak tanımladı. Gelişmiş siber savunma araçlarının sadece sınırlı kapalı modeli sağlayan birimlerde kalması yerine, açık kaynaklı geliştiricilere ve küçük güvenlik ekiplerine sunulması gerektiğini vurguladı. “Açık Kaynak Kalkanı” girişimiyle seçilen projeleri denetleyecek, savunma çalışmaları için modele erişim sağlayacak ve ZCode programında kod denetim işlevleri ekleyecek.
Kaynak: Orijinal Haber

