Z.ai’ın GLM-5.5 çıkaracağı iddia ediliyordu, sonunda beklenen model kendini gösterdi. Fakat GLM-5.5 değil de GLM-5.3 geldi. Çinli şirket yeni yapay zeka aracının kodlama ve güvenlikte 5.2’ye kıyasla daha iyi olduğunu vurguluyor. Lafı dolandırmadan neler olup bittiğine yakından bakalım…
Firma, GLM-5.2’ye kıyasla elde edilen performans artışının temel model değiştirilmeden, eğitim sonrası çalışmalarla sağlandığını söylüyor. Code Bench testinde puanı yükselten model; Terminal Bench 3.0, DeepSWE, CyberGym ve ExploitBench gibi benchmark’larda da 5.2’nin önüne geçti. ExploitGym testinde ise fark daha da açıldı. Z.ai modeli açık kaynak olarak iki hafta sonra yayınlayacağını belirtti. Bu süre içinde güvenlik değerlendirmesi ve ek çalışmalar yapılacak.

Verilen Görevleri Başarıyla Tamamladı
GLM-5.3, iki saatlik süre içinde 105 görevi tamamlarken GLM-5.2 ise 29 görevde kaldı. Süre altı saate çıktığında yeni model 130, eski sürüm ise 39 görevi bitirebildi. Z.ai ayrıca Çin’deki siber güvenlik ekipleriyle yaptığı testlerde 269 projede 2436 güvenlik açığı bulunduğunu açıkladı. Bunların 1097’si orta ve yüksek risk sınıfında.

Güvenlik Zafiyetlerinin Büyük Kısmı Açıklanmadı
Bulunan sorunların sadece 53’ü kamuoyuna duyurulurken 2383 bulgu şimdilik gizli tutuluyor. Şirkete göre bu açıklar uzun yıllardır görünmez şekilde duruyormuş. En eski güvenlik açığı 1981 yılına kadar uzanıyor. Bu arada GLM-5.3, GLM Coding Plan abonelerinde ana model oldu. Eski modellere gönderilen istekler artık otomatik olarak 5.3’e yönlendiriliyor.






