Claude Fable 5 zirveye çıkmış.
Google Android Bench’i yeniledi, Claude Fable 5 zirveye çıktı
google, android kodlama odaklı yapay zeka sıralamasında claude fable 5'i zirveye taşıdı. yeni test sistemi harbor framework çatısında çalışıyor.
google, android bench test sistemini yeniledi ve android kodlama odaklı yapay zeka sıralamasında tabloyu baştan kurdu. şirket, testleri harbor framework çatısına taşıdıktan sonra kapalı ve açık ağırlıklı modelleri yeniden değerlendirdi. yeni listede claude fable 5, 84,5 puanla ilk sıraya yerleşti. gpt 5.5 ise 80,2 puanla ikinci sırada kaldı. android bench, genel bir yapay zeka modeli sıralaması sunmuyor. bunun yerine android uygulama geliştirme işlerinde modellerin kod yazma, hata düzeltme ve proje içinde doğru değişikliği yapma becerisini ölçüyor. bu nedenle liste, özellikle android studio, jetpack compose, wear os ve platform api’leriyle çalışan geliştiriciler için anlamlı bir referans veriyor. google, bu test ailesini yılın başlarında android geliştirme görevlerine odaklanan bir liderlik tablosu olarak duyurmuştu. google daha önce modelleri mini-swe-agent v1 adlı genel amaçlı benchmark aracıyla değerlendiriyordu. şirket, yeni güncellemeyle birlikte bu ölçüm düzenini harbor framework çatısına aldı. böylece geliştiriciler, android bench içinde kullanılan yönteme daha yakın araçlarla kendi kullanım senaryolarını da test edebilecek. bunun yanı sıra google, android geliştiricilerinden gerçek geliştirme görevleri göndermelerini istiyor. google’ın açıklamasına göre geliştiriciler artık android bench veri seti için geri bildirim verebilecek. ayrıca kendi android görevlerini paylaşarak benchmark kapsamının genişlemesine katkı sağlayabilecek. şirket, gönderilen görevleri değerlendirip uygun gördüklerini test havuzuna ekleyecek. benchmark değerlendirmelerini paylaşan geliştiriciler de farklı modellerin … google android bench’i yeniledi, claude fable 5 zirveye çıktı haberi ilk önce teknoblog üzerinde yayımlandı.