Saatlik otomatik veri akışı

Yapay zeka modelleri, canlı karşılaştırma

Neredeyse her hafta yeni bir model çıkıyor; puanı LMArena'da, kodlama başarısı SWE-bench'te, fiyatı OpenRouter'da, hızı Artificial Analysis'te, lisans bilgisi ise Hugging Face'te yayımlanıyor. Hepsini tek tek takip etmek zor olduğu için bu platform o dağınık verileri saat başı otomatik topluyor; ELO, maliyet, hız ve context gibi birbirinden farklı ölçülen değerleri 0-100 aralığında ortak bir ölçeğe çeviriyor ve her uzmanlık alanının kendi ağırlıklarıyla tek bir puana dönüştürüyor. Böylece kodlama, metin, görsel, video, ses ve güncel bilgi kategorilerinde hangi modelin gerçekten önde olduğunu aynı tabloda görebiliyorsunuz. Modellerin açık kaynak mı kapalı kaynak mı olduğu ayrıca işaretleniyor; gelişmiş filtrelerle sağlayıcı, fiyat, context ve tazelik kırılımlarında arama yapabiliyor, bir modelin satırına tıkladığınızda ise her metriğin hangi kaynaktan ve ne zaman alındığını detay sayfasında tek tek doğrulayabiliyorsunuz.

Kod yazma, hata ayıklama ve depo ölçeğinde geliştirme araçları

Bu kategoride yayın tarihi bilinen model yok; "Sadece yeni" filtresi göz ardı edilip tüm modeller listeleniyor.

Neden bu platform?

Dağınık kaynaklar

ELO, fiyat, hız ve context bilgileri her sağlayıcının ve her ölçüm sitesinin kendi sayfasında, farklı biçimlerde yayımlanıyor.

Sürekli değişen liste

Yeni modeller, yeni sürümler ve fiyat değişiklikleri saat başı otomatik olarak çekilir; liste elle güncellenmez.

Tek noktada karşılaştırma

Tüm ölçümler aynı ölçeğe getirilip kategori ağırlıklarıyla puanlanır, böylece modeller yan yana adil biçimde kıyaslanabilir.

Hangi verinin nereden ve ne zaman geldiğini kaynaklar sayfasında görebilirsiniz.

Puan hesabı: her ölçüm, kendi kategorisindeki en iyi ve en kötü değere göre 0-100 arasına yerleştirilir; sonra yukarıdaki yüzdelerle ağırlıklandırılıp toplanır. Maliyet ve gecikme gibi “düşük olması iyi” olan ölçümlerde sıralama tersine çevrilir. Ölçümü eksik olan modellerin puanı, eksik veri oranında düşürülür.