İngiltere Yapay Zeka Güvenlik Enstitüsünden bilgisayar bilimciler ile Stanford, Berkeley ve Oxford üniversitelerinin de aralarında bulunduğu 14 kurumdan 29 araştırmacı, “Önemli Olanı Ölçmek: Büyük Dil Modeli Kıyaslamalarında Yapı Geçerliği” başlıklı bir çalışma yaptı.
Bilim insanları çalışmada, yapay zekanın alt dallarından olan “doğal dil işleme” ve “makine öğrenimi” alanlarının önde gelen konferanslarından alınan 445 değerlendirme testini sistematik olarak inceledi.
İncelemeler sonucunda, testlerin neredeyse hepsinin “sonuçların geçerliliğini zedeleyebilecek” kusurlara sahip olduğu sonucuna ulaşıldı.
Çalışmanın baş yazarı, Oxford İnternet Enstitüsünden Andrew Bean, çalışmaya ilişkin Guardian’a yaptığı açıklamada, kullanılan bu testlerin büyük teknoloji şirketleri tarafından piyasaya sürülen son yapay zeka modellerinin değerlendirilmesinde kullanıldığını söyledi.
Bean, değerlendirme testlerinin yapay zekayla ilgili tüm iddiaların temelini oluşturduğuna vurgu yaparak ortak tanımlar ve sağlıklı ölçümler olmadan modellerin gerçekten gelişip gelişmediğini anlamanın zorlaştığını kaydetti.
kaydırmaya devam ederek gündemden son dakika ve magazin haberlerine havadiskolik.com üzerinden anında erişebilirsiniz ve bizi twitter hesabımızdan takip etmeyi unutmayın ! https://x.com/havadiskolik
SEKTÖREL
13 gün önceSEKTÖREL
20 Eylül 2026SEKTÖREL
20 Eylül 2026SEKTÖREL
20 Eylül 2026SEKTÖREL
20 Eylül 2026
1
TikTok yasaklanıyor mu: ABD Başkanı Joe Biden açıklama yaptı
6174 kez okundu
2
HUAWEI WATCH GT 6 satışa sunuldu: Avrupa’da en büyük ilgi Türkiye’den
2200 kez okundu
3
Fatura kabartan zararlı Android uygulamaları tespit edildi
940 kez okundu
4
Bilim insanları, uzayda yer çekimi sorununu çözmek istiyor
821 kez okundu
5
Roscosmos Başkanı Dmitry Rogozin görevden alındı
805 kez okundu
Veri politikasındaki amaçlarla sınırlı ve mevzuata uygun şekilde çerez konumlandırmaktayız. Detaylar için veri politikamızı inceleyebilirsiniz.