Sonuçların farklı çıkmasının dört nedeni
Bir puan, uzun bir seçim zincirinin sonudur. Herhangi bir bağlantıyı değiştirin ve görüntü hakkında hiçbir şey değişmese bile sayı değişir.
- Farklı eğitim verileri. Bir dedektör gördüğünü tanır. Binlerce açık kaynaklı oluşturucu üzerinde eğitilmiş bir dedektör, sıra dışı modelleri iyi yönetir. Dört büyük ticari araç üzerinde eğitilmiş biri, o dördünü daha iyi ve diğer her şeyi daha kötü yönetir.
- Farklı karar çizgileri. Bir araç 60'ı şüpheli, diğeri 75'i şüpheli olarak adlandırır. Aynı okuma bir eşiği geçerken diğerini geçmez, bu yüzden bir ölçümden iki karar alırsınız.
- Farklı tanımlar. Bazı araçlar, ölçek büyütme veya üretken dolgu dahil olmak üzere herhangi bir üretken katılımı sayar. Diğerleri yalnızca tamamen sentetik kareleri işaretler. Rötuşlanmış bir portre, ilki için AI, ikincisi için gerçektir.
- Farklı ön işleme. Araçlar puanlamadan önce yeniden boyutlandırır, kırpar ve yeniden kodlar. 224 piksellik bir kareyi okuyan bir dedektör, tüm karenin 384 pikselini okuyandan farklı bir resim görür.
Araç D diğerlerinden daha hassas değildir. Daha geniş bir soruyu yanıtlar. Endişeniz bir fotoğrafın bir oluşturucu tarafından kurgulanıp kurgulanmadığıysa, D fazla bildirim yapıyordur. Endişeniz dosyaya herhangi bir AI dokunup dokunmadığıysa, size yanıt veren tek araç D'dir.
Her aracın hangi soruyu yanıtladığını sorun
| Soru | Neyi işaretler | Tipik kullanım |
|---|---|---|
| Bu kare sıfırdan mı oluşturuldu? | Tüm kare sentetik doku | Haberler, pazar yeri listeleri, arkadaşlık profilleri |
| Bunun herhangi bir kısmı AI tarafından düzenlendi mi? | Çizginin üzerindeki bir bölge | Sigorta, tazminat, kanıt inceleme |
| Bu dosyaya hiç AI dokundu mu? | Ölçek büyütme, gürültü giderme, üretken dolgu | Stok kütüphaneleri, yarışma kuralları |
Araçlar arasındaki çoğu anlaşmazlık, aslında bu üçünden hangisini sorduğunuzla ilgili anlaşmazlıktır. Sonuçları karşılaştırmadan önce, hangi sorunun sizin için önemli olduğuna karar verin ve ardından her aracı ona göre okuyun.
İki sonuç nasıl düzgün bir şekilde karşılaştırılır
-
Her iki araca da aynı dosyayı verin
Yeniden indirilmiş, ekran görüntüsü alınmış veya sohbet uygulamasından geçmiş bir kopya değil. Farklı baytlar farklı bir görüntüdür ve haklı olarak farklı puan alacaktır.
-
Sayıları değil, bantları karşılaştırın
50'de çizgisi olan bir ölçekte 61 ve 65'te çizgisi olan bir ölçekte 58 puan, okuma konusunda hemfikir olsalar bile karar konusunda anlaşmazlığa düşer.
-
Yayımlanmış bir eşik arayın
Çizgisinin nerede olduğunu söylemeyen bir araç hiçbir şeyle karşılaştırılamaz. Sayıyı kanıt olarak değil, yorumlanamaz olarak değerlendirin.
-
İşleyişini gösteren aracı tercih edin
Bir bölge haritası, adlandırılmış bir bant ve belirtilen bir karşılaştırmalı test, mantığı kontrol etmenizi sağlar. Arkasında hiçbir şey olmayan emin bir etiket bunu sağlamaz.
-
Anlaşmayı güçlü sinyal olarak kabul edin
Aynı banda ulaşan iki bağımsız araç, tek başına herhangi birinden daha değerlidir. İkisinin anlaşamaması, ortada bir ayrım olduğu anlamına değil, belirsizlik olduğu anlamına gelir.
Anlaşmazlığın bulgu olduğu durumlar
Tek bir örüntüyü tanımayı öğrenmeye değer. Düşük bir tüm-kare puanı ile yüksek bir puan bildiren bir araç, genellikle görüntünün yerel düzenlemeye sahip gerçek bir fotoğraf olduğu anlamına gelir.
İlk araç, düzenlemeyi büyük ölçüde gerçek bir kare üzerinde ortalamaktadır. İkincisi en güçlü bölgeyi ağırlıklandırmaktadır. Her ikisi de neyi ölçtükleri konusunda doğrudur ve anlaşmazlığın kendisi size herhangi bir sayıdan daha fazlasını anlatmıştır.
Aksi takdirde soğuk olan bir karenin içinde karar çizgisinin üzerinde bir karo. Hiçbir tek sayı bunu kapsamaz.
Dedektörlerin anlaşmasını ne sağlardı?
Paylaşılan bir karşılaştırmalı test, yayımlanmış karar çizgileri ve AI katılımının ne sayılacağına dair mutabık kalınmış bir tanım, yayılımın çoğunu ortadan kaldırırdı. Bunların hiçbiri henüz yok ve bunları oluşturmak için çok az ticari baskı var, çünkü zayıflıklarını yayımlayan bir araç, yayımlamayan bir araçtan daha kötü görünür.
Bu değişene kadar, her puanın özel bir ölçekten geldiğini kabul edin. Bir aracın size gösterdiği kanıtları okuyun ve bunu, etiketindeki güven derecesinden daha ağır tartın.
Kimsenin bahsetmediği sürüm sorunu
Bir dedektör zaman içinde aynı şey değildir. Satıcılar duyuru yapmadan yeniden eğitir, eşikleri ayarlar ve modelleri değiştirir; neredeyse hiçbiri çıktılarını sürümlendirmez. Mart ayında aldığınız puan ve bugün aldığınız puan, arkasında farklı kalibrasyona sahip farklı modellerden gelebilir.
Sonuçları kaydederseniz bu önemlidir. On sekiz ay öncesine ait bir puanı alıntılayan bir tazminat dosyası, moderasyon günlüğü veya akademik vaka, artık var olmayan bir enstrümanın ölçümünü alıntılıyordur. Bunu yeniden üretmenin bir yolu ve o sırada ne anlama geldiğini kontrol etmenin bir yolu yoktur.
Sonuçları sakladığınız yerde kanıtları da yanlarında tutun: bölge puanları, bant, karar çizgisi ve tarih. Bunlar, arkalarındaki model değişse bile yorumlanabilir kalır; ham bir yüzde ise bunu sağlamaz.