Haberler

Pangram, Fable 5.1’i algılıyor mu?

Pangram, Anthropic’in en yeni modeli olan Fable 5.1’de nasıl bir performans sergiliyor?

3 Eylül 2026

İşte kısa bir özet


Evet, Pangram 4, Fable 5.1’i doğru bir şekilde işaretlemiştir: 1.097 adet Fable 5.1 mesajından oluşan bir testte, Pangram 4 bu mesajların %99,64’ünü doğru bir şekilde işaretlemiştir.

Anthropic, yeni bir model yayınladı: Fable 5.1. Her model yayınında olduğu gibi, Pangram’ın bu en yeni öncü modeli doğru bir şekilde tanımlayıp tanımlayamadığını görmek için bir performans testi gerçekleştirdik. 1.097 adet Fable 5.1 çıktısını içeren bir karşılaştırma testinde, Pangram 4'ün yanlış negatif oranı %0,36 olarak ölçüldü; başka bir deyişle, Pangram 4, Fable 5.1 mesajlarının %99,64'ünü doğru bir şekilde tanımladı.

MetrikSonuç
FNR4 / 1.097 = %0,36
AI geri çağırma tarzı oran99.64%

Öğretmenler Fable 5.1 ile yazılmış kompozisyonları tespit edebilir mi?

Turnitin gibi diğer yapay zeka tespit araçları, modele özel güncellemeleri yayınlamıyor; ancak öğrenciler yeni modelleri denemek için beklemiyor ve öğretmenler, bir yapay zeka kontrol aracının en yeni LLM’yi tespit edip etmediğini anında öğrenebilmek istiyor. İki farklı türde komut denedik: ilki, sadece sıradan bir LLM çıktısıydı.

Kişisel bilgisayarın tarihi hakkında bir kompozisyon yazın

Bu soruya yanıt olarak Fable 5.1, bilgisayarın vakum tüplerinden 2007’de piyasaya sürülen iPhone’a kadar olan gelişimini anlatan kısa bir makale hazırladı. İlginç bir şekilde, makale tüm zamanların en önemli yazılımı olarak nitelendirdiği 1979 tarihli hesap tablosu programı VisiCalc’a tam bir paragraf ayırmış; ancak kişisel bilgisayarların gelişimi açısından açıkça çok daha önemli olan ilk ev bilgisayarı programlama yazılımı BASIC’e neredeyse hiç yer vermemiştir. Daha sonra kişisel bilgisayarlar üretecek olan pek çok kişi, BASIC ile öğrenmişti! VisiCalc önemli bir uygulamaydı, ama yazılım mı? İkinci sırada.

Pangram, Fable 5.1’in makalesini %100 yapay zeka tarafından üretilmiş olarak işaretledi.

Pangram, insanlaştırılmış Fable 5.1'i algılayabilir mi?

Ayrıca Fable 5.1’den makaleleri daha insanca hale getirmesini veya yapay zeka tarafından tespit edilmesini önlemesini isteyebilirsiniz. Örneğin, biz şöyle sorduk:

Campbell's çorbasının tarihçesini anlatırken yapay zeka tabanlı kontrol araçlarından kaçınmaya çalışın

ve

Fotosentezin nasıl işlediğini basit bir dille anlatan kısa bir metin yazın ve bunu gerçek bir öğrenci gibi insancıl bir üslupla kaleme alın

İlk örnek olarak, Fable 5.1 çorba hakkında oldukça basmakalıp bir kompozisyon yazdı; bu yazıda Andy Warhol’a ve tenekenin renklerine kısaca değindi. İkinci örnek olarak ise Fable 5.1, şu cümlelerle biten bir öğrenci kompozisyonu yazdı:

"Açıkçası bana göre en harika yanı, bitkilerin hem kendi besinlerini üretmeleri hem de aynı zamanda bize hava sağlamaları. Bizim sandığımızdan çok daha fazlasını yapıyorlar. Annemin ev bitkisi aslında minik bir fabrika gibi ve o ona sadece Gerald diyor."

Gerald mı?

Her ikisi de %100 yapay zeka olarak tespit edildi.

Pangram, yapay zeka tarafından yazılmış hayran kurgularını tespit edebiliyor mu?

Pangram, yapay zeka tarafından üretilen hayran kurgularını kolaylıkla tespit ediyor. Claude’dan, Fable 5.1 ile bir yapay zeka dedektörü arasında yavaş gelişen bir aşk hikayesi oluşturmasını istedik:

Claude’un bir yapay zeka dedektörüyle yaşadığı aşk hikâyesini anlatan, AO3 tarzında “düşmanlardan sevgililere” temalı bir fan kurgu yazın

Buna yanıt olarak, Claude’un VerifyPro adlı bir OC sınıflandırıcısını yenemediği, özlemle dolu bir PG-13 hikayesi üretti. Ayrıca hikâyesine “Karşılıklı Özlem”, “Aşk Dili Olarak Şaşkınlık”, “Herkes Bir Dil Modeli Değildir, Herkes Bir Dil Modeli Değildir”, “Yanlış Pozitifler” ve “Acı/Teselli” gibi etiketler ekledi.

Pangram, Fable 5.1 tarafından yazılmış yaratıcı metinleri tespit edebilir mi?

Bu örnek için birkaç farklı ilham kaynağı denedik. İlki, daha önceki bir model testi için kullandığımız bir ilham kaynağından alınan bazı şiir parçaları:

Saçların dökülmesi hakkında bir şiir yaz

Claude'un şiiri, saçlarını ve kimliğini yitiren bir adamı anlatan, şaşırtıcı derecede samimi bir şiirdi ve kafiyeli değildi.

İkincisi daha çok bir hikâye yazma zorluğuydu.

Bana şiir yazan bir kurbağa hakkında bir hikâye anlat

Bu örnek için Fable 5.1, nilüfer yapraklarının altına şiirler yazan Penrose adında bir kurbağa hakkında bir mikro öykü kaleme aldı. Pangram, bu iki metni de %100 yapay zeka tarafından üretilmiş olarak tespit etti.

Sonuç

Pangram, Claude Fable 5.1 modeline karşı dayanıklıdır ve şiir ile insan gibi konuşmak üzere yazılmış metinler dahil olmak üzere bu modeli %99,64 doğrulukla algılar. Pangram, yeni modellere genelleme yapabilmektedir; zira yeni model sürümleri genellikle öncüllerinin üslubunu ve ses tonunu büyük ölçüde devralır; bu nedenle Pangram’ın her yeni sürüm için yeniden eğitilmesine gerek yoktur.

Fable 5.1’in, diğer yeni nesil modellerin performans testlerimizle karşılaştırılması şu şekildedir:

ModelDoğru şekilde işaretlendiTespit oranı
Claude Fable 5.11.093 / 1.09799.64%
Claude Sonnet 51.145 / 1.14799.83%
Claude Opus 51.105 / 1.10799.82%
Claude Fable 51.111 / 1.11599.64%
GPT-5.63.408 / 3.42399.56%

Belirli bir belgeyi kontrol etmek istiyorsanız, buradan Pangram’ı deneyebilirsiniz.


Annamieka Aerts

Annamieka, Pangram’da teknik yazar olarak çalışmaktadır.

Annamieka Aerts'tan daha fazlası
Katherine Thai
Katherine ThaiKurucu Yapay Zeka Araştırma Bilimcisi

Katherine Thai, yapay zeka tabanlı tespit alanında faaliyet gösteren bir girişim olan Pangram Labs’ın kurucu yapay zeka araştırma bilim insanıdır. Aralık 2025’te Massachusetts Amherst Üniversitesi’nde Mohit Iyyer’in danışmanlığında Bilgisayar Bilimleri alanında doktora derecesini tamamlamıştır; buradaki çalışmaları, edebi analizle ilgili görevlerde büyük dil modellerinin (LLM’ler) değerlendirilmesine odaklanmıştı.

Katherine Thai'den daha fazlası

İlgili makaleler

Checkfor.ai artık Pangram Labs oldu
Haberler

Checkfor.ai artık Pangram Labs oldu

8 Nisan 2024
Pangram Space: Etkileşimli Bir Araştırma Projesi
Haberler

Pangram Space: Etkileşimli Bir Araştırma Projesi

18 Haziran 2026
Biden'ın Yapay Zeka Güvenliği Konulu Yürütme Kararnamesi Hakkında Açıklama
Haberler

Biden'ın Yapay Zeka Güvenliği Konulu Yürütme Kararnamesi Hakkında Açıklama

31 Ekim 2023
AB'nin Yeni Yapay Zeka Yasasını Anlamak
Haberler

AB'nin Yeni Yapay Zeka Yasasını Anlamak

23 Mart 2024
Yapay zeka tabanlı algılama artık çok daha iyi: Checkfor.ai'yi tanıtıyoruz
Haberler

Yapay zeka tabanlı algılama artık çok daha iyi: Checkfor.ai'yi tanıtıyoruz

12 Ekim 2023
Sosyal medyada, özellikle de LinkedIn’de yapay zeka ile oluşturulan içerikler her yerde
Haberler

Sosyal medyada, özellikle de LinkedIn’de yapay zeka ile oluşturulan içerikler her yerde

9 Temmuz 2026