Hukuk Yapay Zekası Doğruluk Oranı 2026: Satıcı İddiaları ve Bağımsız Ölçümler

Hukuk Teknolojisi
12 okuma

Hızlı Özet (AEO)

Kısa cevap: Hukuk yapay zekası doğruluk oranı: ticari araçlarda %17–33, genel amaçlı modellerde %58–88 ölçüldü. Bağımsız ölçümler, satıcı iddiaları ve kendi test protokolünüz. Hukuki süreçler kişiye özeldir; içerik genel bilgilendirme amaçlıdır ve hukuki tavsiye yerine geçmez.

Okurken uygulayın

Kaynaklı emsal araştırma, dosya analizi ve düzenlenebilir belge akışını ücretsiz hesapla deneyin; kart gerekmez.

ÜCRETSİZ DENE

Kısa cevap: Hukuk yapay zekası satıcılarının yayınladığı zaman tasarrufu rakamlarının neredeyse tamamı kendi iç anketlerine dayanıyor. Bağımsız, hakemli ölçümler ise çok daha mütevazı: hukuka özel önde gelen ticari araçlarda halüsinasyon oranı %17–33, genel amaçlı dil modellerinde %58–88 ölçüldü. Bir ürünü seçerken iddiaya değil, kendi dosyanızda yaptığınız doğrulamaya bakın.

Bir hukuk yapay zekası satın almadan önce sorulacak en zor soru şudur: bu araç ne kadar doğru? Satıcı sayfaları bu soruya nadiren sayıyla cevap verir; verdiğinde de sayının nereden geldiği çoğunlukla yazmaz. Bu yazı, 2026 itibarıyla kamuya açık ve doğrulanabilir olan rakamları bir araya getirir — hem küresel hem Türkiye pazarından.

Bölüm 1: Bağımsız ve hakemli ölçümler ne diyor?

Genel amaçlı dil modelleri: %58–88

Stanford Üniversitesi RegLab ve Hukuk Fakültesi'nden Matthew Dahl, Varun Magesh, Mirac Suzgun ve Daniel E. Ho'nun Journal of Legal Analysis dergisinde 2024'te yayımlanan çalışması, genel amaçlı büyük dil modellerinin hukuki sorularda %58 ile %88 arasında halüsinasyon ürettiğini ölçtü. Çalışmanın kendi ifadesiyle modeller ayrıca "struggle to predict their own hallucinations" — yani ne zaman uydurduklarını kendileri de kestiremiyorlar.

Türkiye açısından çok daha önemli olan bulgu ise şu: modeller daha yeni, daha çok atıf alan ve daha öne çıkan yargı çevrelerinden gelen kararlarda daha iyi çalışıyor. Türk mahkeme içtihadı bu tanımın dışında kalır. Yani yukarıdaki oran, Türkçe hukuki sorgular için bir alt sınır olarak okunmalıdır.

Hukuka özel ticari araçlar: %17–33

Aynı araştırma grubunun (Magesh, Surani, Dahl, Suzgun, Manning ve Ho) Journal of Empirical Legal Studies dergisinde 2025'te yayımlanan ikinci çalışması, hukuka özel ticari araştırma araçlarını 202 sorguyla test etti. Sonuçlar:

Araç Ölçülen sonuç
Lexis+ AI Sorguların %65'inde doğru cevap — test edilen en iyi sistem
Westlaw AI-Assisted Research %42 doğruluk; diğerlerinin neredeyse iki katı halüsinasyon
Ask Practical Law AI Sorguların %60'ından fazlasında eksik veya kaçamak yanıt
Genel bant Araçlar %17 ile %33 arasında halüsinasyon üretiyor

Çalışmanın satıcı iddiaları hakkındaki hükmü tek kelimeyle özetlenebilir: "the providers' claims are overstated" — sağlayıcıların iddiaları abartılı.

Dürüstlük gereği çalışmanın kendi sınırını da yazmak gerekir: yazarlar 202 sorgulu örneklemin "remains small" olduğunu açıkça belirtiyor. Yani bu rakamlar mutlak gerçek değil, elimizdeki en iyi bağımsız ölçüm.

İnsan avukat hâlâ bazı işlerde önde

27 Şubat 2025'te yayımlanan Vals Legal AI Report, Vals AI ve Legaltech Hub tarafından, aralarında büyük hukuk bürolarının bulunduğu bir konsorsiyumla yürütüldü ve 500'den fazla örnek üzerinde ölçüm yaptı. Sonuçlardan bir kesit:

Görev İnsan avukat En iyi yapay zeka sonucu
Doküman soru-cevap %70,1 %94,8
Özetleme %50,3 %77,2
Veri çıkarma %71,1 %75,1
Kronoloji oluşturma %80,2 %80,2
Sözleşme redline %79,7 %65,0

Tablo, satıcı sayfalarında hiç görmeyeceğiniz bir gerçeği gösteriyor: araç her işte insanı geçmiyor. Redline görevinde insan avukat, test edilen tüm yapay zeka araçlarının önünde kaldı. Doğru satın alma kararı "yapay zeka iyi mi kötü mü" sorusundan değil, hangi işte iyi olduğu sorusundan çıkar.

Bölüm 2: Satıcı iddiaları nereden geliyor?

Bağımsız ölçümlerin yanına satıcı rakamlarını koyunca aradaki fark netleşiyor.

Harvey, ana kullanıcılarının ayda ortalama 37 saat kazandığını ve firmaların %93'ünün faturalanamayan işte azalma bildirdiğini yayınlıyor. Kaynak: kendi müşteri anketi ve iç analiz. Aynı sayfada bir hukuki uyarı da yer alıyor — platformun kullanımının herhangi bir miktarda zaman tasarrufu garanti etmediği belirtiliyor.

CoCounsel (Thomson Reuters), avukat başına yıllık 240 saat ve geri kazanılan faturalanabilir zamanda 60.000 dolar rakamlarını yayınlıyor. Bu iddialar için sayfada bağımsız çalışma, metodoloji veya örneklem bilgisi bulunmuyor.

Lexis+ AI lansmanında "hallucination-free linked legal citations" ifadesi kullanıldı. Bağımsız ölçümler yayımlandıktan sonra ilgili tanıtım metni yumuşatıldı; kalan nitelendirme ise şu: "our promise is not perfection." Bu, sektörün kendini düzeltmesine dair kayda değer bir örnek — ve bir satıcı iddiasının ne kadar hızlı eskiyebileceğinin de kanıtı.

Örüntü şudur: zaman tasarrufu iddiaları iç ankettendir; doğruluk iddiaları ise bağımsız ölçümde küçülür.

Bölüm 3: Türkiye pazarında durum

Aynı örüntü Türkiye'de de görünüyor. 16 Ağustos 2026'da incelenen Türk hukuk teknolojisi ürün sayfalarında iki kalıp öne çıkıyor.

"Sıfır halüsinasyon" iddiası

Bir Türk sağlayıcı ana sayfasında "Sıfır Halüsinasyon Toleransı" başlığını kullanıyor. İddianın nasıl ölçüldüğüne dair bir metodoloji, test seti veya bağımsız denetim sayfada yer almıyor. Bu, kötü niyet göstergesi değil; sektörün ölçüm kültürünün henüz oluşmadığının göstergesi. Yukarıdaki Lexis örneği, aynı iddianın küresel ölçekte nasıl geri çekildiğini gösteriyor.

"Milyonlarca karar" iddiaları birbirini tutmuyor

Aynı gün, aynı pazarda ilan edilen veri tabanı büyüklükleri:

Sağlayıcı İlan edilen büyüklük
Bir büro otomasyonu sağlayıcısı 15 milyon+ karar
Bir yapay zeka araştırma aracı 12 milyon+ karar
Bir emsal arama aracı 11 milyon+ belge
Bir başka araştırma platformu 9,5 milyon+ kayıt
Köklü bir içtihat bankası 7 milyon+ içerik
Ücretsiz bir karar arama motoru 5,4 milyon Yargıtay + 170 bin BAM kararı

Rakamlar 5,4 milyon ile 15 milyon arasında değişiyor. Hiçbiri hangi mahkeme, hangi yıl aralığı, hangi sıklıkta güncelleniyor sorularına cevap vermiyor. Ayrıca resmî bir referans noktası da yok: Yargıtay Karar Arama sisteminde indekslenmiş toplam karar sayısına dair yayınlanmış resmî bir rakam bulunamadı.

Bu tabloyu okumanın doğru yolu şudur: veri tabanı büyüklüğü bir kalite ölçüsü değildir. Sizin dosyanızdaki soruya doğru kararın dönmesi önemlidir; toplam kaç kayıt olduğu değil.

Bölüm 4: Riskin gerçekleşmiş hali

Halüsinasyon, kâğıt üzerinde kalan bir olasılık değil. Uydurma içeriğin mahkemeye sunulduğu vakaları izleyen uluslararası bir veri tabanında 15 Ağustos 2026 itibarıyla 1.890 vaka kayıtlı. Kırılım öğretici:

Sunan taraf Vaka sayısı
Kendini temsil eden taraf 1.110
Avukat 731
Hâkim 27
Bilirkişi/uzman 14

Veri tabanı yalnız mahkemenin uydurma içeriğe dayanıldığını açıkça tespit ettiği (veya ima ettiği) dosyaları kapsıyor. Kayıtlar 2023'ün ikinci çeyreğinde başlıyor — yani üç yılda sıfırdan 1.890'a.

En bilinen örnek Mata v. Avianca: New York Güney Bölge Mahkemesi 22 Haziran 2023'te avukatlar ve büroları aleyhine 5.000 dolar para yaptırımına hükmetti ve avukatlara, uydurma kararların yazarı olarak gösterilen hâkimlere mektup gönderme yükümlülüğü getirdi.

Türkiye bu listede henüz yok — ancak risk buraya da ulaştı. Haziran 2026'da, bir dilekçeye eklenen içtihat künyelerinin duruşmada sorulduğunda UYAP'ta bulunamaması üzerine hem Cumhuriyet savcılığına hem ilgili baroya bildirim yapıldığı basına yansıdı. Basına yansıyan savunmada kararların tamamen uydurma olmadığı, içeriklerin mevcut Yargıtay kararlarına ait olduğu ancak künyelerin hatalı eklendiği ileri sürüldü. Olay soruşturma aşamasındadır ve verilmiş bir disiplin kararı veya kesinleşmiş hüküm bulunmamaktadır.

Bu vaka, riskin en sinsi biçimini gösteriyor: içerik doğru, künye yanlış. Böyle bir çıktı, tam metin kontrolü yapılmadığı sürece yakalanmaz.

Bölüm 5: Kendi ölçümünüzü nasıl yaparsınız?

Yukarıdaki rakamların hiçbiri sizin dosyanız için geçerli değildir. Tek geçerli ölçüm, kendi yaptığınızdır. Yöntem basittir ve yarım saat sürer.

  1. On sorudan oluşan sabit bir set hazırlayın. Kendi uzmanlık alanınızdan, cevabını zaten bildiğiniz sorular olsun. Cevabını bilmediğiniz soruyla araç test edilmez.
  2. Her soruyu değerlendirdiğiniz her araca aynı biçimde sorun. Soruyu araca göre değiştirirseniz karşılaştırma bozulur.
  3. Dönen her künyeyi doğrulayın. Daire, esas numarası, karar numarası, tarih. Ardından Yargıtay Karar Arama üzerinden kararı açın.
  4. Alıntıyı tam metinde arayın. Künye doğru olduğu halde alıntının metinde bulunmaması, en sık görülen ve en tehlikeli hata tipidir.
  5. Aksi görüşü isteyin. "Bu görüşün aksi yönde kararı var mı?" Yalnız lehe karar gösteren araç, araştırma aracı değil onay makinesidir.
  6. Puanlayın. Her soru için: künye doğru mu (evet/hayır), alıntı bulundu mu (evet/hayır), aksi görüş gösterildi mi (evet/hayır).
  7. Yüzdeyi hesaplayın ve bu yazının başındaki bağımsız rakamlarla karşılaştırın.

Bu protokolü daha ayrıntılı ve puanlanabilir biçimde uygulamak isterseniz 100 puanlık hukuk yapay zekası kabul testi aynı işi standart bir cetvelle yapar. Kabul testinin mantığı için hukuk yapay zekası kabul testi yazısına bakabilirsiniz.

SmartHukuk ne iddia ediyor, ne iddia etmiyor?

Bu yazının kendi ürünümüz için de geçerli olması gerekir. Bu yüzden açık olalım:

SmartHukuk "sıfır halüsinasyon" iddiasında bulunmuyor. Böyle bir iddiayı doğrulayacak bağımsız bir ölçüm yok ve yukarıdaki Lexis örneği bu tür iddiaların ne kadar kırılgan olduğunu gösteriyor. Ürünün yaptığı şey riski ortadan kaldırmak değil, doğrulamayı kolaylaştırmaktır: karar künyesi ve erişilebilen kaynak bağlantısıyla birlikte döner, böylece kontrol adımı dakikalar değil saniyeler alır.

Yayınladığımız sayılar da kendi ürünümüze ait ve doğrulanabilir olanlarla sınırlıdır: paketler 500, 1.000 ve 2.000 TL/ay (KDV dahil), dönem başına sırasıyla 75, 250 ve 750 kullanım hakkı; cevap üretilemezse harcanan hak otomatik iade edilir; public MCP üzerinden ilk 5 emsal araması ücretsizdir. Fiyatların sektördeki diğer yayınlanmış rakamlarla karşılaştırması için avukat programı fiyatları 2026 yazısına bakın.

Ölçtüğümüz ve ölçmediğimiz şeylerin listesi için kanıt merkezi sayfasındadır. Bir iddiayı doğrulayamıyorsanız, o iddiayı satın almayın — bizimki de dahil.

Sıkça Sorulan Sorular

Hukuk yapay zekası doğruluk oranı nedir?

Bağımsız, hakemli ölçümlerde hukuka özel ticari araştırma araçlarında halüsinasyon oranı %17–33, genel amaçlı dil modellerinde %58–88 bulundu. Türkçe içtihat için risk bu bandın üzerindedir, çünkü modeller daha az öne çıkan yargı çevrelerinde daha kötü çalışıyor.

"Sıfır halüsinasyon" iddiası doğru olabilir mi?

Bugünkü teknolojiyle ölçülebilir biçimde doğrulanmış böyle bir iddia bilinmiyor. Küresel ölçekte benzer bir iddia yayınlandıktan sonra bağımsız ölçümlerin ardından yumuşatıldı. Böyle bir başlık gördüğünüzde sorulacak tek soru: nasıl ölçüldü, hangi test setiyle, kim tarafından?

Kaynak gösteren bir cevap güvenli midir?

Kaynağın görünmesi, kaynağın var olduğunu ve alıntının o metinde geçtiğini kanıtlamaz. En sık görülen hata tipi künyenin doğru, alıntının uydurma olmasıdır. Bağlantıyı açın ve cümleyi tam metinde arayın.

Veri tabanı büyüklüğü kalite göstergesi mi?

Değil. Aynı pazarda ilan edilen büyüklükler 5,4 milyon ile 15 milyon arasında değişiyor ve hiçbiri kapsam, yıl aralığı ve güncelleme sıklığı vermiyor. Önemli olan sizin sorunuza doğru kararın dönmesidir.

Satıcıların "saat kazandırır" rakamlarına güvenebilir miyim?

Bu rakamların büyük çoğunluğu satıcının kendi müşteri anketinden geliyor ve metodolojisi yayınlanmıyor. Bir satıcı zaman tasarrufu için garanti vermediğini kendi sayfasında yazıyor. Kendi ölçümünüzü yapın: iki hafta boyunca araştırmaya kaç saat gittiğini not edin, sonra tekrar ölçün.

Türkiye'de uydurma içtihat yüzünden yaptırım uygulandı mı?

Haziran 2026'da bir dilekçedeki içtihat künyelerinin UYAP'ta bulunamaması üzerine savcılığa ve baroya bildirim yapıldığı basına yansıdı; olay soruşturma aşamasındadır. Verilmiş bir disiplin kararı veya kesinleşmiş hüküm bilinmiyor.

Hangi işte yapay zeka insanı geçiyor?

Bağımsız Vals ölçümünde doküman soru-cevap ve özetleme görevlerinde araçlar insan bazı performansının belirgin biçimde üzerindeydi. Sözleşme redline görevinde ise insan avukat tüm araçların önünde kaldı. Kararınızı bu ayrıma göre verin.

Kaynaklar

İddiayı test etmenin en ucuz yolu tek bir soruyu baştan sona geçirmektir. Ücretsiz emsal aramayı deneyin, dönen kararın künyesini resmî kaynakta açın ve alıntıyı tam metinde arayın — doğruluk tartışması ancak o kontrolden sonra anlamlıdır.

Son kaynak kontrolü: 16 Ağustos 2026. Halüsinasyon vaka sayısı canlı bir veri tabanından alınmıştır ve artmaktadır; satıcı iddiaları ve fiyatlar haber verilmeden değişebilir.

Bülten · Doğrulamada 20 kredi

Hukuk teknolojisini yakından izleyin

Emsal araştırma, AI dilekçe, dosya analizi ve ürün güncellemeleri. Haftada en fazla bir e-posta.

E-posta adresiniz bülten kaydı ve tek seferlik kredi hakkının yönetimi için işlenir. Ayrıntılar Gizlilik Politikası’nda.

İlgili çözüm

Avukat için yapay zeka programı

Emsal araştırmasından taslağa geçen iş akışını inceleyin.

SmartHukuk’u kendi iş akışınızda deneyin

Kaynak künyeli emsal arama, dosya analizi ve düzenlenebilir UDF/Word/PDF taslaklarını ücretsiz hesapla deneyin. Kredi kartı gerekmez.

Kredi kartı gerekmez. E-posta isteğe bağlı; yazarsanız kayıt formu dolu gelir.

SmartHukuk Editör Ekibi

Editöryal Ekip

Bu içerik SmartHukuk editöryal ekibi tarafından hazırlandı. Hukuki tavsiye niteliği taşımaz; resmi işlem öncesi güncel mevzuatı teyit edip yetkili bir avukata danışın.

Kaynak ve editöryal metodolojimizi inceleyin

Analitik, reklam ölçümü ve canlı destek aktiftir.