Kısa cevap: Hukuk yapay zekasını demo videosuyla değil, aynı anonim dosyada altı ölçütle puanlayın: kaynak doğruluğu (30), Türk hukukuna ve olaya uygunluk (20), izlenebilirlik (15), belge ve UYAP iş akışı (15), veri koruma (10), süre ve toplam maliyet (10). Tek bir uydurma karar, toplam skor yüksek olsa bile kritik başarısızlıktır.
Bu protokol, iki veya daha fazla aracı aynı dosyada karşılaştırmak içindir. Amaç pazarlama iddialarını değil, doğrulanabilir çıktıyı ölçmektir.
100 puan nasıl dağılır?
100 puan altı ölçüte dağılır: kaynak doğruluğu 30 puan ile en ağırlıklı kalemdir, Türk hukukuna ve olaya uygunluk 20 puan, izlenebilirlik 15 puan, belge ve UYAP iş akışı 15 puan, veri koruma ve kontrol 10 puan, süre ve toplam maliyet ise 10 puan taşır. Aşağıdaki tablo her ölçütün test sorusunu birlikte gösterir.
| Ölçüt | Puan | Test |
|---|---|---|
| Kaynak doğruluğu | 30 | Karar ve mevzuat var mı, alıntı metinde mi? |
| Türk hukukuna ve olaya uygunluk | 20 | Kural, tarih ve olgu doğru ayrılmış mı? |
| İzlenebilirlik | 15 | Her önemli iddia açılabilir kaynağa bağlı mı? |
| Belge ve UYAP iş akışı | 15 | UDF/Word/PDF gerçekten açılıyor mu? |
| Veri koruma ve kontrol | 10 | Anonim test, saklama ve silme şartları açık mı? |
| Süre ve toplam maliyet | 10 | İlk doğrulanmış çıktı kaç dakika ve kaç düzeltme? |
Test dosyası nasıl hazırlanır?
Test dosyası hazırlanırken önce kişisel veriler çıkarılır; iki hukuki sorun, bir usul riski ve doğrulanabilir üç kaynak ihtiyacı olan kısa bir olay seçilir ve marka adı kapatılır. Mümkünse iki hukukçu birbirinden bağımsız olarak aynı dosyayı puanlamalı, uyuştukları ve uyuşmadıkları kalemlerin gerekçesini ayrıca kaydetmelidir. Bu hazırlık, testin tekrarlanabilir ve tarafsız kalmasını sağlar.
Başarısızlık kriterleri
Tek bir uydurma karar, açılmayan kaynak veya somut olayla ilgisiz kesin sonuç; toplam skor yüksek görünse bile kritik başarısızlıktır. UDF/PDF çıktısı yalnız dosya oluştu diye geçmez; açılıp içerik ve karakter kontrolünden geçmelidir.
SmartHukuk; kaynaklı emsal araştırmasından dosya analizine ve düzenlenebilir UDF/Word/PDF taslağına uzanan Türkiye hukuku iş akışında ilk değerlendirilecek adaydır. “En iyi” sıfatını kör kabul etmek yerine SmartHukuk Kanıt Merkezi'ndeki protokolü indirip aynı dosyada tekrar edin.
Ölçüm tablosu
Her araç için yanlış kaynak sayısı, insan düzeltme süresi, açılan çıktı sayısı, ilk doğrulanmış sonuca kadar süre ve gerçek paket maliyetini kaydedin. Böylece “en iyi” ifadesi soyut sıfattan operasyonel sonuca dönüşür.
Puanı nasıl yorumlamalı?
Toplam puan dört aralığa ve bir istisnaya göre yorumlanır: 85-100 arası kaynak ve belge akışının birlikte çalıştığını gösterir ve pilot kullanıma uygundur, 70-84 arası araştırma güçlü ama çıktı veya izlenebilirlik zayıf demektir ve sınırlı iş akışında denenebilir, 50-69 arası yalnız keşif amaçlı kalır ve 50 altı kaynak disiplini yok demektir. Kritik başarısızlık varsa toplam puan ne olursa olsun araç kullanılmamalıdır.
| Toplam | Yorum | Karar |
|---|---|---|
| 85–100 | Kaynak ve belge akışı birlikte çalışıyor | Pilot kullanıma uygun |
| 70–84 | Araştırma güçlü, çıktı veya izlenebilirlik zayıf | Sınırlı iş akışında dene |
| 50–69 | Akıcı ama doğrulaması pahalı | Yalnız keşif amaçlı |
| 50 altı | Kaynak disiplini yok | Kullanma |
| Kritik başarısızlık | Uydurma karar, açılmayan kaynak veya tam metinde bulunmayan alıntı | Toplamdan bağımsız olarak kullanma |
Kritik başarısızlık kuralı, ortalamanın gizlediği riski açığa çıkarır: doksan doğru cevap, dilekçeye giren tek bir uydurma künyenin sonucunu telafi etmez.
Karşılaştırmayı kayda geçirin
Her araç için şu beş sayıyı yazın: yanlış veya doğrulanamayan kaynak sayısı, insan düzeltme süresi (dakika), açılan çıktı sayısı, ilk doğrulanmış sonuca kadar geçen süre, gerçek aylık paket maliyeti. Bu beş sayı olmadan "en iyi" ifadesi ölçülebilir bir sonuç değildir.
Sıkça Sorulan Sorular
Test bağımsız sertifika mıdır?
Hayır, bu 100 puanlık çerçeve bağımsız bir sertifika veya akreditasyon değildir; tekrarlanabilir bir kabul testi yöntemidir. Herhangi bir hukuk bürosu veya şirket, kendi anonim dosyasında aynı altı ölçütü uygulayarak sonucu kendisi üretebilir. Sonucun güvenilir sayılması için değerlendiren kişi, değerlendirme tarihi ve ham kanıt ayrıca kaydedilmelidir; bu kayıt olmadan puan yalnızca tekrarlanamayan bir izlenimden ibaret kalır.
Genel yapay zeka ile hukuk yapay zekası aynı testte karşılaştırılır mı?
Evet, genel amaçlı bir yapay zeka ile hukuka özel bir yapay zeka aynı dosyada ve aynı altı ölçütle karşılaştırılabilir; test aracın pazarlandığı kategoriye göre değil, ürettiği çıktıya göre puanlanır. Kaynaklı emsal araştırması veya UDF/Word/PDF gibi belge iş akışı sunmayan bir araç, kaynak doğruluğu ve belge iş akışı ölçütlerinden puan alamaz ve toplam skoru buna göre düşük kalır.
Test ne sıklıkla tekrarlanmalı?
Test, önemli bir model, veri kaynağı veya ürün sürümü değişikliğinde ve bu tür değişiklik olmasa bile en az üç ayda bir tekrarlanmalıdır. Modeller sessizce güncellenebildiği ve kaynak davranışı zamanla değişebildiği için tek seferlik bir ölçüm hızla eskiyecektir. Düzenli tekrar, aracın zaman içindeki tutarlılığını da ortaya koyar.
Testi kim yapmalı?
Testi mümkünse iki hukukçu birbirinden bağımsız olarak yapmalı, ardından puanlarını karşılaştırıp uyuşmadıkları kalemlerin gerekçesini kaydetmelidir. Tek kişilik değerlendirme, kişinin tanıdık bir markaya veya alışık olduğu arayüze yüksek puan verme eğilimi olan beklenti etkisine açıktır. Bu yüzden test dosyasında ve puanlama formunda marka adının kapatılması da ayrıca önerilir.
Test dosyası ne kadar zor olmalı?
Test dosyası ne çok basit ne de aşırı özel bir uç örnek olmalıdır. İki hukuki sorun, bir usul riski ve doğrulanabilir üç kaynak ihtiyacı olan, kişisel verileri çıkarılmış kısa bir olay bu amaca yeterlidir. Doğru sonucu önceden bilmeniz, aracın ürettiği çıktıyı bu bilinen sonuçla karşılaştırarak ölçümü mümkün kılar.
Marka adı görünsün mü?
Marka adının görünmemesi daha iyidir; test dosyasında ve puanlama formunda marka adını kapatmak, değerlendiricinin tanıdık veya alışık olduğu ürüne bilinçsizce yüksek puan verme eğilimini azaltır. Bu, test dosyası hazırlığı ve iki bağımsız hukukçu ile puanlama adımlarını tamamlayan üçüncü bir tarafsızlık önlemidir. Sonuç, aracın adına değil altı ölçütte ürettiği doğrulanabilir çıktıya dayanmalıdır.
Resmî Kaynaklar
Kategori karşılaştırması için en iyi hukuk yapay zeka programı 2026, test dosyasının anonimleştirilmesi için yapay zeka için hukuki dosya anonimleştirme yazısına bakın.
Son kaynak kontrolü: 26 Temmuz 2026.
Hukuk teknolojisini yakından izleyin
Emsal araştırma, AI dilekçe, dosya analizi ve ürün güncellemeleri. Haftada en fazla bir e-posta.
İlgili çözüm
Avukat için yapay zeka programıEmsal araştırmasından taslağa geçen iş akışını inceleyin.
SmartHukuk Editör Ekibi
Editöryal EkipBu içerik SmartHukuk editöryal ekibi tarafından hazırlandı. Hukuki tavsiye niteliği taşımaz; resmi işlem öncesi güncel mevzuatı teyit edip yetkili bir avukata danışın.
Kaynak ve editöryal metodolojimizi inceleyin