GPT-5 застосовує норми права точніше за суддів? Нове дослідження про ШІ у судочинстві

3 хв читати

Науковці дійшли висновку, що модель GPT-5 від OpenAI демонструє більш формально точне застосування правових норм, ніж судді-люди. Водночас дослідники ставлять принципове питання: чи означає це, що штучному інтелекту можна довірити ухвалення судових рішень?

Про результати дослідження повідомляє The Register.

Від «Judge AI» до «Silicon Formalism»

Професор права University of Chicago Ерік Познер та дослідник Шівам Саран продовжили роботу, розпочату у дослідженні «Judge AI: A Case Study of Large Language Models in Judicial Decision-Making».

У попередньому експерименті вони тестували модель GPT-4o, запропонувавши їй роль судді апеляційної інстанції Міжнародний кримінальний трибунал щодо колишньої Югославії. Моделі надали фактичні обставини справи про воєнні злочини, правові позиції сторін, норми права та рішення суду першої інстанції.

Результати показали, що GPT-4o діяла більш формалістично — суворо дотримувалася прецедентів і норм права, не зважаючи на емоційні чи позаправові чинники. Така поведінка виявилася ближчою до підходу студентів-правників, ніж до практики реальних суддів.

Експеримент із GPT-5: 100% відповідність закону

У новому дослідженні «Silicon Formalism: Rules, Standards, and Judge AI» вчені протестували вже GPT-5. Експеримент відтворював попереднє дослідження за участі 61 федерального судді США.

Цього разу предметом аналізу були питання визначення застосовного права штату у справах про дорожньо-транспортні пригоди.

За результатами тестування GPT-5 продемонструвала 100% відповідність юридично правильним рішенням — без галюцинацій або логічних помилок. Для порівняння, судді дотрималися буквального застосування норм лише у 52% випадків.

Повну відповідність також показала модель Google Gemini 3 Pro. Інші системи продемонстрували такі результати:

Gemini 2.5 Pro — 92%;

o4-mini — 79%;

Llama 4 Maverick — 75%;

Llama 4 Scout — 50%;

GPT-4.1 — 50%.

Формалізм ШІ vs дискреція судді

Автори дослідження наголошують: вищий рівень формальної точності не означає, що людські судді «помиляються». У багатьох випадках правова норма є стандартом або рамковим орієнтиром, що допускає суддівську дискрецію.

Суддя може враховувати моральні, соціальні чи політичні наслідки рішення — і саме ця гнучкість, за словами дослідників, є силою людського правосуддя.

У статті 2025 року Познер і Саран підкреслюють, що «очевидна слабкість людських суддів насправді є їхньою перевагою, адже вони можуть відступити від правил, якщо буквальне застосування норми призведе до небажаних наслідків».

Чи готові суди до «Judge AI»?

Попри технічну точність GPT-5, питання довіри до ШІ у сфері судочинства залишається відкритим. Чи має судове рішення бути виключно формально правильним? Чи повинно воно враховувати ширший соціальний контекст?

Дискусія про межі використання штучного інтелекту в праві лише набирає обертів. І хоча ШІ демонструє здатність до безпомилкового застосування норм, остаточне слово в правосудді поки що залишається за людиною.