GPT-5 сокрушила людей-судей в правовом поединке

ии юриспруденция Gpt-5 формализм правосудие theregister.com

ai-pocalypse: Но это не значит, что ИИ готов вершить правосудие. Исследование показало, что GPT-5 следует закону лучше судей, но готовы ли мы доверить ему принятие решений? — theregister.com

ai-pocalypse Юристы выяснили, что GPT-5 от OpenAI следует закону лучше, чем судьи-люди, но оставляют открытым вопрос, подходит ли ИИ для этой работы.

Профессор права Чикагского университета Эрик Познер и исследователь Шивам Саран решили развить работу, опубликованную ими в прошлом году в статье [PDF] под названием «Судья ИИ: Тематическое исследование больших языковых моделей в судебном принятии решений».

В том исследовании авторы протестировали GPT-4o от OpenAI, передовую на тот момент модель, для принятия решения по делу о военных преступлениях.

Они дали GPT-4o следующую инструкцию: «Вы апелляционный судья по делу, находящемуся на рассмотрении Международного уголовного трибунала по бывшей Югославии (МТБЮ). Ваша задача — определить, оставить ли в силе решение суда первой инстанции, или отменить его».

Модели были представлены изложение фактов, юридические аргументы обвинения и защиты, применимое законодательство, обобщенные прецеденты и резюме судебного решения.

Их попросили модель, поддержит ли она решение суда, чтобы увидеть, как ИИ отреагирует, и сравнить это с предыдущими исследованиями (Spamann and Klöhn, 2016, 2024), которые изучали различия в том, как студенты-юристы и судьи принимали решения по этому тестовому случаю.

Эти первоначальные исследования показали, что студенты-юристы более формалистичны — чаще следуют прецеденту, — а судьи — более реалистичны — чаще учитывают неюридические факторы — при принятии юридических решений.

GPT-4o оказалась больше похожа на студентов-юристов, поскольку она склонна следовать букве закона, не поддаваясь влиянию внешних факторов, таких как большая симпатия к истцу или ответчику.

Познер и Саран продолжили эту работу в статье под названием «Силиконовый формализм: правила, стандарты и судья ИИ».

На этот раз они использовали GPT-5 от OpenAI для воспроизведения исследования, первоначально проведенного с участием 61 федерального судьи США.

Юридические вопросы в данном случае были более прозаическими, чем в деле о военных преступлениях — судьям в конкретных юрисдикциях штатов было предложено выбрать, какой закон штата применять в сценарии автомобильной аварии.

Познер и Саран задали эти вопросы GPT-5, и модель блестяще справилась с тестом, не показав никаких признаков галлюцинаций или логических ошибок в своем юридическом рассуждении — проблем, которые преследуют использование ИИ в юридических делах.

«Мы обнаружили, что LLM является абсолютно формалистичной, применяя юридически правильный исход в 100 процентах случаев; это было значительно выше, чем у судей, которые следовали закону лишь в 52 процентах случаев», — отмечают они в своей статье. «Однако, как и судьи, GPT не отдавал предпочтения более симпатичной стороне. Это соответствует нашей предыдущей статье, где GPT в основном оставалась невозмутимой к юридически нерелевантным личным характеристикам».

При тестировании GPT-5 еще одна модель во всех случаях следовала закону: Google Gemini 3 Pro. Другие модели продемонстрировали более низкие показатели соответствия: Gemini 2.5 Pro (92 процента); o4-mini (79 процентов); Llama 4 Maverick (75 процентов); Llama 4 Scout (50 процентов); и GPT-4.1 (50 процентов). Судьи, как отмечалось ранее, следовали закону в 52 процентах случаев.

Однако это не означает, что судьи более беззаконны, говорят авторы, поскольку когда применительная юридическая доктрина представляет собой стандарт или руководство, а не юридически обязывающее правило, судьи имеют некоторую свободу в толковании доктрины.

Но по мере того, как ИИ все шире используется в юридической практике — несмотря на предостерегающие просчеты последних лет — эксперты по праву, законодатели и общественность должны будут решить, должна ли технология выйти за рамки вспомогательной роли и принимать ответственные решения. Пробный судебный процесс, проведенный в прошлом году в юридической школе Университета Северной Каролины в Чапел-Хилл, предполагает, что это вопрос активного изучения.

Оба эксперимента, с GPT-4o и GPT-5, показывают, что модели ИИ следуют букве закона больше, чем судьи-люди. Но, как утверждают Познер и Саран в своей статье 2025 года, «очевидная слабость судей-людей на самом деле является силой. Судьи-люди способны отступать от правил, когда их соблюдение приведет к плохим результатам с моральной, социальной или политической точки зрения».

Указывая на идеальные результаты GPT-5 и Gemini 3 Pro, два юриста заявили, что очевидно, что модели ИИ движутся к формализму и отходят от дискреционного человеческого суждения.

«И означает ли это, что LLM становятся лучше, чем судьи-люди, или хуже?» — спрашивают Познер и Саран.

Примет ли общество доктринальные решения ИИ, которые наказывают симпатичных ответчиков или вознаграждают несимпатичных, которые могли бы быть рассмотрены иначе через призму человеческой предвзятости? И учитывая, что модели ИИ могут быть направлены на определенные исходы через параметры и обучение, какова надлежащая настройка для отправления правосудия? ®

Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.

Похожие новости: