Referências e documentos
Novo benchmark testa agentes de IA em mediações jurídicas com 972 casos
Relação dos documentos, decisões, notícias e demais materiais consultados na elaboração desta publicação.
Referências consultadas
- arXiv — ProMediConv: Benchmarking Proactive Conversational Agents in Legal Dispute Mediation, v1, 10/9/2026Origem: arxiv.org
- Autores do ProMediConv — repositório público de dados e códigoOrigem: github.com
Elementos incorporados à apuração
- Pesquisadores da University of Science and Technology of China, da Singapore Management University e do Institute of Artificial Intelligence do Hefei Comprehensive National Science Center apresentaram um novo benchmark para avaliar agentes conversacionais de inteligência artificial em mediações jurídicas. O estudo ProMediConv foi disponibilizado no arXiv em 10 de setembro e aparece no repositório como aceito no Findings of EMNLP 2026.
- O trabalho organiza 972 casos em diálogos multiparte e procura medir algo que avaliações tradicionais costumam reduzir ao desfecho: como a intervenção do mediador altera, turno a turno, a disposição de cada participante para compreender o problema, assumir responsabilidades e construir uma solução. Benchmark, nesse contexto, é um conjunto padronizado de casos, tarefas e métricas usado para comparar o desempenho de diferentes sistemas.
- A estrutura divide a mediação em três estágios — compreensão, intervenção e reconciliação — e classifica a posição das partes em quatro estados comportamentais. Também identifica 11 estratégias de mediação, entre elas compreensão da situação, tomada de perspectiva, combinação de argumentos jurídicos e morais, reconhecimento, prevenção e formulação do acordo.
- A base final contém 17.277 falas distribuídas pelos 972 casos, com média de 17,88 intervenções por diálogo e 4,54 participantes por caso, contando o mediador. Os conflitos foram agrupados em 13 tipos. Comunidade e vizinhança representam 19,3% da amostra; trabalho, 18,7%; família e casamento, 18%; e patrimônio e terra, 15,9%.
- O dado exige uma distinção importante. Os pesquisadores não obtiveram 972 transcrições integrais de sessões reais prontas para uso. Eles partiram de 981 relatos publicados em 15 livros chineses sobre mediação, descartaram registros de baixa qualidade e empregaram uma cadeia automatizada para extrair fatos, sequência do caso e normas aplicáveis. Em seguida, reconstruíram os diálogos sob essas restrições e anonimizaram as identidades.
