APLICAÇÕES DE LARGE LANGUAGE MODELS NA AVALIAÇÃO PSIQUIÁTRICA FORENSE E NA TOMADA DE DECISÃO MÉDICO-LEGAL: REVISÃO DE ESCOPO

Authors

DOI:

https://doi.org/10.18623/rvd.v23.8043

Keywords:

Large Language Models, Inteligência Artificial, Psiquiatria Forense, Tomada de Decisão Médico-Legal, Avaliação Pericial

Abstract

OBJETIVO: Mapear e analisar as evidências científicas sobre as aplicações de Large Language Models (LLMs) na avaliação psiquiátrica forense e na tomada de decisão médico-legal, identificando potenciais usos em triagem, análise de informações clínicas e periciais, elaboração de pareceres, apoio diagnóstico, predição de riscos, bem como limitações, implicações éticas e desafios relacionados à sua utilização em contextos forenses. MÉTODOS: Revisão de escopo realizada em 2026, conduzida conforme as recomendações do JBI e do PRISMA-ScR. Utilizou-se a estratégia PCC, sendo P: indivíduos submetidos a avaliações psiquiátricas ou psicológicas forenses, profissionais periciais e usuários de sistemas de apoio à decisão; C: aplicações de Large Language Models na avaliação psiquiátrica forense e na tomada de decisão médico-legal; C: psiquiatria forense, psicologia forense, perícias judiciais e demais contextos médico-legais. A pergunta norteadora foi: “Quais evidências científicas descrevem as aplicações de Large Language Models na avaliação psiquiátrica forense e na tomada de decisão médico-legal, e quais lacunas são identificadas na literatura?”. Foram incluídos estudos completos publicados nos últimos cinco anos, em todos os idiomas e relacionados ao uso de LLMs em contextos forenses. Excluíram-se estudos sem relação com inteligência artificial generativa, psiquiatria forense ou tomada de decisão médico-legal. RESULTADOS E DISCUSSÃO: Foram incluídos 14 estudos. As evidências demonstraram que os LLMs apresentam potencial para organizar grandes volumes de informações clínicas, apoiar hipóteses diagnósticas, analisar documentos periciais, identificar padrões psicopatológicos e auxiliar avaliações de risco. Em alguns cenários, os modelos alcançaram desempenho comparável ao de especialistas na identificação de transtornos psiquiátricos e avaliação de risco suicida. Contudo, também foram identificadas limitações relevantes, incluindo alucinações informacionais, vieses algorítmicos, instabilidade das respostas, dificuldades de interpretação probabilística e riscos relacionados à simulação sintomática assistida por IA. Além disso, persistem preocupações quanto à transparência, explicabilidade, validade pericial e segurança jurídica das decisões apoiadas por esses sistemas. CONCLUSÃO: Os LLMs apresentam potencial significativo como ferramentas assistivas na psiquiatria forense, mas sua utilização deve permanecer subordinada ao julgamento especializado, exigindo validação científica contínua, supervisão humana, governança ética e protocolos específicos para garantir confiabilidade, transparência e proteção dos direitos dos indivíduos avaliados.

References

AYDOGAN, H. C. et al. Inferential performance and temporal stability of large language models in suicide method prediction: a forensic psychiatric analysis. Health Informatics Journal, v. 32, n. 1, 2026. DOI: 10.1177/14604582251414578. Disponível em: https://doi.org/10.1177/14604582251414578. Acesso em: 19 jun. 2026.

BATTISTA, F. et al. Malingering depression: a comparative study of human and GPT-3.5 performance. Current Psychology, v. 45, art. 379, 2026. DOI: 10.1007/s12144-025-09009-x. Disponível em: https://doi.org/10.1007/s12144-025-09009-x. Acesso em: 19 jun. 2026.

FUERMAIER, A. B. M.; NIESTEN, I. J. M. ChatGPT helps students feign ADHD: an analogue study on AI-assisted coaching. Psychological Injury and Law, v. 18, p. 97-107, 2025. DOI: 10.1007/s12207-025-09538-7. Disponível em: https://doi.org/10.1007/s12207-025-09538-7. Acesso em: 19 jun. 2026.

GALVÃO, T. F.; PANSANI, T. S. A.; HARRAD, D. Principais itens para relatar revisões sistemáticas e meta-análises: a recomendação PRISMA 2020 (tradução e adaptação para o português). Epidemiologia e Serviços de Saúde, Brasília, DF, v. 31, n. 2, e2022107, 2022. DOI: 10.1590/S1679-49742022000200007. Disponível em: https://doi.org/10.1590/S1679-49742022000200007. Acesso em: 19 jun. 2026.

GARGARI, O. K. et al. Diagnostic accuracy of large language models in psychiatry. Asian Journal of Psychiatry, v. 100, art. 104168, 2024. DOI: 10.1016/j.ajp.2024.104168. Disponível em: https://doi.org/10.1016/j.ajp.2024.104168. Acesso em: 19 jun. 2026.

GERSHAN, S. A.; SCHOENFELD, E.; GRABB, D. J. A pilot analysis investigating the use of AI in malingering. Journal of the American Academy of Psychiatry and the Law, v. 53, n. 2, p. 147-156, 2025. DOI: 10.29158/JAAPL.240115-24. Disponível em: https://doi.org/10.29158/JAAPL.240115-24. Acesso em: 19 jun. 2026.

GOH, E. et al. Large language model influence on diagnostic reasoning: a randomized clinical trial. JAMA Network Open, v. 7, n. 10, 2024. Disponível em: https://jamanetwork.com/journals/jamanetworkopen/fullarticle/2825395. Acesso em: 19 jun. 2026.

GU, B. et al. Probabilistic medical predictions of large language models. npj Digital Medicine, v. 7, art. 367, 2024. DOI: 10.1038/s41746-024-01366-4. Disponível em: https://doi.org/10.1038/s41746-024-01366-4. Acesso em: 19 jun. 2026.

HAGER, P. et al. Evaluation and mitigation of the limitations of large language models in clinical decision-making. Nature Medicine, v. 30, p. 2613-2622, 2024. DOI: 10.1038/s41591-024-03097-1. Disponível em: https://doi.org/10.1038/s41591-024-03097-1. Acesso em: 19 jun. 2026.

HUA, Y. et al. A scoping review of large language models for generative mental health care. npj Digital Medicine, v. 8, 2025. Disponível em: https://www.nature.com/articles/s41746-025-01611-4. Acesso em: 19 jun. 2026.

JOANNA BRIGGS INSTITUTE (JBI). Evidence Implementation Training Program. Adelaide: Joanna Briggs Institute, 2022. Disponível em: http://www.ee.usp.br/jbibrasil/cursos/evidence-implementation-training-program-eitp/. Acesso em: 19 jun. 2026.

JIN, Y. et al. The applications of large language models in mental health: a scoping review. JMIR Mental Health, v. 12, 2025. Disponível em: https://www.jmir.org/2025/1/e69284. Acesso em: 19 jun. 2026.

KE, Y. et al. Mitigating cognitive biases in clinical decision-making through multi-agent conversations using large language models: simulation study. Journal of Medical Internet Research, v. 26, e59439, 2024. DOI: 10.2196/59439. Disponível em: https://doi.org/10.2196/59439. Acesso em: 19 jun. 2026.

KELLERMEYER, L.; HARNKE, B.; KNIGHT, S. Covidence and Rayyan. Journal of the Medical Library Association, v. 106, n. 4, p. 580-581, 2018. Disponível em: https://www.ncbi.nlm.nih.gov/pmc/articles/PMC6148615/. Acesso em: 19 jun. 2026.

KIM, J. et al. Large language models outperform mental and medical health care professionals in identifying obsessive-compulsive disorder. npj Digital Medicine, v. 7, art. 193, 2024. DOI: 10.1038/s41746-024-01181-x. Disponível em: https://doi.org/10.1038/s41746-024-01181-x. Acesso em: 19 jun. 2026.

LAVIGNE, S.; RIOS, A.; DAVIS, J. J. Does generative artificial intelligence pose a risk to performance validity test security? The Clinical Neuropsychologist, v. 40, n. 3, p. 848-861, 2026. DOI: 10.1080/13854046.2024.2379023. Disponível em: https://doi.org/10.1080/13854046.2024.2379023. Acesso em: 19 jun. 2026.

LIESLEHTO, J. et al. Large language model approach to uncover reasoning patterns in forensic psychiatric assessment. Scientific Reports, 2026. DOI: 10.1038/s41598-026-53275-z. Disponível em: https://doi.org/10.1038/s41598-026-53275-z. Acesso em: 19 jun. 2026.

LIU, Z. et al. Large language models in psychiatry: current applications and future directions. Big Data Mining and Analytics, v. 8, 2024. Disponível em: https://www.sciopen.com/article/10.26599/BDMA.2024.9020046. Acesso em: 19 jun. 2026.

McBAIN, R. K. et al. Evaluation of alignment between large language models and expert clinicians in suicide risk assessment. Psychiatric Services, v. 76, n. 11, 2025. DOI: 10.1176/appi.ps.20250086. Disponível em: https://doi.org/10.1176/appi.ps.20250086. Acesso em: 19 jun. 2026.

McCOY, T. H.; PERLIS, R. H. Characterizing research domain criteria symptoms among psychiatric inpatients using large language models. Journal of Mood & Anxiety Disorders, v. 8, art. 100079, 2024. DOI: 10.1016/j.xjmad.2024.100079. Disponível em: https://doi.org/10.1016/j.xjmad.2024.100079. Acesso em: 19 jun. 2026.

OMAR, M. et al. Applications of large language models in psychiatry: a systematic review. Frontiers in Psychiatry, v. 15, art. 1422807, 2024. DOI: 10.3389/fpsyt.2024.1422807. Disponível em: https://doi.org/10.3389/fpsyt.2024.1422807. Acesso em: 19 jun. 2026.

OXFORD CENTRE FOR EVIDENCE-BASED MEDICINE. OCEBM levels of evidence. Oxford: University of Oxford, 2024. Disponível em: https://www.cebm.ox.ac.uk/resources/levels-of-evidence/ocebm-levels-of-evidence. Acesso em: 19 jun. 2026.

PAGE, M. J. et al. The PRISMA 2020 statement: an updated guideline for reporting systematic reviews. BMJ, London, v. 372, n. 71, 2021. DOI: 10.1136/bmj.n71. Disponível em: https://doi.org/10.1136/bmj.n71. Acesso em: 19 jun. 2026.

PARMIGIANI, G. et al. Applications of artificial intelligence in forensic mental health: opportunities and challenges. Frontiers in Psychiatry, v. 15, 2024. Disponível em: https://www.frontiersin.org. Acesso em: 19 jun. 2026.

PETERS, M. D. J. et al. Best practice guidance and reporting items for the development of scoping review protocols. JBI Evidence Synthesis, v. 20, n. 4, p. 953-968, 2022. DOI: 10.11124/JBIES-21-00242. Disponível em: https://doi.org/10.11124/JBIES-21-00242. Acesso em: 19 jun. 2026.

PEZZI JUNIOR, S. A. Ferramenta metodológica padronizada para revisões de escopo em ciências da saúde (versão 1.0). Zenodo, 2026. DOI: 10.5281/zenodo.19476896. Disponível em: https://doi.org/10.5281/zenodo.19476896. Acesso em: 19 jun. 2026.

SUN, M. et al. Large language models for psychiatric diagnosis based on multicenter real-world clinical records: comparative study. JMIR Medical Informatics, v. 14, e77699, 2026. DOI: 10.2196/77699. Disponível em: https://doi.org/10.2196/77699. Acesso em: 19 jun. 2026.

TRICCO, A. C. et al. PRISMA extension for scoping reviews (PRISMA-ScR): checklist and explanation. Annals of Internal Medicine, v. 169, n. 7, p. 467-473, 2018. DOI: 10.7326/M18-0850. Disponível em: https://doi.org/10.7326/M18-0850. Acesso em: 19 jun. 2026.

VOULTSIOU, E. et al. A systematic review of large language models in mental health. Electronics, v. 15, n. 3, 2026. Disponível em: https://www.mdpi.com/2079-9292/15/3/524. Acesso em: 19 jun. 2026.

WANG, Y. F. et al. Large language models in clinical psychiatry. Frontiers in Psychiatry, 2025. Disponível em: https://pmc.ncbi.nlm.nih.gov/articles/PMC12635646/. Acesso em: 19 jun. 2026.

Published

2026-08-18

How to Cite

Cavalcante, R. L. de C., Pena, B. B., Moreira, I. R. da F., Silva, C. A., & Fialho, D. G. (2026). APLICAÇÕES DE LARGE LANGUAGE MODELS NA AVALIAÇÃO PSIQUIÁTRICA FORENSE E NA TOMADA DE DECISÃO MÉDICO-LEGAL: REVISÃO DE ESCOPO. Veredas Do Direito, 23(14), e238043. https://doi.org/10.18623/rvd.v23.8043