[{"data":1,"prerenderedAt":-1},["ShallowReactive",2],{"detail-sidebar-cat-0-pt-112":3,"doc-seo-214017-112":49,"doc-detail-214017-pt":115},{"code":4,"msg":5,"data":6},0,"success",[7,13,17,21,25,29,33,37,41,45],{"id":8,"doc_module":4,"doc_module_name":9,"category_name":10,"show_sort_weight":11,"slug":12},26,"Document","Contos e Romances",60,"story-novel",{"id":14,"doc_module":4,"doc_module_name":9,"category_name":15,"show_sort_weight":11,"slug":16},46,"Estilo de Vida","lifestyle",{"id":18,"doc_module":4,"doc_module_name":9,"category_name":19,"show_sort_weight":11,"slug":20},28,"Exames","exam",{"id":22,"doc_module":4,"doc_module_name":9,"category_name":23,"show_sort_weight":11,"slug":24},47,"Geral","general",{"id":26,"doc_module":4,"doc_module_name":9,"category_name":27,"show_sort_weight":11,"slug":28},29,"Histórias em Quadrinhos","comic",{"id":30,"doc_module":4,"doc_module_name":9,"category_name":31,"show_sort_weight":11,"slug":32},27,"Literatura","literature",{"id":34,"doc_module":4,"doc_module_name":9,"category_name":35,"show_sort_weight":11,"slug":36},32,"Pesquisa e Relatórios","research-report",{"id":38,"doc_module":4,"doc_module_name":9,"category_name":39,"show_sort_weight":11,"slug":40},33,"Religião e Espiritualidade","religion-spirituality",{"id":42,"doc_module":4,"doc_module_name":9,"category_name":43,"show_sort_weight":11,"slug":44},31,"Saúde e Cuidados","healthcare",{"id":46,"doc_module":4,"doc_module_name":9,"category_name":47,"show_sort_weight":11,"slug":48},45,"Tecnologia","technology",{"code":4,"msg":50,"data":51},"ok",{"site_id":52,"language":53,"slug":54,"title":55,"keywords":56,"description":57,"schema_data":58,"social_meta":108,"head_meta":110,"extra_data":112,"updated_unix":114},112,"pt","evaluation-of-language-models-for-clinical-decision-support-in-brazilian-primary-health-care-comparative-study-gpt-4-and-llama-3","Avaliação de Modelos de Linguagem para o Suporte Decisório na Atenção Primária Brasileira - Estudo Comparativo GPT-4 e Llama-3","","A integração de Modelos de Linguagem de Grande Escala à prática clínica oferece potencial para suporte à decisão, mas a confiabilidade na Atenção Primária à Saúde brasileira permanece pouco explorada. O estudo compara GPT-4 e Llama-3 com base em casos de exames de residência médica, avaliando acurácia diagnóstica e “alucinações de protocolo” sob uma perspectiva territorial. Resultados preliminares indicam raciocínio elevado, porém diretrizes internacionais frequentemente se sobrepõem às normas do SUS. A pesquisa identifica barreiras para implementação segura de IA generativa no contexto de saúde pública nacional.",{"@graph":59,"@context":107},[60,77,98],{"@type":61,"itemListElement":62},"BreadcrumbList",[63,68,71,74],{"item":64,"name":65,"@type":66,"position":67},"https://docshare.wps.com","Home","ListItem",1,{"item":69,"name":9,"@type":66,"position":70},"https://docshare.wps.com/pt/document/",2,{"item":72,"name":43,"@type":66,"position":73},"https://docshare.wps.com/pt/document/saúde-e-cuidados/",3,{"item":75,"name":55,"@type":66,"position":76},"https://docshare.wps.com/pt/document/evaluation-of-language-models-for-clinical-decision-support-in-brazilian-primary-health-care-comparative-study-gpt-4-and-llama-3/214017/",4,{"url":75,"name":55,"@type":78,"image":79,"author":84,"headline":55,"publisher":87,"fileFormat":90,"inLanguage":53,"description":57,"dateModified":91,"datePublished":92,"encodingFormat":90,"isAccessibleForFree":93,"interactionStatistic":94},"DigitalDocument",{"url":80,"@type":81,"width":82,"height":83},"https://docshare.wps.com/thumbnails/evaluation-of-language-models-for-clinical-decision-support-in-brazilian-primary-health-care-comparative-study-gpt-4-and-llama-3/214017.png","ImageObject",300,407,{"name":85,"@type":86},"Ethan Miller","Person",{"url":64,"name":88,"@type":89},"DocShare","Organization","application/pdf","2026-10-05","2026-09-07",true,{"@type":95,"interactionType":96,"userInteractionCount":73},"InteractionCounter",{"@type":97},"ViewAction",{"@type":99,"mainEntity":100},"FAQPage",[101],{"name":102,"@type":103,"acceptedAnswer":104},"O que os resultados preliminares indicam sobre diretrizes e segurança?","Question",{"text":105,"@type":106},"Apesar de raciocínio elevado, diretrizes internacionais frequentemente se sobrepõem às normas do SUS, sugerindo barreiras para uso seguro e adequado da IA generativa na saúde pública brasileira.","Answer","https://schema.org",{"og:url":75,"og:type":109,"og:title":55,"og:site_name":88,"og:description":57},"article",{"robots":111,"canonical":75},"index,follow",{"doc_id":113,"site_id":52},214017,1790318014,{"code":4,"msg":5,"data":116},{"doc_id":113,"user_id":117,"nickname":85,"user_avatar":118,"doc_module":4,"category_id":42,"category_name":43,"doc_title":55,"doc_description":57,"doc_content":119,"file_id":120,"file_url":121,"file_type":122,"file_size":123,"view_count":73,"is_deleted":4,"is_public":67,"is_downloadable":67,"audit_status":67,"page_count":124,"language":125,"language_code":53,"site_id":52,"html_lang":53,"table_of_contents":126,"faqs":127,"seo_title":128,"seo_description":57,"update_tm":129,"read_time":130},687207017582,"https://ap-avatar.wpscdn.com/davatar_994ba38a5ba835b3df7d355c54d3ed8d","Avaliac¸ o de Modelos de Ling˜uagem para o Suporte  Deciso  \nMdica na Atenc¸ao Primria Brasileira  \nMartony Demes da Silva 1  \n1 Centro de Educac¸ o Aberta e a Distncia (CEAD)  \n[martony.silva@ufpi.edu.br](martony.silva@ufpi.edu.br)  \nAbstract. The integration of Large Language Models (LLMs) into clinical prac tice offers potential for medical decision support, yet their reliability in Bra zil’s Primary Health Care (PHC) remains under-explored. This study compares GPT-4 and Llama-3 using clinical cases from Brazilian medical residency exams, focusing on diagnostic accuracy and ”protocol hallucinations”under a territorial lens. Preliminary results show that while models exhibit high reasoning, international guidelines frequently override Unified Health System (SUS) standards. This work identifies barriers to the safe implementation of generative AI within the Brazilian public health context.  \nResumo. A integrac¸ o de Modelos de Linguagem de Grande Escala (LLMs) a` pra´tica clı´nica oferece potencial para suporte a` decisa˜o, mas sua confiabilidade na Atenc¸ a˜o Prima´ria a` Sau´de (APS) no Brasil carece de investigac¸ a˜o.  \nEste estudo compara o GPT-4 e o Llama-3 usando casos de exames de resideˆncia me´dica brasileiros, analisando acur a´cia diagno´stica e ”alucinac¸ o˜es de protocolo”sob uma perspectiva territorial. Resultados preliminares indicam que diretrizes internacionais frequentemente sobrep o˜em-se a`s normas do SUS.  \nO trabalho identifica barreiras a` implementac¸ a˜o segura da IA generativa no contexto da sau´depu´blica nacional.  \n1. Introduc¸ o  \nO suporte  deciso cl´ınica mediado por Inteligncia Artificial Generativa tem ganhadodestaque pela capacidade de processar vastos vo˜lumes de literatura mdica em linguagem natural [Nori et al. 2023] . No cenrio da Atenc¸ao Prim˜ria  Sa´ude (APS) no Brasil, essaferramenta pode a˜uxiliar mdicos de fam´ılia na navegac¸ao por protocolos complexos. Entretanto, a aplicac¸ao de modelos generalistas ex˜ige cautela, visto que a conformidade com  \nas diretrizes do Ministrio da Sa´ude e a Relac¸ao Nacional de Medicamentos Essenciais (RENAME)  um requisito de seguranc¸a indispensvel.  \nO problema central reside na natureza pr˜obabil´ıstica desses modelos, que frequen  \ntemente gera ”alucinac¸o˜es clı´nicas”, informac¸oes factualmente incorretas apresentadas com alto grau de con˜fianc¸a. No contexto brasileiro, essa vulnerabilidade  agravada pela  \nnecessidade de adesao estrita aos protocolos do Sistema ´Unico de Sa´ude (SUS), que diferem substancialmente de diretrizes internacionais em termos de rastreame˜nto popula  \ncional, fluxos de encaminhamento e disponibilidade farmacolgica na Relac¸ao Nacional de Medicamentos Essenciais (RENAME) . A Tabela 1 exemplifica discrepncias epid˜e  \nmiolgicas e de protocolo que podem induzir modelos de IA a erros sistemticos se naohouver um ajuste ao contexto local.  \nTabela 1. Discrepncias entre Diretrizes Internacionais e Protocolos do SUS  \n\n| Condic¸ o Clnica | Diretriz Internacional (Base LLM) | Protocolo SUS (Brasil) |\n| --- | --- | --- |\n| Cncer de Colo | In´ıcio do rastreio aos 21 anos (ACOG/ACS) | In´ıcio do rastreio aos 25 anos (INCA/MS) |\n| Hipertenso | Inibidores de SGLT2 como primeira linha (ESC) | Diurticos tiaz´ıdicos e IECA/BRA (RENAME) |\n| Manejo Dengue | Protocol˜os genricos de\u003Cbr>hidratac¸ ao | Classificac¸ o de risco em grupos (A, B, C, D) |\n\nA justificativa para este estudo pauta-se na urgncia de estabelecer parmetros de confiabilidade para o uso assistivo de IA no Brasil. Enquanto modelos proprietrios como o GPT-4 dominam o desempenho, modelos de cdigo aberto (open-source) como o Llama-3 surgem como alternativas viveis para garantir a p˜rivacidade dos dados dos  \npacientes e a soberania tecnolgica nacional. Contudo, ainda nao se sabe em que medidaesses modelos conseguem interpretar nuances da sa´ude p´ublica brasileira.  \nDiante deste cenrio, este trabalho tem como objetivo principal avaliar a acurcia diagnstica e a conformida","cbCaittmGjUMUfce","https://ap.wps.com/l/cbCaittmGjUMUfce","pdf",165132,6,"Portuguese","# Introdução\n# Trabalhos Relacionados","[{\"question\":\"O que os resultados preliminares indicam sobre diretrizes e segurança?\",\"answer\":\"Apesar de raciocínio elevado, diretrizes internacionais frequentemente se sobrepõem às normas do SUS, sugerindo barreiras para uso seguro e adequado da IA generativa na saúde pública brasileira.\"}]","Avaliação de Modelos de Linguagem para o Suporte Decisório na Atenção Primária Brasileira - Estudo Comparativo GPT-4 e Llama-3 | PDF",1788772169,9]