Projeto OpenEval: Avaliação transparente de revisão por pares com suporte a LLMs / OpenEval
O projeto OpenEval oferece uma avaliação transparente e sistemática do desempenho de grandes modelos de linguagem (LLMs) na revisão por pares científica. Comparamos pareceres gerados por LLMs com revisões tradicionais por pares para avaliar sua precisão, consistência e confiabilidade na identificação de afirmações e na avaliação de evidências científicas. Explore nosso conjunto de dados de manuscritos abaixo. Clique em qualquer artigo para visualizar comparações detalhadas, afirmação por afirmação, entre as avaliações dos LLMs e dos revisores humanos. Todos os artigos são publicados sob a licença CC-BY e estão disponíveis em sua forma original no site da eLife. Os artigos apresentados aqui foram modificados para destacar as afirmações neles contidas.
#AvaliaçãoPorPares #OpenEval #IA
via OpenEval
Disponível em: https://openevalproject.com/
