Estudo revela que GPT-4 está "emburrecendo"
Professores de CS em Berkeley e Stanford tem monitorado a performance do GPT-4 e ChatGPT, para ver como ela evolui ao longo do tempo. Soltaram um estudo recente sobre suas descobertas:
https://arxiv.org/pdf/2307.09009.pdf
Por outro lado, o GPT-3.5 tem melhorado sua acurácia.
https://i.imgur.com/wHvrA6F.png
Seria um movimento natural? Um fruto de corte de custos? Da especialização dos plugins? Preocupante... Especialmente para quem está se propondo a construir aplicações utilizando o modelo.
Como disse outro comentarista: "Estamos saindo da fase 'Uau' dos Large Language Models. Agora é a hora de começarmos a descobrir onde estão os problemas."