Pesquisadores da Brown University, liderados por Michael Lepori, perguntaram se modelos de linguagem distinguem eventos plausíveis, improváveis, impossíveis ou sem sentido. Eles mostraram sentenças como "resfriou com gelo", "resfriou com neve", "resfriou com fogo" e uma frase sem sentido.
Para entender as respostas, usaram interpretabilidade mecanicista, que examina os estados matemáticos internos do modelo. Os testes rodaram em modelos open-source como GPT 2, Llama 3.2 e Gemma 2. O estudo encontrou vetores internos que se relacionam com categorias de plausibilidade e que seguem julgamentos humanos, e observou padrões emergindo em modelos maiores.
Palavras difíceis
- interpretabilidade — capacidade de explicar estados internos
- mecanicista — que explica algo por mecanismos ou partes
- plausível — que pode parecer verdadeiro ou lógicoplausíveis
- vetor — representação numérica que modelos usamvetores
- emergir — aparecer ou surgir de forma inesperadaemergendo
Dica: passe o mouse, foque ou toque nas palavras destacadas no artigo para ver definições rápidas enquanto lê ou ouve.
Perguntas para discussão
- Você acha que é fácil distinguir uma frase plausível de uma sem sentido? Por quê?
- Dê um exemplo curto de uma frase plausível e outra sem sentido para testar um modelo.
Artigos relacionados
Kerala nomeia Bacillus subtilis micróbio estadual
Kerala declarou Bacillus subtilis micróbio estadual para destacar o papel de micróbios benéficos na saúde, segurança alimentar, ambiente e resiliência climática. O novo centro de microbioma investiga aplicações e produtos baseados nesses micróbios.