VIÉS EM GERAÇÃO DE LINGUAGEM NATURAL NA ERA DOS LARGE
LANGUAGE MODELS (LLMS) SOB A PERSPECTIVAS DAS HUMANIDADES
DIGITAIS
modelos de linguagem; viés em modelos de linguagem; humanidades digitais; inteligência artificial
A rápida disseminação e adoção de tecnologias de inteligência artificial, especialmente
modelos de linguagem, representa um marco na evolução da sociedade digital contemporânea. Esses modelos, alimentados por algoritmos avançados e treinados em grandes
volumes de dados, têm o potencial de transformar uma ampla gama de setores, desde a
indústria até os serviços públicos. A escalabilidade e versatilidade dessas soluções têm
conduzido as mesmas a um uso exponencial (HAAN, 2023) em diversas aplicações, criando um cenário onde a interação entre humanos e máquinas é cada vez mais comum e intrínseca à vida cotidiana.
O presente trabalho objetiva avaliar os vieses nos modelos de linguagem, especialmente
os de grande escala, e seu impacto na produção de conhecimento contemporâneo. O
estudo busca identificar como esses modelos reproduzem preconceitos e estereótipos a
partir dos dados de treinamento, influenciando decisões automatizadas e disseminação de
informações. Além disso, destaca a necessidade de regulamentação na área e a importância
da representatividade cultural nos conjuntos de dados para promover uma produção de
conhecimento mais equitativa e socialmente responsável.