🏳️‍🌈 TybyrIA v2.2

A TybyrIA é um modelo de IA especializado em identificar indícios de hostilidade anti-LGBTQIA+ em português brasileiro.

Tecnicamente, é um classificador de texto baseado em BERT/Tupi-BERT, ajustado sobre comentários do Instagram anotados e revisados manualmente. Ele classifica textos como hostis ou não hostis no contexto de violência anti-LGBTQIA+.

🌱 De onde veio

É um protótipo feito por uma organização de direitos humanos, não nasceu em um laboratório de IA e sim em meio a uma onda coordenada de ódio.

Em 2024, o podcast Entre Amigues virou alvo de uma mobilização organizada de ataques anti-LGBTQIA+ que atravessou Instagram, TikTok, YouTube e X. Denunciamos às plataformas. Elas não agiram. Construímos a TybyrIA para conseguir medir com nossas próprias mãos o que elas se recusavam a reconhecer.

A anotação foi feita à mão pela própria Código Não Binário e pessoas colaboradoras. O treino rodou em computadores pessoais, com recursos limitados, doados por fundos de direitos humanos. O relatório que originou este modelo registra os "reduzidos recursos humanos, financeiros e psicológicos da organização e da equipe".

Somos uma organização de direitos humanos que ousa ser também um laboratório popular e colaborativo de IA. Publicamos o modelo, os dados e as limitações porque quem é afetado por sistemas automatizados tem direito de auditá-los, inclusive os nossos.

O nome é de Tybyra do Maranhão, primeira vítima registrada de LGBTfobia em território brasileiro.

🎯 Para que serve, e para que não serve

Serve para sinalizar textos que merecem olhar humano, em pesquisa, documentação de violência e triagem de grandes volumes.

Não serve para bloquear, remover, punir ou pontuar ninguém automaticamente.

O limiar que recomendamos é 0,40, sempre com revisão humana depois.

🔬 Como foi treinada

Retreino a partir da v2.1, sobre 2.551 exemplos: 1.891 comentários do Instagram anotados à mão pela equipe, mais 660 exemplos novos revisados uma por uma por pessoas da organização, incluindo fala afirmativa, para melhorar performance de versão anterior.

⚠️ Limitações

TybyrIA v2.2 é uma ferramenta de apoio assistido à detecção de hostilidade contra pessoas LGBTQIA+ em português brasileiro, pensada para triagem de comentários em conteúdo LGBTQIA+ nas redes.

Esta atualização da v2.2 corrige um problema importante das versões anteriores: o modelo sinalizava como hostil parte da fala afirmativa e de apoio da própria comunidade (ex.: "pessoa não binária merece respeito", "bom dia pra todes"). O re-treino reforçou exemplos afirmativos e de crítica não-direcionada, reduzindo fortemente esses falsos positivos sem perder a detecção de hostilidade explícita e de dog whistles.

📄 Licença

Pesos deste repositório: MIT. Dados de treino: CC-BY-NC-SA-4.0.

Desenvolvido pela Código Não Binário.

Downloads last month
178
Safetensors
Model size
0.1B params
Tensor type
F32
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for Veronyka/tybyria-v2.2

Dataset used to train Veronyka/tybyria-v2.2

Spaces using Veronyka/tybyria-v2.2 2