tweets citados na decisão, de – perfis diferentes
– já não estavam no ar quando fizemos a coleta
ainda estavam no ar. Foram esses que a gente leu e analisou
Resultado
O tom dos tweets
Cada quadradinho é um dos 1.022 tweets da decisão.
Negativo, neutro e positivo falam do tom do texto. Não dizem de que lado a pessoa está: dá para criticar Flávio Bolsonaro cheio de entusiasmo e sair como positivo.
Fora do ar
tweets já não abriam no X quando fizemos a coleta. A plataforma só avisa "tweet não encontrado ou excluído" e não diz por quê. Pode ter sido o próprio autor, a ordem judicial, uma conta suspensa ou um perfil que virou privado.
Perfis com mais tweets fora do ar
Quem mais aparece
Os perfis mais citados
Quantos tweets de cada perfil entraram na decisão, com a cor do tom de cada um. Clique no nome para ler.
Do que se fala
Palavras mais frequentes
Quantas vezes cada palavra aparece nos tweets que ainda estavam no ar. Clique para filtrar a lista.
Hashtags
Quase ninguém usou hashtag
Nenhuma hashtag aparece em mais de dois tweets. O assunto circulou em respostas e comentários soltos, sem uma tag puxando a conversa.
Na íntegra
Todos os tweets da decisão
Procure uma palavra ou um @perfil, filtre pelo tom e abra o original no X.
Metodologia
Como medimos o tom de cada tweet
Usamos o VADER (Valence Aware Dictionary and sEntiment Reasoner), criado em 2014 por C. J. Hutto e Eric Gilbert para ler textos de redes sociais. O nome é comprido, mas a ideia é simples. Nada de IA treinada: é um dicionário em que cada palavra tem uma nota, mais algumas regras de bom senso.
Essas regras entendem negação ("não é bom"), reforço ("muito ruim"), CAIXA ALTA, exclamações e emojis. Também sabem que, depois de um "mas", o que vem em seguida pesa mais.
O VADER original só entende inglês. Por isso usamos o LeIA (Léxico para Inferência Adaptada), versão com o dicionário traduzido e ajustado para o português, mantida por Rafael Almeida.
A régua
Um número de −1 a +1
Para cada texto, o VADER devolve quatro números. Três dizem quanto do texto é negativo
(neg), neutro (neu) e positivo (pos), e somam 1. O
quarto,
o compound, junta tudo numa nota só, de −1 (muito negativo) a +1 (muito
positivo).
É essa nota que decide a categoria de cada tweet.
Aqui, negativo é tudo que fica em −0,25 ou abaixo, e positivo, a partir de +0,20. O VADER costuma usar ±0,05. Com essa régua apertada, uma palavra solta como "ataque" ou "guerra" já jogaria o tweet para o lado negativo. Alargando a faixa do meio, notícias, links e comentários mornos ficam no neutro, que é onde devem estar.
Distribuição
Como os – tweets se espalham na régua
Na prática
Três tweets reais e suas notas
O mais negativo, o mais positivo e um neutro. Os dois extremos batem no mesmo alvo. Só muda o tom.
Cuidados
O que o VADER não enxerga
- Tom não é opinião. A nota mostra se o texto soa positivo ou negativo, e só. Ela não sabe se a pessoa é contra ou a favor de alguém.
- Ironia engana. Um "parabéns, Flávio" cheio de sarcasmo pode virar positivo.
- Gíria e meme passam batido. Palavra que não está no dicionário vale zero.
- Só o texto conta. Foto, vídeo e link ficam de fora, e um tweet que é só uma imagem recebe nota 0.
- Resposta curta perde o contexto. Um "exatamente isso" é lido sem o tweet a que responde.
Por isso a nota ajuda a enxergar o conjunto. Para julgar um tweet sozinho, o melhor ainda é ler o tweet.
Coleta
Passo a passo
- Tiramos da decisão os 1.022 links de tweets.
- Abrimos cada link e guardamos o autor, o texto, as hashtags e se o tweet ainda estava no ar.
- Passamos o VADER/LeIA em cada tweet disponível e guardamos as quatro notas.
- Separamos os tweets pela nota
compound, usando a régua acima, e contamos as palavras mais usadas (sem contar "de", "que", "o" e parecidas).
Quer refazer as contas? Os dados brutos estão aqui: