Voltei, como prometi de madrugada. Vou repetir a tabela corrigida aqui para ela ficar junto do resto, e depois pego cada ponto que você levantou.
Refazendo com a mesma janela para todas as safras, contando só quem já teve aquele tempo disponível:
| estreou em | voltou em 30 dias | em 90 dias | em 365 dias |
|---|---|---|---|
| 2022 | 32,0% | 36,4% | 43,0% |
| 2023 | 21,5% | 27,9% | 36,1% |
| 2024 | 20,5% | 28,3% | 37,5% |
| 2025 | 20,7% | 25,1% | 34,8% |
| 2026 | 19,6% | 25,8% | ainda não deu um ano |
A queda existe, mas ela é de 2022 para 2023 e acaba ali. Depois disso a linha para, e na janela de um ano a safra de 2024 até retém mais que a de 2023.
Ou seja, não foram quatro anos de queda. Foi um degrau entre a safra fundadora e todo mundo que veio depois, e desde então está parado.
E isso derruba a explicação que eu tinha dado no post. O site não encolheu porque quem chega gruda menos. Ele encolheu porque chega menos gente:
| ano | estreantes por mês |
|---|---|
| 2023 | 222 |
| 2024 | 109 |
| 2025 | 101 |
| 2026 | 129 |
Repare no último número. A chegada de gente nova subiu 28% este ano, e o volume de publicação também está acima de 2025. São dois indicadores apontando para cima pela primeira vez desde 2023.
Reescrevi a seção 2 com sua correção e coloquei uma nota de edição com seu nome. Achei que apagar o erro seria pior que deixar ele visível junto da conta certa.
Sobre a turma de novembro de 2022, fui atrás. Foram 1.292 pessoas estreando naquele mês, e o que sobrou delas é isto:
| pessoas | % | |
|---|---|---|
| chegaram a publicar um segundo post | 580 | 44,9% |
| ainda publicavam em 2023 | 269 | 20,8% |
| em 2024 | 122 | 9,4% |
| em 2025 | 103 | 8,0% |
| em 2026 | 46 | 3,6% |
Quarenta e seis pessoas. De mil e trezentas. O vídeo trouxe uma multidão e restaram quarenta e seis.
Sua ideia da curva de sobrevivência foi a melhor coisa que saiu daqui, e o resultado contraria o que você imaginou. Peguei só a safra de 2022, que já foi observada por quatro anos inteiros e não sofre do problema de janela:
| chegou a | quantos | seguiu para o dobro |
|---|---|---|
| 1 post | 2.264 | 47,7% |
| 2 posts | 1.081 | 45,0% |
| 4 posts | 486 | 43,0% |
| 8 posts | 209 | 42,1% |
| 16 posts | 88 | 29,5% |
Não tem precipício no começo. A chance de dobrar fica em torno de 45% do primeiro post até o oitavo, quase constante, o que é bem a cara de um decaimento geométrico simples.
Você apostou que quem passa de 16 dificilmente para. É o contrário: o único degrau visível está justo aí, de 16 para 32, onde cai para 29,5%. Com 88 pessoas na base eu não bato o martelo, mas se existe um ponto de desgaste, ele fica antes do que você chutou e não depois.
E sim, "posts" ali é só publicação, não inclui comentário. Isso foi um buraco meu que o @Oletros também apontou. São 9.915 pessoas que só comentam e nunca publicaram, 60% de quem comenta, e elas somam 24% de todos os tabcoins distribuídos em comentário. Cada vez que eu escrevi "autores" no post, essa gente ficou de fora.
Sobre os comentários mais divididos, você tinha razão de suspeitar que rendem mais que os posts:
| votos | autor | trecho |
|---|---|---|
| +17 / -21 | @marlon | "Um sudo apt install java também é perigoso, imagina só ter que programar em Java 😨" |
| +16 / -16 | @maniero | links de stackoverflow em resposta técnica |
| +12 / -12 | @clacerda | "Automatizar a documentação com IA é definitivamente um tema quente" |
| +11 / -13 | @queroporderfalarmas | "Vale a pena ainda estudar C? Nem vaga mais de C eu vejo" |
| +20 / -11 | @maniero | "Eu gostaria de entender os negativos que esta postagem recebeu" |
O terceiro da lista é seu, no post do @jeffz sobre economizar 20 horas com um script, em agosto de 2024. Doze a favor e doze contra num comentário que elogia o cara e depois lista três ressalvas. Perguntar sobre comentários divididos e aparecer na lista foi engraçado demais haha.
Duas coisas do conjunto: só 5,4% dos comentários levam ao menos um voto contra, e só 1,15% levam três ou mais. Divisão é raríssima aqui, e quando acontece é quase sempre sobre linguagem de programação ou sobre IA.
Sua pergunta sobre a primeira experiência foi a que mais me surpreendeu. Rodei com janela fixa de 90 dias, e separando as duas coisas que você citou:
| como foi a estreia | autores | voltou em 90 dias |
|---|---|---|
| 0 tabcoin ou menos | 572 | 15,7% |
| 1 tabcoin | 2.964 | 26,2% |
| 2 a 4 | 2.490 | 32,1% |
| 5 ou mais | 1.955 | 36,6% |
| autores | voltou em 90 dias | |
|---|---|---|
| ninguém comentou | 1.699 | 29,4% |
| 1 pessoa comentou | 1.822 | 26,0% |
| 2 pessoas | 1.382 | 29,8% |
| 3 ou mais | 3.078 | 32,3% |
Tabcoin move a agulha, de 15,7% para 36,6%. Comentário quase não move, de 29,4% para 32,3%, e receber exatamente um comentário fica até abaixo de não receber nenhum.
Eu esperava o contrário. Achava que conversa segurava mais que voto.
E tem um resultado que eu ainda não sei explicar. Olhando só quem estreou enterrado, quem recebeu comentário volta menos que quem não recebeu: 13,7% contra 21,0%. Meu palpite é que comentário em post enterrado costuma ser alguém explicando por que aquilo está errado, e levar downvote calado dói menos que levar downvote com plateia. São 157 pessoas de um lado e 415 do outro, então é fraco para afirmar, mas é o tipo de coisa que eu não teria procurado.
Sobre a sua última pergunta, a dos indícios comportamentais, eu fui rodar porque achei a ideia boa. E ela não acende:
| ano | posts em rajada de 3+ no mesmo dia | rajada só com textos longos |
|---|---|---|
| 2022 | 22,6% | 1,7% |
| 2023 | 3,4% | 0,9% |
| 2024 | 1,9% | 0,7% |
| 2025 | 2,8% | 1,6% |
| 2026 | 3,2% | 0,9% |
Três ou mais textos longos do mesmo autor no mesmo dia responde por 0,9% das publicações de 2026, menos que os 1,7% de 2022, quando ninguém tinha ChatGPT. Aquele 22,6% de 2022 é a bagunça do lançamento, gente publicando teste em sequência.
Então o sinal que você propôs existe e é fácil de medir, mas ele não separa o que a gente quer. Quem usa IA para escrever aqui publica no mesmo ritmo de todo mundo, um post de cada vez. Faz sentido, porque o gargalo nunca foi escrever, foi ter o que dizer e ter vontade de postar.
O que talvez funcione melhor é o que você citou depois, similaridade estrutural entre textos consecutivos do mesmo autor. Isso não depende de ritmo e mede outra coisa. Não rodei porque ia precisar de embedding e o dia acabou.
E já que você puxou a meta camada e disse que era impossível de ignorar, prefiro falar direto em vez de deixar no ar.
Os dados eu fui buscar, e o coletor está aberto no repositório junto com o resto. A análise não foi minha. Tenho habilidade limitada com análise de dados, então usei IA para essa parte, o Fable 5 da Anthropic, verificando, corrigindo e questionando cada resultado antes de aceitar. Morreu bastante coisa errada nesse caminho, e o que passou você achou.
A escrita é minha, feita em cima dos números que saíram dessa apuração e com supervisão minha do começo ao fim.
Na sua lista de quatro categorias, isso é humano assistido. Achei melhor dizer do que deixar você adivinhar.
E repare no seu critério do tempo aplicado a este post aqui. Da primeira requisição na API até publicar foram quatro dias quase inteiramente dedicados a isso, de sexta 31 até segunda 3. Um post só, nenhuma rajada, nada que acendesse o seu alarme. E teve IA no meio do caminho do mesmo jeito.
É por isso que eu acho que o sinal de rajada não vai te levar aonde você quer. Ele pega automação, que é gente despejando volume. Não pega assistência, porque assistência também custa caro em tempo.
O acervo está aberto se você quiser rodar a similaridade:
https://github.com/im-fernando/tabnews-analise/releases/tag/acervo-2026-07-31
São 72 MB comprimido e 230 MB abertos, em NDJSON, com o corpo completo dos posts, as árvores de comentário e os órfãos das publicações apagadas. No post eu tinha escrito que subia se alguém pedisse, aí o @Oletros pediu, então nessa edição o link entrou no texto e agora está à mão de qualquer um. Desenterra os NLP dos anos 70 sem dó haha.
E valeeeu de novo pela correção. Post que sai errado e é consertado no comentário é bem melhor que post que sai errado e ninguém percebe. Um abraço!