1. Uma IA transformou o mascote de um site em personagem inventado
Um site pequeno usava IA para produzir artigos sem parar. Alguns textos comparavam personalidades com personagens de Chiikawa, especialmente Hachiware. Quando alguém perguntou a outra IA sobre o mascote do site, ela sugeriu que fosse um suposto “Hachiware problemático” da obra.
Quem é esse cidadão?
O personagem original do site recebeu um papel em outra história sem currículo, entrevista nem aviso prévio. Foi uma contratação feita inteiramente pela IA.
O fato confirmado nessa história é que a resposta foi dada. Não sabemos se a IA leu os artigos, se associou nomes ou se simplesmente inventou. Também não há prova aqui de que essa descrição corresponda a um personagem oficial. Uma resposta confiante não é a mesma coisa que uma informação verificada.
2. Enquanto isso, a fábrica de artigos trabalha sem parar
O processo escreve textos, melhora a clareza, prepara versões completas em doze idiomas, faz verificações, publica e distribui links. Se uma etapa trava, outro processo investiga, corrige e verifica de novo.
Logo, os relatórios viram entretenimento próprio.
IA A: “Corrigi a publicação.”
IA B: “Os testes passaram.”
IA C: “Encontrei outro motivo para a parada.”
Supervisor: “Chamem mais um responsável pelo conserto.”
Leitor: “Daqui a pouco o relatório vai ter mais capítulos que os artigos.”
A diferença importante é simples: salvar uma correção não comprova que a página pública já está funcionando. A fábrica de conteúdo também precisa ser uma oficina de manutenção.
3. “Já são 1.900 artigos?” Depende do que foi contado
Existem pelo menos cinco contagens diferentes:
- Artigos originais: textos com ideias independentes.
- Páginas por idioma: versões de um mesmo artigo em línguas diferentes.
- Prontos, mas não publicados: textos aguardando revisão ou envio.
- Publicados: páginas que o leitor realmente consegue abrir.
- Rotas do site: podem incluir menus, aplicativos e páginas que nem são artigos.
Por exemplo, 1.000 artigos originais publicados em doze idiomas podem gerar até 12.000 páginas localizadas. Não são 12.000 ideias diferentes.
Um registro de operação mostrou 15.862 rotas, mas isso não significava 15.862 artigos originais em japonês. Uma alegação como “1.900 artigos” só pode ser analisada com data, unidade e estado de publicação. Somar tudo é uma ótima maneira de assustar a equipe de estatística.
4. E o repositório do GitHub chegou a cerca de 2,46 GB
Em um caso anonimizado, os dados do GitHub indicavam 2.400.972 KiB, ou aproximadamente 2,29 GiB e 2,46 GB em unidades decimais, em 8 de outubro de 2026.
“Mas artigo não é só texto?”
O repositório também pode guardar programas, traduções, índices de publicação, resultados de verificações, imagens, áudio e histórico de alterações. Ainda assim, não dá para dizer qual categoria ocupou mais espaço olhando apenas o total. Isso exige uma análise separada. O valor informado pelo GitHub também não equivale necessariamente ao tamanho de uma pasta local.
Artigo: “Tenho só alguns KB.”
Histórico: “Guardei suas versões antigas.”
Traduções: “Trouxe mais onze amigos.”
Depósito: “Ninguém me avisou!”
5. A resposta: GitHub Free não significa “5 GB no total e depois paga”
Para repositórios Git comuns, o GitHub não anuncia uma cota única e universal de armazenamento gratuito que passe a cobrar automaticamente ao atingir certo total de GB. Cinco gigabytes são uma recomendação de tamanho, não um gatilho de cobrança.
A documentação diz que o ideal é ficar abaixo de 1 GB e recomenda fortemente ficar abaixo de 5 GB. Outro documento recomenda um máximo de 10 GB no disco para os dados compactados do Git. Isso não é uma garantia contratual de 10 GB gratuitos.
Se um repositório prejudicar o desempenho do serviço, o GitHub pode pedir mudanças. Portanto, tanto “passou de 5 GB, pagou” quanto “é grátis, então cabe infinito” estão errados.
6. Os limites de verdade pertencem a caixas diferentes
| Recurso | Limite ou franquia gratuita |
|---|---|
| Repositório Git comum | Sem cobrança automática por uma cota total única; ideal abaixo de 1 GB, fortemente recomendado abaixo de 5 GB |
| Dados Git no disco | Máximo recomendado de 10 GB, não um limite para cobrança |
| Um arquivo comum | Aviso acima de 50 MiB, bloqueio acima de 100 MiB; envio pelo navegador até 25 MiB |
| Um envio de alterações | Limite de 2 GiB |
| Git LFS para arquivos grandes | GitHub Free inclui 10 GiB para armazenamento e 10 GiB para transferência; separado do Git comum |
| Resultados do GitHub Actions | GitHub Free inclui 500 MB de armazenamento; normalmente há 2.000 minutos de execução por mês |
Não é tudo uma mesma carteira. O uso além da franquia de LFS, Actions e outros produtos depende de regras e orçamentos próprios. Um repositório comum com 2,46 GB não gastou automaticamente os 500 MB do Actions. E ficar abaixo de 5 GB no Git não garante que as outras franquias estejam disponíveis.
7. Por que o repositório cresce mais rápido que a contagem de textos
O Git armazena arquivos atuais e o histórico das mudanças. Um índice enorme regravado a cada hora pode aparecer como um arquivo só na versão recente, enquanto versões antigas continuam no histórico. Some revisões, traduções refeitas, registros de testes e arquivos de saída repetidos: o crescimento deixa de acompanhar a quantidade de novos artigos.
Mas o Git também compacta conteúdo e guarda versões parecidas com eficiência. Uma edição não significa que o tamanho necessariamente dobrou. É preciso medir os maiores responsáveis.
Artigos originais e código, cujas alterações precisam ser acompanhadas, costumam fazer sentido no Git. Resultados descartáveis e mídias grandes podem, conforme o caso, ficar em outro armazenamento.
8. Os conflitos entre processos podem aparecer antes da falta de espaço
Quando várias IAs tentam editar o mesmo arquivo quase ao mesmo tempo, podem ocorrer conflitos. Uma correção termina, mas outro processo consulta um índice de publicação antigo. O artigo ficou pronto e o site público continua desatualizado.
Não é correto chamar tudo isso de “GitHub lotado”. Volume, frequência de alterações, concorrência e publicação são problemas distintos.
A ordem de verificação é: existe o texto mais recente? Passou nos testes? Foi enviado para publicação? A página pública mostra exatamente essa versão? A comemoração deveria ficar para a quarta resposta.
9. Quatro cuidados para manter a operação gratuita
Medir antes de apagar. Investigue arquivos grandes e histórico, não só o número apresentado na página. O próprio GitHub aponta para ferramentas como git-sizer.
Separar arquivos temporários. Índices gerados repetidamente, registros descartáveis, imagens e áudios nem sempre precisam ficar eternamente no histórico Git.
Evitar regravações desnecessárias. Alterações que não afetam o conteúdo não deveriam reconstruir um índice enorme. Depois de um conflito, releia o estado atual e confirme o resultado real.
Cuidado ao reescrever o histórico. Apagar um arquivo da versão atual pode deixar cópias em versões antigas. Alterar o histórico compartilhado pode quebrar referências; avalie o impacto e guarde uma cópia segura.
10. Mais artigos não significam automaticamente mais valor
Milhares de originais e dezenas de milhares de páginas traduzidas não garantem leitores. As páginas podem ser encontradas? Os fatos estão corretos? A leitura é natural em cada idioma? Existe valor novo ou apenas repetição?
As orientações públicas do Google priorizam conteúdo útil, original e feito para pessoas. Também tratam como problema a produção em massa de páginas sem valor cujo principal objetivo seja manipular resultados de busca. O problema não é simplesmente usar IA, mas publicar em escala sem ajudar o leitor.
O suposto “Hachiware problemático” fecha a história: uma invenção da IA pode render uma ótima piada, mas não deve virar informação oficial.
Fábrica: “Vou aumentar os artigos.”
GitHub: “Vou guardar mais versões.”
Revisor: “Vou diminuir os erros.”
IA de busca: “Vou aumentar o elenco!”
Todos: “Esse aumento ninguém pediu!”
Em resumo: 5 GB não são a barreira de pagamento do GitHub Free. Tamanho, publicação, qualidade e afirmações da IA exigem verificações separadas. O resultado mais importante é o conteúdo confiável que realmente chega aos leitores.
