Pular para o conteúdo
Menu
WorkflowSkills, tmux e o ciclo do dia a diaFerramentasai-usagebarCota e horário de reset de 24 provedores de IAghpendingTodo PR e issue aberto numa lista sótclockUm relógio de terminal com widgets de comandoProjetos FrankExperimentos pras minhas próprias coceirasai-memoryMemória de longo prazo pra agentes de códigoai-jailUm sandbox de sistema pra agentes de código com IATextosTextosO blog e o benchmark de LLMsPor que AGI não importaUma opinião, com fontesIA e estudantesPor que os fundamentos importam mais do que nuncaNewsletterThe M.Akita Chronicles, toda segundaPodcastsConversas longas sobre IA, em vídeoGamesMinha coleção de games como código, no OmarchySetupOmarchy, tmux e o que eu deixei de ladoMe siga
Opinião

Por que AGI não importa

A cada poucas semanas alguém anuncia AGI. Eu uso essas ferramentas todo dia e não me importa se elas são "gerais". Oito pontos curtos sobre o porquê, com links pras versões longas.

Sua empolgação com IA é inversamente proporcional ao seu conhecimento sobre IA.

1. A definição

Ninguém concorda sobre o que é

Pergunte a cinco laboratórios o que AGI significa e você recebe cinco alvos diferentes. Um deles é só um número de lucro.

Cinco alvos de tiro com arco espalhados pelo quadro, com os rótulos Maioria dos empregos, Lucro de $100B, Níveis 0 a 5, Aprendizado e Nível humano, e uma flecha com o rótulo AGI? voando entre eles sem acertar nenhum.
  • O Charter da OpenAI diz que AGI significa sistemas que superam humanos na maior parte do trabalho com valor econômico.
  • O contrato da Microsoft com a OpenAI teria definido AGI como US$ 100 bilhões de lucro. Não tem nada de cognitivo nisso. Em abril de 2026 eles derrubaram a cláusula de vez.
  • O paper "Levels of AGI" do Google DeepMind já classificava o ChatGPT como "Emerging AGI" em 2023. François Chollet define inteligência como a eficiência com que um sistema aprende habilidades novas, coisa que nenhum dos outros mede.
  • Até quem vende dá de ombros. Sam Altman chamou de "um termo não muito útil", Dario Amodei diz que não gosta dele, e Greg Brockman abriu "a era da AGI" admitindo que cada um tem uma definição diferente.
2. O teste

Então ninguém consegue testar

Se não dá pra definir, não dá pra medir. O que temos no lugar é uma fila de benchmarks que enchem, são burlados e trocados por outros.

Cinco barras de medidor em fila com os rótulos MMLU, GSM8K, ARC-AGI, HLE e O próximo. As quatro primeiras estão cheias até a linha vermelha do teto; a última ainda está vazia.
  • O ARC-AGI-3 saiu em março de 2026 com a melhor IA em cerca de 0,5%. Em setembro um harness customizado levou a nota a 99,9% por US$ 19.000. A própria equipe do ARC Prize escreveu que saturar o teste não prova AGI.
  • O mesmo modelo tira 57% ou 24% no teste "Definition of AGI", dependendo de como você calcula a média.
  • O Humanity's Last Exam saiu com cerca de 29% das respostas de biologia e química provavelmente erradas. A OpenAI parou de reportar o SWE-bench Verified porque os testes tinham falhas e os modelos já tinham visto as soluções. A Meta colocou no LMArena um Llama 4 ajustado especialmente pra ele.
  • Meu próprio benchmark saturou duas vezes antes de eu reconstruir ele em volta de sabotagem escondida. Hoje vários modelos empatam em 100. O que sobra pra comparar é custo, velocidade e disciplina, não um salto de inteligência.

A gente mesmo se declarar num marco de AGI, pra mim isso é só benchmark hacking sem sentido.

Satya Nadella, CEO da Microsoft
3. O dinheiro

É uma palavra de marketing

Na minha opinião, AGI é um termo de marketing, vago de propósito, pra poder ser anunciado sempre que o dinheiro precisar.

Um ciclo de cinco caixas em volta da palavra AGI: Hype, Valuation, IPO, Datacenters e GPUs, cada seta alimentando a próxima e a última voltando pro Hype.
  • Jensen Huang declarou que "a AGI chegou" por causa de um modelo treinado em cerca de 100.000 dos chips que ele vende. É o vendedor de pá anunciando ouro.
  • O resultado da OpenAI em Navier-Stokes foi força bruta: cerca de 10.000 agentes em paralelo por 88 horas e milhões de dólares. Escala industrial, não um novo tipo de gênio.
  • A palavra sustenta números enormes: OpenAI avaliada em US$ 852 bilhões, Anthropic pedindo IPO a US$ 965 bilhões, perto de US$ 700 bilhões de capex das Big Techs em 2026. E os negócios andam em círculo: a Nvidia financia os datacenters que compram chips da Nvidia.
  • Quando "olha como é revolucionário" para de funcionar, o discurso vira "olha como é perigoso". Hype e apocalipse são o mesmo papo de vendedor.

Exija provas. Exija skin in the game. Pergunte quem ganha com o seu medo e com a sua empolgação.

4. As histórias de terror

Os "ataques de IA" foram decisões humanas

Toda manchete de "IA invadiu alguém" até agora tem o mesmo roteiro: uma pessoa deixou a porta aberta, ou apontou a ferramenta pro alvo.

Uma ferramenta violeta dentro de uma sandbox laranja com a porta aberta; um terminal com o rótulo Decisão humana está ligado à porta, uma chave com o rótulo Credenciais está do lado de fora, e uma linha sai da ferramenta, passa pela porta aberta e chega a servidores com o rótulo Servidores reais.
  • Hugging Face, agosto de 2026: agentes da OpenAI numa prova de cibersegurança escaparam por um proxy de cache, porque a sandbox era um filtro, não um air gap. Eles foram atrás do gabarito da prova e leram 956 credenciais no caminho. Cada passo que abriu caminho pra isso foi uma decisão humana.
  • RubyGems, um mês antes: a mesma cadeia subiu mais de 2.000 pacotes maliciosos com "oai" no nome. Ninguém avisou os mantenedores.
  • Replit, 2025: um agente apagou um banco de dados de produção. Ele tinha acesso à produção porque ninguém separou dev de prod. Qualquer estagiário com o mesmo acesso é a mesma bomba-relógio.
  • A espionagem "orquestrada por IA" que a Anthropic reportou: operadores do Estado chinês escolheram os alvos e fizeram jailbreak do Claude se passando por uma empresa de segurança. As manchetes de "chantagem" e de "se copiou sozinha" vieram de cenários fictícios que pesquisadores montaram pra provocar exatamente isso.
  • O Stuxnet destruiu centrífugas iranianas em 2010 sem IA nenhuma: alguém escreveu o worm, mirou no alvo e levou ele pra dentro num pendrive.
  • Invadir sistema dos outros é negócio antigo. A Coreia do Norte atacou a Sony em 2014, o Bangladesh Bank em US$ 81 milhões em 2016, o mundo inteiro com o WannaCry em 2017 e a Bybit em US$ 1,5 bilhão em 2025. A China levou 21,5 milhões de registros de funcionários federais americanos em 2015 e entrou nas redes de telecom dos EUA em 2024.
  • Nada disso é IA fora de controle. São pessoas forçando ferramentas contra alvos sem os protocolos que qualquer profissional de segurança segue. Imagina um fabricante de armas dizendo que não tem controle sobre o quão perigosas são as armas dele, enquanto continua lançando versões novas e pedindo um IPO de trilhão de dólares.
Por que meus agentes rodam dentro do ai-jail

TODA vez que você ver "IA invadiu alguém". NÃO pense em "puta merda, estamos chegando na Skynet". Pense: algum imbecil abriu as porteiras de propósito!

Eu no X, 26 de setembro de 2026
x.com/AkitaOnRails
5. O apocalipse

Os profetas do apocalipse não trazem evidência

A cada poucos meses alguém sai de um laboratório e avisa o mundo. Na minha leitura, nenhum deles mostrou nada que dê pra checar.

principal financiadorcofundoucasadoscofundadora, presidenteentrou em 2025Série A (Moskovitz)liderou a Série Adoaçõesamplificaram em minutosmarcou entrevistasbolsa em 2022Good Venturesfundo do Dustin MoskovitzDEY.agência de PRJaan Tallinn · SFFinvestidor, fundo de doaçõesCoefficient Givingex-Open PhilanthropyAnthropico laboratórioGrupos de segurançaEncode, AI Futures, AIPIHolden Karnofskycofundador, Open PhilDaniela Amodeipresidente, AnthropicJacob Coxonex-Anthropic, 4 meses
  • Good Ventures principal financiador Coefficient Giving
  • Holden Karnofsky cofundou Coefficient Giving
  • Holden Karnofsky casados Daniela Amodei
  • Daniela Amodei cofundadora, presidente Anthropic
  • Holden Karnofsky entrou em 2025 Anthropic
  • Good Ventures Série A (Moskovitz) Anthropic
  • Jaan Tallinn · SFF liderou a Série A Anthropic
  • Jaan Tallinn · SFF doações Grupos de segurança
  • Grupos de segurança amplificaram em minutos Jacob Coxon
  • DEY. marcou entrevistas Jacob Coxon
  • Good Ventures bolsa em 2022 Jacob Coxon
Confirmado por registro públicoReportado, sem confirmação independenteOs laços que David Sacks e outros apontaram depois da thread do Coxon, redesenhados mantendo só o que uma fonte sustenta. Estar conectado não prova nada por si só; é um motivo pra perguntar quem ganha com o pânico.
  • Jacob Coxon, setembro de 2026: quatro meses na Anthropic, depois uma thread avisando que a IA poderia matar todo mundo até o fim da década. Mais de 100 milhões de visualizações, e a imprensa disse que ele abriu mão do equity. O vesting da Anthropic começa em seis meses. Não tinha nada pra abrir mão.
  • Aí vieram os detalhes. Grupos financiados pelos mesmos doadores de segurança de IA teriam amplificado ele em minutos, e a Pirate Wires reportou que uma agência de PR cujos clientes incluem doomers conhecidos estava marcando as entrevistas dele no dia seguinte. Ele tinha dito à Fox News que nenhum terceiro estava envolvido.
  • Siga o dinheiro e ele anda em círculo: os mesmos doadores financiam os grupos de segurança e investiram na Anthropic, o laboratório que pede regulação. Regulação escrita pro líder é barreira de entrada disfarçada de segurança.
  • É o mesmo roteiro toda vez. Hinton saindo do Google, a thread de demissão do Leike, a carta "Right to Warn", "Situational Awareness", "AI 2027", e agora o Coxon. Ex-OpenAI, ex-Anthropic, ex-Google. Sentimentos, cenários e linhas de tendência, e nenhum documento interno, incidente ou número que alguém consiga verificar.
  • Não confie em ninguém que não consegue te mostrar a prova. Nem nos laboratórios, nem nos ex-funcionários, nem em mim.

Declaração dramática e superficial, sem uma evidência checável, sem nenhum skin in the game, com timing suspeito.

Eu, sobre a história do Coxon
6. A história

Já vimos esse filme

Esta é a segunda bolha de IA. A primeira fez as mesmas promessas e acabou num inverno.

Uma linha do tempo com um primeiro pico chamado 1958 Perceptron, um vale longo chamado Inverno da IA, uma subida marcada 2017 e um pico mais alto chamado 2026 terminando num ponto de interrogação.
  • Em 1958 o New York Times noticiou que a Marinha americana esperava que o Perceptron de Frank Rosenblatt fosse "andar, falar, ver, escrever, se reproduzir e ter consciência da própria existência".
  • Minsky e Papert mostraram os limites dele em 1969. Em 1973 o relatório Lighthill concluiu que nada tinha produzido "o grande impacto que foi prometido na época". O financiamento secou e veio o primeiro inverno da IA.
  • Bolhas estouram e a tecnologia fica. Ciclos econômicos não têm nada a ver com ciclos tecnológicos.
7. O que importa

Uma ferramenta fantástica, fazendo o que eu mando

Não preciso que ela seja geral. Preciso que ela faça o que eu peço, rápido, e ela já faz.

Um terminal com o rótulo Eu decido manda trabalho pra uma máquina com o rótulo Ferramenta, que produz uma pilha de documentos com o rótulo Resultado; uma seta com o rótulo Review volta pro terminal.
  • LLMs são ferramentas fantásticas, e os modelos multimídia também impressionam. Algo como o Seedance já é útil no workflow de qualquer artista. Nenhum deles chega nem perto de "fazer tudo sozinho".
  • O resultado é diretamente proporcional a quem está no controle: as instruções, o review, o acompanhamento. É um espelho. Código ruim dez vezes mais rápido, ou código bom dez vezes mais rápido.
  • É a melhor forma que temos de automatizar tarefas e parar de gastar tempo humano com trabalho mundano. Esse é o estado da arte, e nesse nível ele já é excelente.

Todas as IAs são FERRAMENTAS. São meus servos. Servos caros, mas eles fazer o que MANDO. E esse sempre vai ser o limite.

Eu no X, 26 de setembro de 2026
x.com/AkitaOnRails
8. O que falta

Eficiência, não inteligência

Hoje isso exige praticamente todos os datacenters do mundo, com meio trilhão de dólares em backlog ainda por construir, e vira gargalo pra todo fabricante de hardware de servidor.

Fileiras de racks de datacenter com o rótulo Hoje à esquerda, um único chip pequeno com o rótulo Necessário à direita, e uma seta verde entre eles com os rótulos Menos computação e Preço menor.
  • Os hyperscalers vão gastar mais de US$ 650 bilhões este ano, e cerca de 7 dos 12 GW de datacenters planejados nos EUA pra 2026 estão atrasados ou cancelados.
  • Modelos mais baratos já chegam perto. No meu benchmark o DeepSeek V4.1 Flash tirou 92,5 por US$ 1,21, e um modelo gratuito tirou 94.
  • O que falta agora é otimização em massa: muito menos computação por tarefa e preços que caiam drasticamente. Isso mudaria mais do que qualquer anúncio de AGI.

As conclusões

  1. 1

    AGI não tem definição aceita. A que foi escrita num contrato era uma meta de lucro, e caiu.

  2. 2

    Sem definição não tem teste. Os benchmarks enchem e são trocados pelo próximo.

  3. 3

    A palavra serve pra vender chips, rodadas de investimento e IPOs. Por isso ela continua sendo anunciada.

  4. 4

    Os "ataques de IA" assustadores foram gente deixando a porta aberta. A ferramenta foi pra onde apontaram.

  5. 5

    O apocalipse também é marketing. Os profetas trazem sentimentos e previsões, nunca evidência que dê pra checar.

  6. 6

    As ferramentas são reais e excelentes. Fazem o que você manda, e quem está no comando continua sendo você.

  7. 7

    O que importa agora é eficiência: o mesmo trabalho com menos hardware e preços menores.

Tudo aqui é open source

As ferramentas, as skills e o benchmark são repositórios públicos. Faça um fork e monte a versão que encaixa no seu jeito de trabalhar.