News26 JulhoVelocidade virou a prioridade, não inteligência
Edição #164·26 de julho de 2026·2 min

Velocidade virou a prioridade, não inteligência

Zara Zhang colocou em palavras algo que muita gente já sente na prática: a inteligência dos modelos de IA já é boa o suficiente. O que falta agora é velocidade. Esperar de 1 a 5 minutos por tarefa é o pior cenário possível: tempo curto demais para mergulhar em trabalho profundo, mas longo demais para ficar olhando a tela. Resultado? Você acaba rolando o feed do X enquanto espera. --- A observação dela tem um ponto ácido e certeiro: agentes de IA estão nos deixando mais dispersos. A ironia é que uma ferramenta criada para aumentar produtividade pode estar treinando nosso cérebro para não tolerar nem dois minutos de espera. Se os próximos modelos não resolverem a latência, a inteligência extra vai servir de pouco.

A corrida dos grandes modelos de linguagem (LLMs) passou por uma mudança de eixo. Se, até pouco tempo atrás, o debate se concentrava em quem detinha o maior context window ou o melhor desempenho em benchmarks de raciocínio, hoje o critério decisivo para adoção em produção é outro: latência. A análise da pesquisadora e builder Zara Zhang resume o momento — a inteligência dos agentes de IA já é suficiente para grande parte das tarefas reais; o que falta agora é velocidade.

A armadilha dos minutos mortos

Zhang aponta um efeito colateral pouco discutido: a janela de um a cinco minutos de espera é a pior possível para o fluxo de trabalho. O período é curto demais para iniciar trabalho profundo, mas longo demais para manter o foco. O resultado é um ciclo de fragmentação atencional — o desenvolvedor alterna entre a IDE e distrações externas, perdendo o estado de flow necessário para resolver problemas complexos. Em vez de acelerar entregas, o agente introduz ruído cognitivo.

Do benchmark à experiência real

O problema não é teórico. Em pipelines de desenvolvimento que dependem de geração de código, review automatizado ou execução de testes por IA, cada segundo de latência afeta o feedback loop. Para startups e equipes brasileiras que operam com margens apertadas de produtividade, essa fricção tem custo direto. A developer experience (DX) deixa de ser detalhe de interface e vira limitação de infraestrutura. Otimizações de inference, caching de respostas e arquiteturas de edge computing deixam de ser diferenciais técnicos para virar necessidades operacionais.

O próximo campo de batalha

A ironia, como Zhang observa, é que ferramentas criadas para aumentar o output podem estar condicionando o cérebro a rejeitar qualquer intervalo de espera. Se os próximos lançamentos não reduzirem o tempo de resposta, ganhos de inteligência — como melhorias em chain-of-thought ou fine-tuning especializado — terão impacto limitado. Para builders brasileiros, a lição é clara: avaliar um modelo apenas pela capacidade cognitiva é insuficiente. A métrica que importa agora é quanto tempo ele economiza, não apenas quanto acerta.

tempozhangnãopoucolatênciainteligênciaagoraminutosesperatrabalho

Mais da mesma edição

@rauchg

📁CEO da Vercel trocou apps de pesquisa por uma pasta e um agente

Guillermo Rauch, CEO da Vercel, compartilhou uma abordagem que parece simples demais pra funcionar, mas funciona. Ele abandonou aplicativos de pesquisa, grafos de conhecimento e interfaces sofisticadas. No lugar, criou uma pasta chamada 'research' no computador, escreveu um arquivo de texto descrevendo o formato que prefere e as boas práticas, e pronto: quando quer pesquisar qualquer assunto, lança um agente de IA direto no terminal e faz a pergunta. --- O mais interessante é a escala do negócio. O agente consegue buscar e cruzar informações de sessões anteriores, a pasta pode ser sincronizada via iCloud ou Git, e se Guillermo quiser compartilhar o resultado com alguém, pede pro agente montar um relatório em HTML e publicar. O 'software' que roda tudo isso é, nas palavras dele, inglês escrito num arquivo de texto. --- É o tipo de solução que faz a gente pensar: será que estamos complicando demais as ferramentas de produtividade? Às vezes o melhor app é nenhum app.

@GergelyOrosz

🔍Engenheiro veterano para de revisar código gerado por IA

Gergely Orosz, autor do The Pragmatic Engineer e referência na comunidade de engenharia de software, trouxe um relato que incomoda. Ele conversou com um engenheiro muito experiente que, até pouco tempo, revisava todo o código gerado por IA. Até que percebeu que o código estava bom o suficiente para ser inútil ficar revisando tudo, e decidiu parar, exceto para partes críticas do produto. --- O detalhe que pesa: estamos falando de alguém que passou a carreira inteira revisando o próprio código e o dos colegas. Não é um júnior empolgado com novidade. É alguém que entende profundamente o valor da revisão e, mesmo assim, concluiu que o custo-benefício não fecha mais. --- O próprio Gergely admite que não sabe o que vai substituir a revisão de código. Algo precisa entrar no lugar, porque revisão não é só sobre pegar bugs: é sobre transferência de conhecimento, padrão de qualidade e alinhamento do time. Se ela desaparece, o que sobra?

@vboykis

⚠️O risco silencioso de programadores que nunca revisaram nada

Vicki Boykis, engenheira de machine learning, levantou uma preocupação que complementa o debate sobre o fim das revisões de código: o que acontece com programadores juniores que começam a carreira usando agentes de IA desde o primeiro dia e nunca precisam construir aquele instinto de arquitetura e gestão de código na marra? --- Ela compartilhou a reflexão respondendo a um post de Salvatore Sanfilippo, o criador do Redis, sobre a importância de desenvolver o que chamou de 'simpatia mecânica', aquela intuição que só se constrói errando muito. Vicki argumenta que a analogia do compilador, que muita gente usa para justificar que IA é só mais uma camada de abstração, não funciona bem aqui: código de baixo nível é diferente de substituir código por inglês. --- É um ponto que vale a reflexão. Ferramentas que eliminam atrito são ótimas, mas habilidades que só nascem do atrito podem estar desaparecendo junto.

Receba no seu email

Todo dia, grátis pra sempre.

Assinar newsletter