News24 JulhoEthan Mollick publica guia prático de qual IA usar agora
Edição #162·24 de julho de 2026·2 min

🧭Ethan Mollick publica guia prático de qual IA usar agora

Ethan Mollick, professor da Wharton e uma das vozes mais sensatas sobre IA, publicou mais um de seus guias periódicos para quem não é especialista mas quer usar IA no dia a dia. O foco: os sistemas agenticos, aqueles que não só respondem perguntas mas agem por conta própria, que estão ficando extremamente poderosos. --- O próprio Mollick admite que está confuso com a quantidade de nomes, planos e funcionalidades que mudam toda semana. Pro, Ultra, Work, Codex: cada empresa parece competir para criar a nomenclatura mais incompreensível possível. O guia tenta colocar ordem nesse caos para quem só quer saber o que funciona de verdade. --- Se você está perdido com tantas opções de IA, esse é o tipo de recurso que vale salvar nos favoritos.

Ethan Mollick, professor da Wharton School, publicou um novo guia prático destinado a organizar o cenário atual de inteligências artificiais agenticas. O documento surge em um momento em que a velocidade de lançamentos de modelos como Claude, GPT-4o e ferramentas como Codex tornou a navegação pelo ecossistema uma tarefa confusa até para especialistas.

O que são sistemas agenticos e por que importam agora

Diferente dos chatbots conversacionais tradicionais, os sistemas agenticos representam uma mudança de paradigma: em vez de apenas processar prompts e gerar respostas, essas IAs executam ações autônomas, interagindo com APIs, navegadores e ambientes de desenvolvimento. Mollick destaca que essa capacidade está atingindo níveis de confiabilidade que permitem integração real em fluxos de trabalho produtivos, marcando uma evolução dos LLMs de assistentes para operadores de infraestrutura.

A torre de Babel das nomenclaturas

O mercado atual apresenta fragmentação complexa. Planos chamados Pro, Ultra, Enterprise, Work e ferramentas específicas como Codex (OpenAI) ou Claude Sonnet (Anthropic) atualizam funcionalidades semanalmente. Essa avalanche de nomes cria barreiras de adoção, especialmente para desenvolvedores brasileiros que precisam justificar investimentos em infraestrutura de IA e treinamento de equipes. O próprio Mollick reconheceu a dificuldade: "Eu mesmo fiquei confuso trabalhando no guia".

Implicações práticas para desenvolvedores

A confusão documentada pelo pesquisador reflete um desafio técnico concreto: como escolher a stack correta quando cada provedor promete capacidades agenticas distintas? Para builders brasileiros, o guia serve como filtro técnico, identificando quais sistemas realmente executam tarefas multi-etapas versus aqueles que apenas simulam autonomia através de prompts encadeados.

Pontos a considerar na avaliação de ferramentas agenticas:

  • Capacidade real de execução de código em sandbox versus geração estática de snippets
  • Consistência em workflows que exigem múltiplas chamadas de API sequenciais
  • Custo por token em processos agenticos, que consomem significativamente mais contexto que interações chat simples
  • Integração nativa com ambientes de desenvolvimento (IDEs) versus interfaces web isoladas

Em um mercado onde hype frequentemente mascara limitações técnicas reais, o guia de Mollick funciona como um diagnóstico pragmático. Para equipes de tecnologia no Brasil, isso significa menos tempo gasto avaliando modelos obsoletos e mais foco em implementar automações que realmente reduzem débito técnico em pipelines de CI/CD e processos de desenvolvimento.

mollickguiaagenticasferramentassistemasagenticosdesenvolvimentotécnicoversusatual

Mais da mesma edição

@OpenAI

🏥ChatGPT começa a ler seus dados de saúde

A OpenAI começou a liberar, para usuários nos Estados Unidos, uma integração do ChatGPT com o Apple Health e prontuários médicos compatíveis. A ideia é que você possa conectar seus dados de saúde ao chat e ter conversas mais informadas: perguntar sobre mudanças nos seus exames, entender resultados de laboratório ou acompanhar tendências ao longo do tempo. --- A conexão é feita de forma segura dentro do app. É o tipo de funcionalidade que pode ser incrivelmente útil para quem tem dificuldade de interpretar exames, mas também levanta questões óbvias sobre privacidade. Ter seus dados médicos passando por um modelo de linguagem exige um nível de confiança que nem todo mundo está pronto para dar. --- Por enquanto, a funcionalidade é exclusiva dos EUA. Mas se funcionar bem, é questão de tempo até chegar a outros mercados.

@AndrewYNg

🛠️Andrew Ng lança agente open source que entrega trabalho pronto

Andrew Ng, um dos nomes mais conhecidos do mundo da IA, anunciou o OpenWorker: um agente de código aberto que não fica só na conversa, ele entrega resultados concretos. Pode preparar um relatório, organizar sua agenda, redigir documentos ou filtrar alertas do Slack. E antes de fazer algo importante, pede sua confirmação. --- O diferencial é a filosofia: o OpenWorker roda na sua máquina (Mac por enquanto, Windows em breve), não te prende a nenhum modelo específico e seus dados só saem do computador se você quiser. Você pode usar GPT 5.6 Sol, Claude Fable, Gemini 3.6, modelos abertos como DeepSeek e Kimi, ou até rodar tudo localmente com Ollama. --- Ng e o cofundador Rohit Prasad argumentam que assistentes de IA que realmente trabalham por você serão cada vez mais comuns, e que precisa existir uma opção aberta, privada e independente de fornecedor. O código está no GitHub e basta uma chave de API para testar.

@arcprize

🧩Grok 4.5 alcança 85,7% no teste de raciocínio ARC-AGI

O Grok 4.5 acaba de ser avaliado no ARC-AGI, o benchmark que testa a capacidade de uma IA de resolver problemas visuais de raciocínio que nunca viu antes, algo que humanos fazem com relativa facilidade. O resultado: 85,7% no ARC-AGI-1 a um custo de 0,33 dólar por tarefa, e 52,6% no ARC-AGI-2, mais difícil, a 0,78 dólar por tarefa. --- No ARC-AGI-3, a versão mais desafiadora, o modelo praticamente travou: 0,3% de acerto a um custo absurdo de quase 7 mil dólares. Um detalhe curioso é que aumentar o esforço de raciocínio do modelo de médio para alto não melhorou nem a performance, nem o custo. Ou seja, pensar mais não ajudou. --- Os números mostram que modelos de ponta estão ficando muito bons em raciocínio de nível básico, mas a fronteira real continua longe de ser conquistada.

Receba no seu email

Todo dia, grátis pra sempre.

Assinar newsletter