Podlileitor de podcasts Webplayer

Between Futures

Between Futures

#029 - Chegamos no AGI? Benchmarks, agentes e o futuro do compute

Between Futures · 11 de set. de 2026 · 1:10:42

0:001:10:42

Ouça na app Podli 🎧

Siga os seus podcasts favoritos, ouça offline e no carro com CarPlay e Android Auto, e continue sempre onde ficou. Experimente grátis.

No EP 29, Flávio Pripas e Rodrigo Conde discutem o que muda quando modelos de fronteira deixam de ser apenas chatbots e passam a executar trabalho por horas, usar o computador, navegar interfaces e operar ferramentas.

A conversa parte do GPT-6 Astra e do Claude Fable 5.1, mas vai além dos placares: o que benchmarks como ARC-AGI-3, FrontierMath e ExploitBench realmente medem? Quando um resultado mede o modelo — e quando mede também o harness, as ferramentas e o orçamento de inferência?

Também entram na pauta os limites práticos dos agentes: ganho real em codebases conhecidas, tarefas de suporte resolvidas no navegador, overengineering e a importância de definir bem o escopo. Na segunda metade, eles analisam a aquisição pendente da Hugging Face pela NVIDIA, a tensão entre open source e neutralidade de plataforma, e por que compute local pode se tornar infraestrutura estratégica para empresas — especialmente no Brasil.

Neste episódio:

Entre na conversa e acompanhe as notas completas do episódio no site do Between Futures.

Episódios: Between Futures

PodliDescarrega a app gratuita do Podli
↓ App