aiexpert
Início / Podcast
Episódio novo a cada edição

ai|expert podcast

A edição do dia narrada por dois apresentadores sintéticos. O roteiro sai do mesmo arquivo que alimenta o site — com as fontes à vista, e sem humano no meio.

40Episódios
3Idiomas
36
Episódio mais recente · 23 de set.

O harness ao redor do modelo decidiu esta semana se um agente sobrevivia à produção, não o modelo em si.

O harness ao redor do modelo decidiu esta semana se um agente sobrevivia à produção, não o modelo em si.

Apresentam ALANApresentação
00:00 05:33
7 min
Ep. 35 · Plantão

A confiabilidade dos agentes de produção migrou do modelo para o harness que o cerca.

A confiabilidade dos agentes de produção migrou do modelo para o harness que o cerca.

4 min
Ep. 34 · Plantão

O harness, não o modelo, decide se o agente sobrevive à produção

O harness, não o modelo, decide se o agente sobrevive à produção

5 min
Ep. 33 · Plantão

O harness, não o modelo, decide se um agente é seguro e barato de rodar

O harness, não o modelo, decide se um agente é seguro e barato de rodar

5 min
Ep. 31 · Plantão

Kernel profiling, power conversion, e segurança de imagem expõem a infraestrutura de IA como o novo gargalo da produção.

Kernel profiling, power conversion, e segurança de imagem expõem a infraestrutura de IA como o novo gargalo da produção.

5 min
Ep. 30 · Plantão

Kernel profiling, power conversion, e segurança de imagem expõem a infraestrutura de IA como o novo gargalo da produção.

Kernel profiling, power conversion, e segurança de imagem expõem a infraestrutura de IA como o novo gargalo da produção.

4 min
Ep. 29 · Plantão

Kernel profiling, GPU safety, and agent harnesses became measurable this week—and the numbers expose where optimization actually lives.

Kernel profiling, GPU safety, and agent harnesses became measurable this week—and the numbers expose where optimization actually lives.

28 min
Ep. 28 · Edição

A edição em que agentes pararam de falhar por causa do modelo

A semana em que ficou claro: agentes em produção não travam por falta de modelo — travam por falta de engenharia de dados, governança de permissão e átomos de silício.

21 de ago.
29 min
Ep. 27 · Edição

A edição em que a inferência ficou barata e a confiança ficou cara

A semana em que o custo de rodar agentes despencou em três frentes — e o custo de confiar neles subiu na mesma proporção.

14 de ago.
15 min
Ep. 26 · Plantão

A semana em que a conta dos agentes começou a apertar

A semana em que a economia da IA agêntica virou a restrição dominante — quem não otimizar memória, CPU e inferência vai financiar o roadmap do concorrente.

10 de ago.
41 min
Ep. 25 · Edição

A edição em que os agentes tiveram que provar o que valem

A semana em que autonomia de agente virou número medido — e a economia do silício embaixo deles mudou de dono.

07 de ago.
25 min
Ep. 24 · Edição

A edição em que o agente saiu do sandbox

A semana em que agente autônomo, arquitetura de produção e economia de compute pararam de ser três problemas separados — e viraram a mesma decisão de CTO.

31 de jul.
28 min
Ep. 22 · Edição

Edição 22 — Agentes ganham régua, silício perde monopólio

A semana em que agentes viraram disciplina de engenharia mensurável — e o silício embaixo deles deixou de ser monopólio.

24 de jul.
25 min
Ep. 21 · Edição

A edição em que a conta dos agentes ficou visível

A semana em que o custo real de rodar agentes apareceu no extrato — e ele não é o preço do token: é o harness, a rede elétrica e o lugar onde a inferência acontece.

10 de jul.
15 min
Ep. 20 · Plantão

A semana em que agentes em produção viraram problema de governança

Os agentes chegaram aos repositórios e ao chat — mas os times perderam o rastro do que eles escrevem, executam e custam.

29 de jun.
24 min
Ep. 19 · Edição

A edição em que a camada abaixo do modelo virou o problema

A semana em que a infraestrutura abaixo do modelo virou a notícia: agentes exigem runtime próprio, memória legada disparou 60%, e o laboratório que criou o Claude largou o SQL.

26 de jun.
13 min
Ep. 18 · Plantão

A semana em que os agentes embarcaram antes do cinto de segurança

Microsoft, Azure e a própria Windows hardening colocaram agentes em produção nesta semana — e ServiceNow e DeepMind, no mesmo intervalo, publicaram a prova de que a contenção ainda não chegou junto.

22 de jun.
34 min
Ep. 17 · Edição

Agentes como unidade implantável — e o stack que correu atrás

A semana em que agentes deixaram de ser protótipo e viraram unidade implantável — forçando supply, regulação e confiabilidade a se reorganizarem em torno deles.

19 de jun.
14 min
Ep. 16 · Plantão

A semana em que a pilha de agentes virou infraestrutura — e mostrou onde quebra

Agentes saíram do laboratório: ganharam orquestrador, cache durável e MCPs padronizados na mesma semana em que um post-mortem catalogou 22 formas deles falharem em silêncio.

15 de jun.
27 min
Ep. 15 · Edição

A edição em que o agente parou de ser o produto

A semana em que a capacidade do modelo deixou de ser o gargalo — e o ambiente, o gateway e a capacidade de inferência viraram o produto que o CTO precisa precificar.

12 de jun.
13 min
Ep. 14 · Plantão

Wire #14: A semana em que o custo do token virou KPI de board

Provedores derrubaram preço, builders aprenderam a cortar tokens, e a Uber lembrou todo mundo que ROI de IA continua mais frágil do que o hype sugere — tudo na mesma semana.

03 de jun.
28 min
Ep. 13 · Edição

A Conta Chegou: Custo, Soberania e Auditoria de Agentes

A semana em que custo, soberania e auditoria de agentes pararam de ser três conversas separadas — e viraram a mesma decisão de arquitetura para o CTO.

29 de mai.
16 min
Ep. 12 · Plantão

Wire #12 — O dia em que a memória dos agentes virou superfície de ataque

A semana em que a memória dos agentes virou a nova superfície de ataque — e o hardware que roda esses agentes ficou impagável.

25 de mai.
36 min
Ep. 11 · Edição

A semana em que memória virou o gargalo e os agentes foram pra produção

A semana em que o custo de IA migrou da GPU pra memória, agentes encararam sistemas reais de empresa, e a pesquisa entregou réguas mais honestas pra medir o que está em produção.

22 de mai.
16 min
Ep. 10 · Plantão

Wire #10 — A semana em que confiabilidade de agente virou problema de infraestrutura

Os agentes não estão quebrando no modelo — estão quebrando no harness, na memória, na latência e nos mandatos de adoção que CTOs estão assinando sem medir.

18 de mai.
13 min
Ep. 9 · Plantão

A semana em que compute virou aluguel — e o Claude entrou no banco

A semana em que o gargalo de GPU forçou rivais a alugarem silício uns dos outros, enquanto agentes Claude desembarcam no core bancário regulado.

11 de mai.
26 min
Ep. 8 · Edição

A edição em que os agentes pararam de pedir permissão

A semana em que a economia da inferência se descolou do hype, os agentes começaram a provisionar infraestrutura sozinhos — e a janela para defender ficou bem mais curta.

08 de mai.
28 min
Ep. 7 · Edição

A semana em que a infraestrutura virou agente

O stack de IA está sendo reprecificado por baixo (silício e TCO) e operado por cima (agentes autônomos) — e o perímetro de risco se moveu junto.

08 de mai.
15 min
Ep. 6 · Plantão

A semana em que agentes começaram a comprar sua própria nuvem

Agentes começaram a provisionar infraestrutura no próprio cartão de crédito enquanto CTOs recalculam o stack contra um teto de capex limitado por memória.

05 de mai.
17 min
Ep. 5 · Plantão

A semana em que o stack de IA foi reprecificado

Capital, contratos e custo-por-token mudaram todos de uma vez — o stack de IA que as empresas compram tem cara materialmente diferente do que tinha na sexta.

29 de abr.
15 min
Ep. 4 · Plantão

A semana em que a IA frontier ficou mais cara — e as alternativas ficaram sérias

OpenAI dobrou o preço da inteligência frontier; em 48 horas, open weights, mega-fusões e o moonshot do LeCun recapitalizaram o stack alternativo.

25 de abr.
11 min
Ep. 3 · Plantão

A semana em que o stack de IA foi reprecificado

A IA frontier ficou mais cara enquanto open weights fecharam a diferença — e as empresas agora têm uma escolha real sobre o stack.

25 de abr.
11 min
Ep. 2 · Edição

O Jogo de Poder de Precificação — e a Resposta Open-Weights

Os labs frontier estão testando quanto as empresas pagam por acesso flagship opaco, enquanto open weights e nova ciência de RL silenciosamente redefinem o que o resto do stack pode fazer.

24 de abr.