<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:content="http://purl.org/rss/1.0/modules/content/">
  <channel>
    <title>Agentes on Wiliam Rosa | Lakehouse, Dados &amp; IA</title>
    <link>https://wiliamrosa.github.io/tags/agentes/</link>
    <description>Recent content in Agentes on Wiliam Rosa | Lakehouse, Dados &amp; IA</description>
    <image>
      <title>Wiliam Rosa | Lakehouse, Dados &amp; IA</title>
      <url>https://wiliamrosa.github.io/images/wiliam-rosa-blog-og.png</url>
      <link>https://wiliamrosa.github.io/images/wiliam-rosa-blog-og.png</link>
    </image>
    <generator>Hugo</generator>
    <language>pt-br</language>
    <lastBuildDate>Thu, 10 Sep 2026 09:00:00 -0300</lastBuildDate>
    <atom:link href="https://wiliamrosa.github.io/tags/agentes/index.xml" rel="self" type="application/rss+xml" />
    <item>
      <title>Avaliação não é etapa final: o loop duplo que decide se um agente de IA vai pra produção</title>
      <link>https://wiliamrosa.github.io/articles/mlflow-avaliacao-loop-duplo-agentes-producao/</link>
      <pubDate>Thu, 10 Sep 2026 09:00:00 -0300</pubDate>
      <guid>https://wiliamrosa.github.io/articles/mlflow-avaliacao-loop-duplo-agentes-producao/</guid>
      <description>O case da Zepto usando MLflow mostra um padrão generalizável, dois loops separados, um de desenvolvimento e um de produção, ligados por um portão de qualidade, mais dataset dourado que cresce com o tempo e amostragem estratificada por risco em vez de amostragem uniforme. É engenharia de avaliação, não só uma métrica de acurácia isolada.</description>
    </item>
    <item>
      <title>Agente que sobrevive à queda de worker: durabilidade real combinando Temporal e Lakebase</title>
      <link>https://wiliamrosa.github.io/articles/agentes-duraveis-temporal-lakebase-postgres/</link>
      <pubDate>Wed, 09 Sep 2026 09:00:00 -0300</pubDate>
      <guid>https://wiliamrosa.github.io/articles/agentes-duraveis-temporal-lakebase-postgres/</guid>
      <description>Agente de IA de longa duração falha de um jeito diferente de API request-response: o processo pode cair no meio de uma etapa que já produziu efeito parcial. Um projeto de referência combina Temporal para reexecução determinística de workflow com Lakebase Postgres para estado operacional consultável, mas a idempotência de cada passo continua sendo responsabilidade de quem escreve o código do agente.</description>
    </item>
    <item>
      <title>Genie Agents ganha modo de pesquisa em múltiplos passos e aprende a ler arquivo, não só tabela</title>
      <link>https://wiliamrosa.github.io/posts/genie-agents-deep-analysis-file-reasoning/</link>
      <pubDate>Wed, 02 Sep 2026 09:00:00 -0300</pubDate>
      <guid>https://wiliamrosa.github.io/posts/genie-agents-deep-analysis-file-reasoning/</guid>
      <description>Agent mode traz raciocínio em múltiplos passos com relatório e visualização, Genie Agents passa a ler PDF, slide e imagem dentro de volume do Unity Catalog, e o Genie Code ganha função pra criar e diagnosticar outros agentes Genie.</description>
    </item>
    <item>
      <title>Skill de agente virou um objeto do Unity Catalog, com dono, permissão e auditoria</title>
      <link>https://wiliamrosa.github.io/posts/unity-catalog-skills-beta-agentes/</link>
      <pubDate>Sat, 29 Aug 2026 09:00:00 -0300</pubDate>
      <guid>https://wiliamrosa.github.io/posts/unity-catalog-skills-beta-agentes/</guid>
      <description>Unity Catalog Skills (Beta) trata skill de agente como securable de três níveis, catalog.schema.skill, com as mesmas permissões e tags que já protegem tabela. O Databricks MVP Hubert Dudek notou a mudança antes do anúncio oficial confirmar.</description>
    </item>
    <item>
      <title>Antes de abrir o Grafana: como a Databricks usa agente de IA pra investigar o próprio incidente</title>
      <link>https://wiliamrosa.github.io/articles/databricks-ai-sre-investigacao-incidentes-agente/</link>
      <pubDate>Tue, 25 Aug 2026 09:00:00 -0300</pubDate>
      <guid>https://wiliamrosa.github.io/articles/databricks-ai-sre-investigacao-incidentes-agente/</guid>
      <description>A Databricks documentou o AI SRE, agente interno que roda checagem de plataforma, análise de log e runbook de time em paralelo assim que um incidente dispara, entregando causa raiz com evidência rastreável antes de um engenheiro terminar de montar o contexto manualmente.</description>
    </item>
    <item>
      <title>Por que um agente que já conhece seu catálogo vence um agente de código genérico em tarefa de dado</title>
      <link>https://wiliamrosa.github.io/articles/genie-code-agente-dados-vs-agente-codigo-generico/</link>
      <pubDate>Fri, 24 Jul 2026 09:00:00 -0300</pubDate>
      <guid>https://wiliamrosa.github.io/articles/genie-code-agente-dados-vs-agente-codigo-generico/</guid>
      <description>Um benchmark interno da Databricks com 401 tarefas reais de descoberta de dado mostra o Genie Code batendo agentes de código genéricos em acurácia e custo, e a explicação não é o modelo por trás, é o agente não precisar explorar o workspace às cegas.</description>
    </item>
  </channel>
</rss>
