AI Extract ganhou modo Precision pra documento longo e schema complexo demais pro chunk-and-merge

Precision Mode no ai_extract combina modelo especializado com um harness agentico que dispara subagentes em paralelo por seção do documento e depois junta os resultados, atingindo 94,7% de acurácia em benchmark contra 9 mil documentos, sete pontos acima do melhor baseline de modelo de fronteira com chunk-and-merge.

setembro 13, 2026 · 2 min · 381 words · Wiliam Rosa

De PDF solto a coluna de tabela: o pipeline que domestica documento não estruturado no lakehouse

ai_parse_document, ai_extract e ai_classify já são GA no Azure Databricks, e o pipeline de processamento inteligente de documento (IDP) inteiro roda dentro do Lakeflow, sem infraestrutura separada de OCR ou fila de mensagem. A peça que ainda é Beta, ai_prep_search, é justamente a que decide se o documento processado vira retrieval bom ou lixo semântico.

abril 17, 2026 · 6 min · 1257 words · Wiliam Rosa