He estado trabajando casos de uso más complejos, en donde se tienen que reconocer IDs alfanumericos y correos electronicos, y cómo comenta Marcos, es bastante dificil ya que los LLMs no son realmente inteligentes.
Pero tengo la hipótesis de que creando flujos donde interactúan distintos agentes más especificos (por ejemplo agente extractor de IDs, agente extractor de correos, etc) podría tener mejores resultados con menos halucinaciones que con un solo agente (con un prompt largo y una base de conocimientos)