Abstract
Costruire agenti AI capaci di elaborare documenti legali di oltre 10.000 pagine richiede molto più che semplicemente riversare il contesto in un LLM. Questo talk analizza nel dettaglio la nostra architettura event-driven in produzione.
Imparerai:
- Perché le chiamate sincrone agli LLM falliscono alla scala dei documenti, il problema del cold start e dei timeout
- Pattern di orchestrazione event-driven per workflow di agenti multi-step (planning, caricamento dinamico, assemblaggio del contesto)
- Strategie di chunking per il long-context che preservano le catene di ragionamento giuridico
- Ottimizzazione dei costi: come abbiamo ridotto del 73% il costo per richiesta tramite caching intelligente e caricamento selettivo del contesto
- Modalità di fallimento in produzione: cosa si rompe quando gli agenti pianificano in modo errato l’intero ciclo di esecuzione.