Cambia tema

Ingegneria degli agenti IA nel 2026: come scegliere tra LangGraph e OpenAI Agents SDK

Easton editorial illustration: one central state ledger with three controlled graph branches
7
Dimensioni di produzione
Persistenza dello stato, approvazione HITL, osservabilità, budget di costo, modello di permessi, eval dataset e recupero dagli errori.
5
Opzioni confrontate
OpenAI Agents SDK, LangGraph, AutoGen, CrewAI e Temporal.
3
Passaggi decisionali
Prima complessità del task, poi ecosistema di strumenti e bisogno di stato, infine governance di produzione.
数据来源: Dimensioni di selezione definite in questo articolo a partire dalla ricerca ufficiale della fase 1

"Documentazione OpenAI Agents SDK"

Una demo di agent per la ricerca clienti sa già cercare nella documentazione, riassumere i risultati e inviare un messaggio su Lark. Il problema arriva quando il team prova a portarla in produzione: mancano code, approvazioni, recupero dagli errori, log, limiti di costo e test di regressione. Quando il product manager chiede se il team operations può usarla la settimana successiva, lo sviluppatore capisce che scegliere tra LangGraph e OpenAI Agents SDK non dipende da quale demo gira più veloce. Dipende da sette dimensioni di ingegneria: persistenza dello stato, approvazione umana, osservabilità, budget di costo, modello di permessi, eval dataset e recupero dagli errori.

OpenAI Agents SDK: la scelta leggera prima di tutto

OpenAI Agents SDK è un toolkit leggero, code-first, per costruire agenti vicino all’ecosistema OpenAI di modelli e tool calling.

Le primitive principali includono:

PrimitivaCosa faConfine
AgentsUnità composta da instructions, model, tools, MCP servers, handoffs e guardrailsNon è un grafo di stato esplicito; lo stato di business va progettato a parte
HandoffsMeccanismo multi-agent con cui un agent può passare il task a un altroNon equivale al controllo di un workflow di lunga durata
GuardrailsGuardrails input/output che eseguono controlli in parallelo e sollevano un’eccezione quando scatta un tripwireNon equivalgono a modello completo di permessi, audit log o approvazione di compliance
TracingTraces/spans integrati, con processor personalizzato e controllo dei dati sensibiliNon equivale a un sistema completo di monitoring, alerting, budget o rollback
ToolsSupporta OpenAI Hosted tools, strumenti funzione personalizzati e MCP serversTipi di strumenti e supporto MCP vanno verificati nella documentazione corrente
Sessions / HITLLa documentazione ufficiale include voci per sessions, human-in-the-loop e sandbox agentsNon equivale a graph checkpointing, time travel o replay in stile LangGraph

Se devi costruire rapidamente un agent leggero in codice, dipendi soprattutto da modelli e strumenti OpenAI, ti servono handoff multi-agent, guardrail su input e output, tracing del SDK e una complessità di framework più bassa, OpenAI Agents SDK è la scelta più leggera. Esempi tipici: Q&A per supporto clienti, ricerca documentale + riassunto, o agenti che elaborano passaggi in sequenza.

Il costo è la responsabilità. I guardrail possono validare input e output, ma flussi di approvazione complessi, isolamento dei permessi e audit log restano nella logica di business. Il tracing può collegarsi a OpenTelemetry o a un processor personalizzato, ma il team deve comunque collegare log, metriche, alert, budget di costo e test di regressione. Sessions e HITL coprono una parte di conversazione e intervento umano. Se servono grafo di stato esplicito, checkpoint, resume/replay, time travel o controllo di workflow lunghi, devi ancora valutare LangGraph, Temporal o uno strato di stato di business.

Gli scenari poco adatti sono chiari: rami di stato complessi, pause e ripresa dopo approvazione, processi con SLA forte che devono garantire retry, rollback e tracciabilità, oppure workflow che richiedono replay dello stato e orchestrazione di lunga durata.

Nota sui fatti volatili: API, modelli di default, Hosted tools, supporto MCP, sessions, sandbox agents, comportamento di tracing e prezzi di OpenAI Agents SDK possono cambiare. Prima dell’integrazione controlla la documentazione OpenAI Agents SDK.

LangGraph: forte su stato esplicito e persistenza

LangGraph è un low-level orchestration framework per stateful agents. Il focus è su durable execution, HITL, memory e time travel.

Capacità principali:

CapacitàCosa significaUso tipico
Durable executionPersiste threads e checkpoint/state snapshots tramite un checkpointerRiprendere o riprodurre da un checkpoint dopo un errore
Human-in-the-loopUsa interrupt per sospendere e Command resume per continuare; supporta approve/reject/edit/review dei tool callsFlussi di approvazione complessi e revisione umana di azioni sensibili
MemoryOffre comprehensive memory per contesto a breve e lungo termineProgettazione di sistemi di memoria per agenti
Time travelEsegue replay o fork da checkpoint storiciRiprodurre esecuzioni fallite e confrontare rami

Meccanica della persistenza

La persistenza di LangGraph non è semplice cronologia chat. È costruita intorno a threads e checkpoints:

Thread: il filo di esecuzione di una conversazione o di un workflow. Checkpoint: uno snapshot completo dello stato in un momento specifico, inclusi graph state, pending tasks e pending writes. Resume/Replay: continuare da un checkpoint o riprodurre un percorso storico di esecuzione.

Questo modello è adatto quando servono pausa/ripresa, retry dopo errore e replay dello stato. Per esempio: flussi di approvazione nel supporto clienti, workflow di business multi-step e agenti di ricerca di lunga durata.

Human-in-the-loop(HITL)

Il HITL di LangGraph assomiglia di più a pausa e ripresa in un workflow con stato:

Interrupt sospende l’esecuzione in un nodo e attende input umano. Command resume continua dopo approve, reject o edit. Tool-call review può sospendere prima di una chiamata a strumento per chiedere approvazione.

Rispetto ai guardrail di OpenAI Agents SDK, i guardrail sono più simili a controlli prima o dopo una run, mentre il HITL di LangGraph sospende e riprende nel mezzo del workflow. Se il flusso di approvazione richiede più turni, stato salvato, replay e rami, LangGraph di solito è più adatto.

Se servono rami di stato complessi, recupero, pause di approvazione e replay dello stato, LangGraph è più vicino a un’orchestrazione di produzione. Esempi: flussi di approvazione del supporto clienti, workflow di business multi-step e agenti di ricerca di lunga durata.

Il costo è la complessità. Devi progettare e mantenere un grafo di stato. Devi anche scegliere un backend di persistenza, e il supporto può cambiare; per questo conviene verificare la documentazione corrente prima dell’integrazione.

Scenari poco adatti: task brevi, prototipi con poco stato e progetti che dipendono soprattutto dall’ecosistema di strumenti OpenAI senza bisogno di persistenza o approvazioni complesse.

Nota sui fatti volatili: LangGraph v1, Platform/Studio/Deployment e supporto ai backend di persistenza possono cambiare. Prima dell’integrazione controlla la documentazione LangGraph.

Per approfondire la gestione dello stato con LangGraph, leggi LangGraph nella pratica: gestione dello stato e LangGraph vs AutoGen: confronto sul tracking dello stato.

AutoGen, CrewAI e Temporal: collaborazione multi-agent e durable execution

La scelta non è solo OpenAI Agents SDK contro LangGraph. Se il focus è collaborazione multi-ruolo, prototipo di ricerca o uno strato indipendente di infrastruttura workflow, vale la pena guardare anche AutoGen, CrewAI e Temporal.

AutoGen / AG2

AutoGen è un layered framework con Core API, AgentChat API, Extensions e Studio, pensato per conversazioni e applicazioni collaborative multi-agent.

Core API copre runtime agent di basso livello e routing dei messaggi. AgentChat API offre astrazioni di conversazione e collaborazione di livello più alto. Extensions integra strumenti, modelli e piattaforme esterne. Studio offre una superficie visuale per costruzione e debug.

Scenari adatti: ricerca e prototipi di conversazione/collaborazione multi-agent; team che conoscono già l’ecosistema AutoGen.

Da valutare a parte: persistenza dello stato, recupero dagli errori, osservabilità, permessi e deploy. Verifica anche relazione di versioni AutoGen/AG2, stabilità API e ingresso alla documentazione nella documentazione AutoGen.

Nota sui fatti volatili: migrazioni tra AutoGen e AG2, relazione con Microsoft Agent Framework e stabilità API possono cambiare. Questo articolo tratta AutoGen come candidato per collaborazione multi-agent, non come affermazione fissa sulla roadmap.

CrewAI

CrewAI organizza la collaborazione multi-agent intorno a concetti come crews, agents, tasks, processes e flows, con Flows per un’orchestrazione più strutturata.

Concetti principali: Crews raggruppa agents e tasks. Agents definisce i ruoli. Tasks descrive il lavoro concreto. Processes definisce il flusso di esecuzione. Flows offre un modello più strutturato di orchestrazione multi-step.

Scenari adatti: applicazioni agent collaborative per ruolo; orchestrazione rapida e prototipi.

Da valutare a parte: moduli prodotto, capacità hosted, pricing e funzionalità enterprise. Prima dell’integrazione controlla la documentazione CrewAI.

Nota sui fatti volatili: moduli prodotto, capacità hosted, pricing e funzionalità enterprise di CrewAI possono cambiare. Questo articolo non lo classifica come “il più forte”; lo colloca nella categoria collaborazione multi-agent.

Temporal

Temporal non è un framework per agenti. È durable execution infrastructure. Offre workflow, activity, retry, timeout e visibility, quindi è adatto a processi di business che devono essere eseguiti in modo affidabile.

Capacità principali: Workflow definisce processi di lunga durata. Activity incapsula operazioni esterne che possono fallire. Retry/Timeout configura strategie di retry e limiti di tempo. Visibility permette di interrogare e monitorare lo stato di esecuzione del workflow.

Relazione con i framework per agenti: un agent può essere un passaggio dentro un workflow o una activity Temporal. Temporal gestisce il processo di business affidabile; il framework per agenti gestisce i passaggi intelligenti.

Scenari adatti: processi con SLA forte che devono fare retry, rollback e restare tracciabili; workflow enterprise complessi con code, retry, timeout e audit.

Cosa non è: non è un motivo per infilare tutta la logica in un framework per agenti. Temporal + Agent SDK o LangGraph può essere una separazione più pulita.

Nota sui fatti volatili: Temporal Cloud pricing, API SDK e opzioni di deploy possono cambiare. Prima dell’integrazione controlla la documentazione Temporal.

Matrice di selezione: differenze sulle dimensioni di produzione

La selezione non è una classifica di popolarità. È una verifica su sette dimensioni di ingegneria: persistenza dello stato, approvazione HITL, osservabilità, budget di costo, modello di permessi, eval dataset e recupero dagli errori. La tabella confronta cinque opzioni lungo queste dimensioni e i loro confini.

FrameworkPersistenza dello statoApprovazione HITLOsservabilitàBudget di costoModello di permessiEval datasetRecupero dagli errori
OpenAI Agents SDKSessions può mantenere contesto conversazionale, ma non è graph checkpoint né time travelHITL e guardrails esistono, ma i flussi complessi richiedono design nello strato businessTracing integrato; servono comunque log, metriche e alertNessun sistema completo integrato; va implementatoGuardrails non è un modello completo di permessi, audit o complianceVa implementatoRetry, recupero e rollback comuni richiedono design nello strato business
LangGraphCheckpointer + thread + checkpoint/state snapshots, con resume/replayInterrupt + Command resume, con approve/reject/edit/review dei tool callsPuò collegarsi a OpenTelemetry; servono comunque log, metriche e alertNon integrato; va implementatoDa implementare nei nodi del graph o nello strato businessVa implementatoResume o replay da checkpoint; supporta pattern di retry e replay
AutoGenPersistenza da valutare separatamenteHITL da valutare separatamenteIntegrazioni di osservabilità da valutare separatamenteDa valutare separatamenteDa valutare separatamenteDa valutare separatamenteDa valutare separatamente
CrewAIPersistenza da valutare separatamenteHITL da valutare separatamenteIntegrazioni di osservabilità da valutare separatamenteDa valutare separatamenteDa valutare separatamenteDa valutare separatamenteDa valutare separatamente
TemporalWorkflow + activity supportano stato di workflow lunghiI workflow possono attendere input umano; le approvazioni possono vivere nello strato workflowVisibility integrata; possibile connessione a OpenTelemetryControllo possibile nello strato workflow/activityControlli possibili nello strato workflow/activityVa implementatoRetry/timeout integrati; adatto a esecuzione affidabile e recupero

La lettura principale: LangGraph e Temporal sono più forti su persistenza dello stato, approvazione HITL e recupero dagli errori. OpenAI Agents SDK è più leggero, ma la governance complessa di produzione resta a carico tuo. Per l’osservabilità, ogni opzione ha bisogno di log, metriche e alert del team; OpenAI Agents SDK e LangGraph offrono astrazioni di tracing, Temporal offre visibility. Budget di costo, modelli di permessi ed eval dataset restano responsabilità del team. Non dare per scontato che un framework per agenti li abbia già risolti. AutoGen e CrewAI sono adatti a collaborazione multi-ruolo e prototipi, ma le loro dimensioni di produzione vanno valutate a parte.

Tieni chiari anche i confini: tracing non è osservabilità completa. Guardrails non è un modello completo di permessi, audit o compliance. Checkpoints e threads non eliminano il bisogno di code, database o workflow engines.

Albero decisionale: dalla demo funzionante alla produzione

Se la demo del tuo agent funziona già, passa da questo flusso prima di metterla davanti a utenti reali.

Passo 1: valuta la complessità del task

Domanda: il tuo agent è un task breve con poco stato, oppure ha rami e richiede pausa/ripresa?

Task breve / poco stato: esempi, Q&A una tantum, ricerca documentale + riassunto, elaborazione dati singola. Parti con OpenAI Agents SDK. Motivo: è leggero, vicino all’ecosistema di modelli e strumenti OpenAI e non richiede gestione dello stato complessa.

Rami / pausa e ripresa: esempi, flusso di approvazione nel supporto clienti, workflow di business multi-step, agent di ricerca di lunga durata. Passa al secondo passaggio.

Passo 2: valuta ecosistema di strumenti e bisogno di stato

Domanda: il tuo agent dipende soprattutto dall’ecosistema di strumenti OpenAI, oppure ha bisogno di un grafo di stato esplicito?

Ecosistema OpenAI prima di tutto: se usi principalmente OpenAI Hosted tools, MCP servers e modelli OpenAI, parti con OpenAI Agents SDK. Se servono anche approvazioni complesse o replay dello stato, valuta LangGraph o una combinazione Temporal + Agents SDK.

Grafo di stato esplicito necessario: se hai rami complessi, recupero, pause di approvazione e replay dello stato, scegli LangGraph. Aspettati più complessità di ingegneria, perché dovrai progettare e mantenere il grafo di stato.

Passo 3: valuta la governance di produzione

Domanda: è un prototipo di ricerca o richiede governance di produzione?

Prototipo di ricerca: per conversazione/collaborazione multi-agent o per un team che conosce già AutoGen/CrewAI, valuta AutoGen e CrewAI. Controlla a parte persistenza, recupero, osservabilità, permessi e deploy.

Governance di produzione: per processi con SLA forte che devono fare retry, rollback e restare tracciabili, considera LangGraph + Temporal. Temporal gestisce il workflow di business affidabile esterno; LangGraph gestisce il grafo di stato dell’agent e l’orchestrazione LLM.

Punto decisionale

Qualunque framework tu scelga, aggiungi queste capacità prima del lancio:

CapacitàChecklist
Persistenza dello statoCi sono checkpoints/threads? Puoi fare resume o replay?
Approvazione HITLCi sono interrupt/Command resume? Il flusso di approvazione è completo?
OsservabilitàIl tracing è collegato a log, metriche e alert del team?
Budget di costoCi sono limiti di budget, tracciamento dei costi e alert?
Modello di permessiCi sono isolamento dei permessi, audit log e approvazione di compliance?
Eval datasetCi sono test di regressione, eval dataset e definizioni delle metriche?
Recupero dagli erroriCi sono logica di retry, piani di rollback e percorsi di intervento umano?

Passaggio successivo: se scegli OpenAI Agents SDK, devi ancora collegare log, metriche, alert, budget, permessi, eval dataset e recupero dagli errori. Se scegli LangGraph, progetta il grafo di stato, scegli un backend di persistenza e collega comunque osservabilità, costi, permessi ed eval. Se scegli Temporal più un framework per agenti, definisci workflows e activities, configura retry/timeout e collega osservabilità, costi e permessi.

Passi successivi e letture correlate

Una volta scelta la direzione del framework, puoi approfondire per dimensione di ingegneria:

Articoli BetterLink esistenti: Sviluppo di agenti IA nella pratica: guida ad architettura e implementazione è la base sull’architettura degli agenti, con confini dei componenti, tool calling e progettazione dello stato. LangGraph nella pratica: gestione dello stato spiega checkpoints, threads, resume/replay e recupero dagli errori. LangGraph vs AutoGen: tracking dello stato confronta i due approcci di state tracking. Monitoring, alerting e recupero dagli errori per agenti IA approfondisce log, alert, recovery e intervento umano. Progettazione di un sistema di memoria per agenti è il passo successivo per memoria a breve/lungo termine e gestione del contesto.

I prossimi articoli della serie scomporranno context engineering, flussi di approvazione HITL, budget e controllo dei costi, modelli di permessi, design di state machine, eval dataset e test di regressione, oltre alla checklist completa di lancio dalla demo alla produzione.

Se sei ancora in fase di scelta, parti dall’albero decisionale: complessità del task, ecosistema di strumenti e bisogno di stato. Non fermarti a “la demo funziona”. Prima del lancio, verifica persistenza dello stato, approvazione HITL, osservabilità, budget di costo, modelli di permessi, eval dataset e recupero dagli errori.

Come scegliere uno stack di ingegneria per agenti IA

Un flusso di selezione per passare da una demo funzionante alla produzione, decidendo framework principale, workflow engine esterno e componenti di governance mancanti.

⏱️ Estimated time: 30 min

  1. 1

    Step 1: Capire se il task è una sessione breve o un workflow lungo

    Verifica se il lavoro è una Q&A, una ricerca o un riassunto una tantum, oppure se attraversa più passaggi, approvazioni umane, tempi di attesa e recupero.
  2. 2

    Step 2: Elencare i requisiti di governance in produzione

    Scrivi in modo esplicito stato, approvazioni, permessi degli strumenti, recupero dagli errori, budget, trace/audit ed eval dataset.
  3. 3

    Step 3: Mappare i confini di responsabilità di ogni framework

    Usa OpenAI Agents SDK, LangGraph, AutoGen/CrewAI e Temporal per separare primitive leggere per agenti, grafi di stato, collaborazione multi-ruolo e workflow affidabili.
  4. 4

    Step 4: Provare con un task reale di business

    Usa un task reale per verificare trace, retry, intervento umano, isolamento dei permessi e test di regressione, invece di fermarti a una demo hello world.
  5. 5

    Step 5: Decidere framework principale e sistemi da completare

    Decidi quale framework per agenti gestisce i passaggi intelligenti, quale workflow engine assume l'affidabilità e come implementare osservabilità, costi e permessi.

FAQ

LangGraph e OpenAI Agents SDK si sostituiscono a vicenda?
Non del tutto. OpenAI Agents SDK è più vicino a primitive leggere per agenti, tool calling, handoff multi-agent, guardrails, tracing, sessions e HITL. LangGraph è più vicino a grafi di stato espliciti, persistenza, pause/ripresa e workflow riproducibili. Nei sistemi reali possono essere combinati.
Un agent di produzione ha sempre bisogno di LangGraph?
No. Per task brevi, con poco stato e centrati soprattutto sull'ecosistema di strumenti OpenAI, Agents SDK può essere più leggero. LangGraph diventa più interessante quando servono rami, recupero, pause di approvazione o replay dello stato.
AutoGen e CrewAI valgono ancora la pena?
Sì, se il focus è la collaborazione multi-ruolo, il prototipo di ricerca o un team che conosce già quell'ecosistema. Prima della produzione, valuta separatamente persistenza, recupero, osservabilità, permessi, costi e confini di deploy.
Come si dividono le responsabilità tra Temporal e LangGraph?
Temporal è infrastruttura di durable execution per workflow di business affidabili. LangGraph gestisce grafi di stato per agenti e orchestrazione LLM. Per processi con SLA forte, Temporal può gestire workflow, activity, retry e timeout, mentre il framework per agenti gestisce i passaggi intelligenti.
Cosa dimenticano più spesso i team quando scelgono un framework per agenti IA?
Spesso dimenticano approvazioni HITL, retry, trace/audit, budget di costo, modelli di permessi, eval dataset e piani di rollback. Queste lacune raramente emergono in una demo.

13 min di lettura · Pubblicato il: 11 set 2026 · Aggiornato il: 11 set 2026

Commenti

Accedi con GitHub per lasciare un commento

Easton BlogEaston Blog