AIREITER
DOC APIPREZZI
TEMPLATE
  • AIReiter
  • Blog
  • OpenAI Agents API in beta pubblica: prezzi, sandbox e limiti

OpenAI Agents API in beta pubblica: prezzi, sandbox e limiti

Ultimo Aggiornamento: 2026-09-11 00:15:35

OpenAI Agents API è ora in beta pubblica, ma non va considerata né un’alternativa più economica alle chiamate ai modelli né una piattaforma di automazione pronta all’uso. OpenAI gestisce l’harness dell’agente; agli sviluppatori spettano la scelta dell’ambiente di esecuzione, degli strumenti e dei relativi confini operativi.

In breve: cosa è stato lanciato e a chi serve

OpenAI ha annunciato Agents API il 10 settembre 2026 come beta pubblica per sviluppatori. L’annuncio ufficiale la descrive come un modo gestito per eseguire agenti cloud utilizzando l’harness Codex, modelli, strumenti e una sandbox selezionata.

Agents API è pensata soprattutto per i team che stanno già sviluppando agenti capaci di usare strumenti e operare su sessioni prolungate. Per richieste circoscritte, una normale chiamata alla Responses API accompagnata da un piccolo loop applicativo può risultare più semplice.

DomandaRisposta
È disponibile?Sì, in beta pubblica e non in disponibilità generale
Esiste un costo separato per la piattaforma Agents API?OpenAI dice di no; l’uso di modelli e strumenti resta comunque a pagamento
OpenAI esegue tutto il codice dell’applicazione?No. Puoi scegliere un ambiente gestito da OpenAI, da un partner o autogestito
Cosa gestisce OpenAI?L’harness dell’agente, inclusi orchestrazione e gestione delle sessioni lunghe
È pronta per la produzione?È adatta a piloti controllati; lo stato di beta rende necessario predisporre un piano di rollback

L’architettura si decide in base all’ambiente di esecuzione

Agents API separa il ciclo di ragionamento dal luogo in cui il lavoro viene eseguito. L’harness può gestire sessioni, contesto, selezione degli strumenti e delega, mentre una sandbox esegue codice, gestisce file o produce artefatti.

La documentazione sull’architettura di OpenAI è il riferimento per capire questi confini. Gli articoli sul lancio citano questi ambienti partner: Blaxel, Cloudflare, Daytona, DigitalOcean, E2B, Modal, Oracle, Runloop e Vercel. Prezzi e funzionalità disponibili nelle diverse aree geografiche non sono necessariamente comparabili.

Opzione di esecuzioneIdeale perPrincipale compromesso
Sandbox gestita da OpenAIPrototipi rapidi ed esecuzione gestitaMinore controllo sull’infrastruttura
Sandbox di un partnerChi ha già un rapporto con un provider o deve rispettare uno specifico modello di deploymentPrezzi e comportamento cambiano da provider a provider
Ambiente autogestitoRequisiti esistenti di sicurezza, rete o infrastrutturaUna quota maggiore di affidabilità e operatività ricade sul tuo team

Scegli un ambiente autogestito quando policy di rete, segreti, residenza dei dati o controllo del filesystem sono requisiti irrinunciabili. L’esecuzione gestita è invece preferibile quando la velocità conta di più, a condizione che il pacchetto del provider, i timeout, la persistenza e la gestione degli artefatti superino i tuoi test.

Le decisioni di governance restano comunque al team, inclusi gestione dei segreti, file, accesso alla rete e stato persistente.

Cosa introduce davvero la beta

La panoramica di Agents API e la documentazione collegata descrivono diverse funzionalità pensate per attività che vanno oltre una singola interazione con il modello.

Sessioni lunghe e compattazione del contesto

La compattazione automatica del contesto aiuta a contenerne la crescita durante le esecuzioni prolungate, ma OpenAI non garantisce un tasso di compressione universale né una durata massima valida per ogni scenario. Va quindi misurata su carichi di lavoro rappresentativi.

Ricerca degli strumenti e chiamate parallele

La ricerca degli strumenti può ridurre la quantità di informazioni sugli strumenti inserita in ogni contesto del modello. Le chiamate parallele programmatiche possono diminuire il tempo totale quando le operazioni sono indipendenti. Nessuna delle due funzionalità rende sicure le chiamate dipendenti: se il workflow deve ottenere il risultato B prima di invocare lo strumento C, la dipendenza sequenziale rimane.

Delega tra più agenti

Un agente principale può delegare sottoattività ad altri agenti, anche in parallelo. È utile per attività circoscritte di ricerca, classificazione o produzione di artefatti. Aumentano però anche i possibili punti di errore e di addebito: il design dell’applicazione dovrebbe quindi prevedere un limite al numero di subagenti e al numero massimo di turni.

Ambienti di esecuzione

La documentazione illustra le sandbox gestite da OpenAI e le sandbox autogestite. Prima di scegliere, verifica installazione dei pacchetti, persistenza del filesystem, policy di rete, credenziali, timeout e gestione degli artefatti con il provider esatto che intendi utilizzare.

Modello dei costi: niente costo di piattaforma non significa gratis

OpenAI afferma che durante la beta Agents API non applica un costo separato. Il conto può comunque includere token dei modelli, strumenti integrati o esterni e infrastruttura della sandbox.

Voce di costoCosa mettere a budget
Chiamate ai modelliToken di input e output per ogni turno e subagente
Strumenti integratiUtilizzo specifico degli strumenti, quando previsto
SandboxCosti di calcolo, storage, rete o del provider
Operatività dell’applicazioneLog, code, database, monitoraggio e retry

Un’analisi indipendente dei costi di A8gent mostra perché le stime basate su una sola chiamata possono essere fuorvianti. Per un carico dichiarato di 1.000 esecuzioni di triage al mese, 3.000 token di input e 400 token di output per esecuzione, la stima era di circa 0,31 $ al mese per i token del modello con gpt-5-nano e di circa 27 $ con gpt-5.6-sol, prima dei costi di hosting. Sono i calcoli riportati nell’articolo con i prezzi disponibili all’epoca, non un preventivo di Agents API.

I workflow con più turni costano più delle stime basate su una singola chiamata, perché i turni successivi includono il contesto accumulato. Per fissare il budget, usa i dati effettivi del tuo utilizzo.

Un pilota prudente dovrebbe stabilire un numero massimo di turni, limitare il lavoro concorrente, registrare il consumo di token per ogni risultato di business completato e imporre un tetto di spesa per esecuzione. L’esempio di controllore della spesa per esecuzione pubblicato nell’OpenAI Cookbook specifica chiaramente che i prezzi sono fittizi, ma il suo schema di prenotazione è utile: riserva un importo massimo prima di ogni richiesta e regola il conto in base all’utilizzo effettivo.

Le domande da chiarire prima di portarla in produzione

API, integrazioni e limiti in beta possono cambiare. Mantieni quindi un fallback in grado di bloccare le nuove esecuzioni senza compromettere i dati di riferimento.

Un primo utilizzatore, @yandt888, ha sollevato dubbi sulla residenza dei dati negli Stati Uniti e sull’interazione tra esecuzione autogestita e requisiti di conservazione zero dei dati. Si tratta della preoccupazione riportata da un utente, non di una dichiarazione sulle policy di OpenAI: prima di inviare dati regolamentati, verifica i termini contrattuali e regionali aggiornati del tuo account.

Prima dell’adozione, verifica:

  • Se un’esecuzione fallita può riprendere senza duplicare un’azione esterna.
  • Dove vengono archiviati record delle sessioni, file e artefatti e cosa accade durante un’interruzione del provider.
  • Se il team può ricostruire la decisione di un subagente, riprodurre gli input e migrare qualora cambiassero le condizioni della beta.

Considera le demo per quello che sono: demo. Proteggi le azioni irreversibili, rendi gli strumenti idempotenti quando possibile e testa i casi di prompt injection e di guasto parziale usando integrazioni reali.

Un perimetro pratico per l’adozione

Agents API è una buona prima scelta quando la difficoltà principale consiste nel coordinare attività che richiedono valutazione, distribuite tra strumenti, sessioni o agenti specializzati. Inizia con un’attività circoscritta, come il triage di documenti, la ricerca interna o la generazione di artefatti, poi confrontala con il loop più semplice che altrimenti dovresti mantenere.

Se la priorità è…Inizia da…
Accedere rapidamente a un’orchestrazione gestitaUn pilota con Agents API
Ottenere il massimo controllo sullo stato del workflowIl tuo layer di orchestrazione
Garantire la portabilità tra providerUn framework o gateway indipendente dal modello
Gestire approvazioni e audit con requisiti elevatiUn workflow engine attorno all’agente
Effettuare chiamate prevedibili e convenienti a singolo turnoRichieste dirette alle API dei modelli

Per un pilota, definisci un unico indicatore di successo, un costo massimo per attività, una durata massima e un punto di approvazione umana. Se l’harness gestito non riduce in modo concreto il tempo di sviluppo o non migliora il comportamento in caso di recupero dagli errori, non trasformarlo in una nuova dipendenza basata su una beta.

FAQ su OpenAI Agents API

OpenAI Agents API è disponibile per tutti?

No. OpenAI l’ha annunciata come beta pubblica il 10 settembre 2026. Nei materiali del lancio non è stata annunciata la disponibilità generale.

Posso usare una sandbox mia?

Sì. OpenAI documenta gli ambienti autogestiti come una delle opzioni, insieme agli ambienti gestiti da OpenAI e a quelli dei partner. In questo caso, sicurezza, rete, persistenza e operatività dipendono in misura maggiore dal tuo team.

Supporta workflow multi-agente?

Sì. L’API supporta la delega ai subagenti e il lavoro parallelo. Imposta limiti espliciti, perché ogni agente aggiuntivo può aumentare latenza, consumo di token e possibilità di errore.

>_Directory modelli AIReiter

Accesso API rapido ai modelli collegati a questa guida

GPT-5.6 Sol

Chat

Un modello di testo GPT-5.6 premium per attività impegnative di coding, ragionamento e lavoro agentico a lungo formato.

OpenAICrea API Key >

Claude Fable 5

Chat

Un modello Claude premium per il ragionamento profondo e il lavoro complesso su contenuti lunghi.

AnthropicCrea API Key >

Claude Fable 5.1

Chat

Mythos-class model for long-horizon coding, research, and knowledge work.

AnthropicCrea API Key >

Claude Opus 4.8

Chat

Un modello Claude ad alte prestazioni per ragionamenti impegnativi e lavoro professionale.

AnthropicCrea API Key >

Claude Opus 5

Chat

Un modello Claude premium per ragionamenti complessi, programmazione e lavoro professionale su contesti lunghi.

AnthropicCrea API Key >

Post recenti

Recensione della beta di Cursor Projects: è utile per le migrazioni di grandi dimensioni?

2026-09-11

API full-duplex GPT-Live: architettura degli agenti vocali

2026-09-10

Prezzi dell’API GPT-Live-1: stato, costi e alternative

2026-09-10

OpenRouter US In-Region Routing: configurazione e limiti

2026-09-10
AIREITER

Domande? Contattaci a
[email protected]

新速率有限公司NEWRATE LIMITED香港九龍花園街 2-16 號好景商業中心 2304 室Room 2304, Haojing Commercial Center, 2-16 Garden Street, Kowloon, Hong Kong

LLM

GPT-6 AstraGemini 3.8 FlashClaude Fable 5.1GLM-5.3 FlashGemini 3.6 Flash

Video IA

Gemini Omni 1.1 Flash ExtMiniMax H3Kling 3.0 Motion ControlKling 3.0 TurboKling 3.0

Immagine IA

GPT-Image 2.5Grok Imagine Image 2.0Midjourney V8.1Midjourney V7Z-Image Turbo

Blog

Vedi Tutto →

Azienda

Informativa sulla privacyTermini di servizioPolitica di rimborso

© 2026 AIReiter. Tutti i diritti riservati.