AIREITER

OpenRouter Auto Router: come funziona, fasce di costo e quando fissare un modello

Ultimo Aggiornamento: 2026-08-10 19:05:41

Non esiste un modello migliore per ogni prompt, ed è proprio qui che entra in gioco OpenRouter Auto Router. Inviando le richieste a openrouter/auto, il servizio assegna ogni prompt a una delle circa 30 categorie previste e seleziona il modello seguendo i flussi di spesa della piattaforma, che superano i 55T+ token a settimana, anziché una classifica statica. Dal 10 agosto 2026, il precedente routing basato su NotDiamond è stato sostituito da un sistema fondato su un segnale mobile di 7 giorni della community: al livello predefinito punta a ridurre i costi, mentre al livello massimo mira a una qualità da modelli frontier. Non ci sono sovrapprezzi per singola richiesta, ma la fattura dipende dal modello scelto e, senza configurazione, anche un prompt semplice può finire su un modello costoso.

Auto Router di OpenRouter: cosa fa davvero

Auto Router è un meta-router: si indica openrouter/auto come nome del modello e il servizio inoltra il prompt a uno specifico modello sottostante. Si paga la tariffa standard di quel modello, senza costi di routing aggiuntivi. Nella risposta, il campo model rivela quale modello è stato selezionato, così ogni richiesta resta verificabile.

L'aggiornamento di agosto 2026 ha rimpiazzato il precedente motore di routing, prima basato su NotDiamond, con quella che OpenRouter definisce la “wisdom of the market”. Al posto di un modello di classificazione fisso che stabilisce quale sia il modello “migliore”, il router considera dati di spesa anonimizzati dei 7 giorni precedenti. Se nell'ultima settimana migliaia di sviluppatori hanno spostato i propri carichi di coding da un modello a un altro, il router segue quel cambiamento nel giro di pochi giorni.

Pagina del prodotto OpenRouter Auto Router

Il router classifica i prompt al volo, senza richiedere la conservazione dei prompt, in circa 30 categorie: generazione di codice, debugging, pianificazione di agenti su più passaggi, Q&A basato sulla conoscenza, matematica, assistenza clienti e report di ricerca, tra le altre. Se i dati di classificazione o ranking non sono disponibili, passa a un insieme predefinito di modelli, così un problema nel routing non fa fallire la richiesta.

Sono disponibili due slug:

SlugUsoID del plugin
openrouter/autoRouter stabile, generalmente disponibileauto-router
openrouter/auto-betaCanale ad accesso anticipato per gli aggiornamenti del routingauto-beta-router

Il nuovo router è rimasto su auto-beta per un paio di settimane prima di approdare allo slug stabile il 10 agosto 2026. Se la configurazione viene inviata con l'ID plugin errato, viene ignorata silenziosamente: un errore di configurazione piuttosto comune.

La scelta del modello: 30 tipi di attività e 5 fasce di costo

La logica di selezione del router parte da due elementi: la classificazione dell'attività e la fascia di costo. Prima identifica il tipo di attività dal prompt; poi, per quella categoria, ordina i modelli candidati in base alla quota di utilizzo della community negli ultimi 7 giorni, applicando i vincoli dell'account, come modelli consentiti, guardrail, impostazioni sulla privacy e policy ZDR.

Le fasce di costo stabiliscono fino a quale livello della scala dei prezzi il router può spingersi. Ce ne sono cinque, dalla più economica alla più capace: low, medium, high, xhigh e max. Il valore predefinito è low. Una fascia rappresenta un intervallo, non un tetto massimo: vengono esclusi sia i modelli più economici sia quelli più costosi di quella fascia.

La matrice di routing pubblicata da OpenRouter il 10 agosto 2026 copre tutti i circa 30 tipi di attività. I 15 esempi rappresentativi qui sotto mostrano come categoria e fascia di costo determinino la selezione del modello:

Tipo di attivitàLowMediumHighXhighMax
Generazione di codiceglm-5.2claude-4.6-sonnetkimi-k3claude-opus-5claude-5-fable
Debuggingdeepseek-v4-proglm-5.2gemini-3.6-flashclaude-4.8-opusclaude-opus-5
Code reviewglm-5.2claude-sonnet-5kimi-k3gpt-5.6-solclaude-opus-5
SQL e databasedeepseek-v4-flashglm-5.2claude-sonnet-5kimi-k3claude-opus-5
Frontend e UIglm-5.2claude-sonnet-5gpt-5.6-solkimi-k3claude-5-fable
DevOps e configurazionedeepseek-v4-flashglm-5.2gpt-5.6-solkimi-k3claude-opus-5
Pianificazione multi-stepdeepseek-v4-proglm-5.2claude-4.8-opuskimi-k3claude-5-fable
Ricerca webdeepseek-v4-flashglm-5.2gpt-5.6-solkimi-k3claude-4.6-opus
Matematicadeepseek-v4-proglm-5.2gemini-3.1-prokimi-k3claude-4.6-opus
Scrittura di contenutiglm-5.2gemini-3.6-flashclaude-4.8-opusclaude-4.6-opusgpt-5.6-sol
Report di ricercadeepseek-v4-proglm-5.2claude-sonnet-5gpt-5.6-solclaude-opus-5
Q&A e conoscenzaglm-5.2gemini-3.6-flashclaude-sonnet-5kimi-k3gpt-5.6-sol
Traduzionedeepseek-v4-flashgemini-3-flashgemini-3.5-flashclaude-sonnet-5gpt-5.6-sol
Classificazionegemini-3-flashgemini-3.5-flashgemini-3.6-flashgemini-3.1-progpt-5.6-sol
Assistenza clientigemini-3-flashgpt-4.1gemini-3.6-flashclaude-4.6-sonnetclaude-opus-5

La fascia low privilegia modelli meno costosi come GLM-5.2 e DeepSeek V4 Flash per il coding, nonché le varianti Gemini Flash per classificazione e supporto. La fascia max indirizza invece verso Claude Opus 5, Claude 5 Fable o GPT-5.6 Sol, a seconda dell'attività.

cost_tier e il parametro deprecato cost_quality_tradeoff

Il vecchio parametro numerico cost_quality_tradeoff (0-10, dove 0 privilegiava la qualità e 10 il costo, con valore predefinito 7) è deprecato, ma viene ancora accettato. Il nuovo parametro cost_tier usa invece fasce con nomi espliciti. Inviandoli entrambi, cost_quality_tradeoff ha la precedenza: è una scelta di compatibilità all'indietro che può produrre routing inatteso durante la migrazione di codice esistente. Quando si adotta cost_tier, occorre rimuovere il vecchio parametro.

Configurazione tramite richiesta API:

{
  "model": "openrouter/auto",
  "messages": [{ "role": "user", "content": "Debug this Python function" }],
  "plugins": [{
    "id": "auto-router",
    "cost_tier": "max",
    "allowed_models": ["anthropic/*", "openai/*"]
  }]
}

allowed_models accetta pattern wildcard come anthropic/* per limitare la scelta a un provider. L'elenco excluded_models viene applicato dopo allowed_models e può restringere ulteriormente il pool. Se dopo i filtri non resta alcun modello, l'API restituisce un 404.

Benchmark: il nuovo Auto Router contro il precedente

OpenRouter ha messo a confronto il router nuovo e quello precedente su cinque benchmark eterogenei, sia con impostazioni predefinite sia al livello massimo. Il default del vecchio router era cost_quality_tradeoff=7; quello del nuovo è cost_tier=low.

Punteggi dei benchmark: nuovo default contro vecchio default Costo per esecuzione del benchmark: nuovo default contro vecchio default

Alla fascia predefinita, il nuovo router eguaglia o supera il vecchio in 3 benchmark su 5: i miglioramenti più marcati sono su DSQA (ricerca, +45,6%) e WideSearch (ricerca, +16,0%), mentre si registrano lievi cali su MMLU Pro (-1,6%) e tau-bench Banking (-1,9%); parità su SWE-Atlas QnA. I costi al livello predefinito sono inferiori su MMLU Pro (-64,2%), tau-bench (-51,3%) e SWE-Atlas (-35,9%), ma su DSQA sono superiori dell'87,6% ($276 contro $147.11). Alla fascia max, il nuovo router vince tutti e 5 i benchmark: tau-bench Banking passa dal 7,2% al 31,6% (+338,9%) e SWE-Atlas QnA dal 2,4% al 60,7% (+2429,2%). I costi della fascia max, però, sono più alti in 4 benchmark su 5, con SWE-Atlas a $1,325 contro $205. Sono risultati puntuali nel tempo: OpenRouter avverte che il comportamento del routing cambia insieme alle preferenze della community.

Come evitare costi inattesi con Auto Router

Le spese impreviste sono una delle preoccupazioni più frequenti attorno ad Auto Router. Come ha osservato un utente di r/openrouter:

"Potrebbe continuare a usare Opus." - u/xtekno-id, un avvertimento sulla selezione incontrollata di modelli costosi nel contesto di un team di ingegneria.

Cinque accorgimenti concreti aiutano a mantenere i costi prevedibili:

1. Il suffisso :free non fa ciò che sembra. openrouter/auto:free non limita Auto Router ai modelli gratuiti: può comunque instradare verso modelli a pagamento. Per un routing a costo zero bisogna usare openrouter/free, che restringe il pool ai soli endpoint del tier gratuito. Lo conferma il centro assistenza di OpenRouter.

2. Affianca cost_tier a allowed_models. Impostare soltanto cost_tier=low non impedisce al router di scegliere un modello costoso per i propri volumi. Aggiungere allowed_models permette di limitarsi a famiglie specifiche: ["deepseek/*", "google/*"] mantiene nella fascia economica per la maggior parte delle attività.

3. Imposta provider.max_price come tetto rigido. Questo parametro filtra gli endpoint idonei in base al prezzo e stabilisce un limite di costo per token che opera indipendentemente dalla fascia scelta dal router.

4. Considera la commissione di piattaforma del 5,5%. OpenRouter applica una commissione del 5,5% all'acquisto di crediti, con un minimo di $0.80, non per token. Un deposito di $20 in crediti costa $21.10. La commissione si applica indipendentemente dall'uso di Auto Router: è il meccanismo di monetizzazione della piattaforma, non un sovrapprezzo del routing.

5. Attenzione alla persistenza di sessione e al costo della cache. Quando il router cambia modello nel mezzo di una conversazione, la cache di input deve essere ricostruita, aumentando il costo in token. Per limitarlo, il router usa la persistenza di sessione: identifica le conversazioni tramite un session_id esplicito o l'impronta dei messaggi, rivaluta i candidati a ogni turno ma preferisce il modello precedente quando rimane tra i candidati migliori. Se l'attività cambia in modo sostanziale, il router passerà a un altro modello e verrà addebitato il costo di ricostruzione della cache.

Quando usare Auto Router e quando fissare un modello

Auto Router è adatto a carichi di lavoro variabili, con attività diverse in momenti diversi, quando scegliere manualmente il modello diventa un collo di bottiglia. La matrice di routing offre un punto di partenza per capire a quali modelli la community affida le singole categorie di attività.

ScenarioRaccomandazione
Carichi variabili, uso generalistaopenrouter/auto con cost_tier=low
Produzione su larga scala sensibile ai costiFissare modelli specifici o usare liste di fallback
Coding multi-turn con contestoopenrouter/auto con session_id per la persistenza
Serve qualità frontier indipendentemente dal costoopenrouter/auto con cost_tier=max
Requisito di costo zeroopenrouter/free (non auto:free)
Si vogliono aggiornamenti del routing prima della release stabileopenrouter/auto-beta

Per i team di ingegneria, il compromesso più pratico è una configurazione di auto-routing vincolata: cost_tier impostato sulla fascia di budget, allowed_models limitato ai vendor approvati e provider.max_price come tetto rigido.

FAQ

OpenRouter Auto Router ha un costo aggiuntivo?

No. Usare Auto Router non comporta sovrapprezzi. Si paga la tariffa standard del modello che viene selezionato. I ricavi di OpenRouter derivano dalla commissione del 5,5% applicata all'acquisto di crediti.

openrouter/auto:free è davvero gratuito?

No. Il suffisso :free non limita il routing ai modelli gratuiti. Bisogna usare openrouter/free, il router dedicato esclusivamente ai modelli gratuiti.

Posso limitare Auto Router a provider specifici?

Sì. Nel plugin auto-router, usa il parametro allowed_models con pattern wildcard come ["anthropic/*", "openai/*"].

Come verifico quale modello è stato selezionato?

Controlla il campo model nella risposta API. Contiene l'identificatore del modello che ha elaborato la richiesta, non openrouter/auto.

Qual è la differenza tra auto e auto-beta?

openrouter/auto è il router stabile. openrouter/auto-beta riceve i miglioramenti del routing prima che arrivino sul canale stabile.

Auto Router supporta streaming e tool calling?

Sì. Sono disponibili tutte le funzionalità del modello selezionato, incluse streaming, tool calling e vision.