Blog
Modelli K2 Horizon: Apache 2.0, MoVA e costi di self-hosting
Un'analisi pratica dell'economia di K2 Horizon: cosa copre Apache 2.0, perché MoVA riduce il calcolo attivo ma non la memoria e quando l'hosting locale ha senso.
Prezzi API di GPT-6 Astra (2026): costi, limiti e accesso
Guida pratica ai prezzi API di GPT-6 Astra: tariffe attuali per token, sovrapprezzo sull’intera richiesta oltre 272K token, moltiplicatori delle modalità di servizio, stato dell’accesso, quote, verifiche per la migrazione ed esempi di fattura.
Memoria per agenti di coding con Funes: configurazione di Claude Code e Codex
Guida pratica alla memoria per agenti di coding con Funes: installa il binario, indicizza le sessioni di Claude Code e Codex, verifica i recuperi, condividi una memoria privata tramite Hub ed evita gli errori più comuni di sicurezza e affidabilità.
Recensione Grok Bot: agente persistente o semplice chat?
Una recensione di Grok Bot basata sui fatti: identità nominativa, memoria, strumenti, routine e stato persistente del computer rispetto a una normale sessione chat, con un verdetto pratico su acquisto o attesa.
Modelli K2 Horizon: quale dimensione scegliere? (2026)
Confronto tra tutti e sei i modelli K2 Horizon per carico di lavoro, memoria, benchmark, apertura e modalità di serving. In pratica, il modello più grande non è automaticamente la scelta migliore.
Data di uscita di ChatGPT Astra: cosa ha confermato OpenAI
ChatGPT Astra è un modello OpenAI in arrivo e ufficialmente confermato, ma al 3 settembre 2026 non sono ancora state comunicate una data di uscita pubblica, un’API, un prezzo o l’accesso tramite il normale ChatGPT.
Recensione di Claude Cowork e del controllo del computer: lavoro in background e rischi
Claude Cowork può delegare attività utili, ma “esecuzione in background” può significare due cose molto diverse. Questa recensione distingue il lavoro nel cloud dal controllo diretto dello schermo e propone una regola prudente per iniziare.
Gemini 3.8 Flash in Cursor: contesto, costi e configurazione
Una guida a Gemini 3.8 Flash in Cursor: accesso, pool di utilizzo, prezzi, limiti di contesto, impostazioni di effort, migrazione e un workflow più sicuro per gli agenti di coding.
Prezzo e recensione dell’API Muse Spark 1.3 (2026)
Muse Spark 1.3 è un modello promettente ed economico per coding e agenti, ma la latenza elevata al primo token, il numero ridotto di provider e benchmark ancora provvisori lo rendono una scelta da testare prima di adottare.
Kling AI Watermark Remover: metodi ufficiali e rischi
Il metodo più sicuro per rimuovere la filigrana da Kling AI è usare l’opzione ufficiale di esportazione inclusa nei piani a pagamento. Questa guida spiega come attivare il download senza watermark, quanto costano i piani, cosa non è ancora chiaro sulle API, quali promesse fanno gli strumenti di terze parti e quali rischi comportano sul piano delle policy.
Suno ha un’API? Stato ufficiale e alternative
Suno pubblicizza una Platform API proprietaria, ma la pagina pubblica non mostra documentazione dettagliata degli endpoint né i prezzi. Questa guida distingue l’accesso ufficiale dalle alternative di terze parti.
Cursor Self-Hosted Machines: analisi della privacy (2026)
Un’analisi dei flussi di dati di Cursor Self-Hosted Machines: cosa resta sul worker, cosa ne esce, cosa cambia con Privacy Mode e quando il self-hosting non è la scelta giusta.
Recensione dei prezzi dell’API Gemini 3.8 Flash (2026)
Gemini 3.8 Flash merita un test per agenti multimodali e specializzati, ma un ragionamento più approfondito può aumentare il costo per attività. Confronta tariffe API, limiti, risultati dei benchmark e strategia di rollout.
Guida all’API Gemini per la comprensione agentica dei video
Una guida pratica alla comprensione agentica dei video con Gemini: scelta della modalità in base al compito, configurazione con Interactions e GenerateContent, dichiarazioni su prezzi e prestazioni, modelli supportati e piano di test per la produzione.
Stato del rilascio di Grok 4.7: API, data e specifiche (2026)
Una verifica aggiornata sullo stato di Grok 4.7 che separa la documentazione ufficiale di xAI dalle dichiarazioni del fondatore, dalle indiscrezioni e dall’opzione Grok 4.6 già disponibile per gli sviluppatori.
API Qwen3.8-Max-0902: rilascio, prezzi e limiti
Qwen3.8-Max-0902 sembra essere una revisione già attiva su QwenCloud, non uno SKU documentato separatamente. Questa guida esamina l'ID API pubblico, i prezzi regionali, i limiti di contesto, i pesi aperti e un'adozione prudente.
Fable 5.1 vs ChatGPT 5.6 Sol: quale scegliere?
Fable 5.1 guida diversi benchmark agentici pubblicati, mentre GPT-5.6 Sol costa meno e offre una superficie di strumenti API documentata più ampia. Questa guida separa le evidenze dalla scelta pratica.
Fable 5.1 vs Opus 5 (2026): costi, benchmark e casi d'uso
Opus 5 è il punto di partenza più sensato per la maggior parte dei carichi di lavoro. Fable 5.1 merita di essere valutato per attività di lunga durata e ricche di tool, quando i suoi vantaggi nei benchmark e nella cache resistono alla verifica sul proprio caso d'uso.
Fable 5.1 vs 5: costi, benchmark e cambiamenti alle API
Fable 5.1 mantiene i prezzi di listino di Fable 5, pari a 10/50 $, e il contesto da 1M di token, ma riduce del 75% il costo delle letture dalla cache e modifica la gestione dei tool forzati e dei blocchi di thinking.
Miglior modello OpenRouter per roleplay: costi, contesto e configurazione nel 2026
Guida pratica 2026 per scegliere un modello OpenRouter per roleplay: slug aggiornati, contesto e prezzi, scenari di costo per 1.000 turni, limiti del piano gratuito e configurazione con SillyTavern e JanitorAI.