Blog
Risolvere OpenRouter 429: errore del provider o limite di frequenza?
Una guida pratica per diagnosticare gli errori 429 di OpenRouter: limiti attuali dei modelli gratuiti, controlli sul fallback dei provider e codice di retry che rispetta Retry-After.
DeepSeek V4 Flash vs GLM-5.2: test dell'aggiornamento 0731
Ho testato DeepSeek V4 Flash (0731) e GLM-5.2 su quattro task valutati. Pareggio in tre casi; sul quarto GLM-5.2 non ha mai restituito una risposta, mentre Flash è costato 19 volte meno nel complesso. Prezzi verificati il 2026-07-31.
La B2B Ad Intelligence passa dall'HTML: come scrivere un parser che resiste ai redesign
La maggior parte delle librerie pubblicitarie B2B non ha API JSON: espone soltanto HTML renderizzato dal server. Ecco come costruire un parser streaming resistente ai redesign e dove un modello può essere utile, confrontando HTML vecchio e nuovo per suggerire le correzioni.
Metti a confronto creator e asset: smetti di scegliere in base ai follower
Scegliere i creator in base al numero di follower è sistematicamente sbagliato. Parti dalle creatività che funzionano, estrai la loro struttura, individua a ritroso i creator con contenuti compatibili e collega ogni match a un video specifico.
Dalle keyword al budget: come trasformare volume, CPC e concorrenza in un unico numero
Un tool per keyword restituisce tre metriche isolate, ma per un lancio serve un budget unico. Ecco le insidie dei dati, perché si ragiona per set e perché le keyword espanse restano ipotesi finché il volume reale non le conferma.
Come leggere la curva di retention secondo per secondo di un annuncio: tre curve e un percentile
Analizzare le creatività dei competitor in base a visualizzazioni e like non dice nulla. Per il prossimo script contano i punti di flesso di tre curve al secondo e il posizionamento del CTR nella categoria, non il valore assoluto.
22 piattaforme, 241 comandi e perché non ho creato un modello di risposta unificato
Il modello unificato Post/User è il primo istinto nella raccolta cross-platform, ma con oltre venti piattaforme collassa. Meglio trattare ogni piattaforma come un bounded context e normalizzare separatamente.
329 comandi, 128 ancora assenti: una migrazione si riconcilia con la teoria degli insiemi, non con un modello
Un modello può tradurre bene una funzione, ma verificare che l'intera migrazione sia completa è matematica degli insiemi. Deriva entrambi i set di comandi dalle dichiarazioni, calcola il diff con uno script e lascia al modello il compito di spiegare le differenze, non di trovarle.
API GraphQL senza query nella richiesta: due strade per recuperare un’operazione persistita
Con le operazioni GraphQL persistite, nella cattura trovi operationName e hash, non la query. Puoi recuperare la mappatura dal build client o replicare l’hash come black box: due approcci con costi molto diversi.
Non trovi la logica di firma nel codice? Potrebbe non esserci affatto
Alcune firme non esistono nel codice statico. Il server può inviare uno script monouso a runtime, oppure il valore è una costante di build che cambia a ogni release. Eseguila o leggila: non cercare di invertirla.
Tutti gli hook Frida scattano. Eppure gli endpoint utilizzabili sono zero.
Tutti gli hook Frida scattano, ma gli endpoint utilizzabili restano zero. Un hook che funziona non è una capability pronta: tra i due ci sono quattro soglie di evidenza, e dichiarare onestamente “non ancora utilizzabile” è meglio che distribuire un guscio vuoto.
Dai 300 annunci dei competitor a un modello e ottieni quattro aggettivi: fai così invece
Chiedi a un modello di riassumere 300 annunci dei competitor e riceverai quattro aggettivi inutili. Prima estrai campi strutturati, un annuncio alla volta; poi raggruppa quei campi e chiedi al modello di portare un controesempio.
Dalla keyword all'annuncio finito: una pipeline in cinque fasi e sei stati per farla funzionare davvero
L'automazione delle creatività pubblicitarie non funziona con una semplice keyword e un video in uscita. Ecco una pipeline in cinque fasi, i sei stati che la rendono gestibile e il gate delle evidenze che evita di generare senza dati.
Le descrizioni degli strumenti degli Agent vanno fuori sincrono: la dichiarazione deve essere l’unica fonte di verità
Le descrizioni degli strumenti mantenute a mano finiscono per divergere dalle firme reali delle funzioni, così il modello invoca tool con argomenti che hai modificato. Generale dalla dichiarazione, così non resta nulla che possa andare fuori sincrono.
MiniMax H3: specifiche, prezzi e confronto con la concorrenza
Cos'è MiniMax H3 (un modello video, non M3), specifiche e prezzi ufficiali verificati, confronto con Veo, Kling e Seedance, cosa significa davvero open-weights e come accedervi.
GPT-5.6 Luna vs GPT-5.4 Mini: quale costa meno oggi?
Dopo il taglio del 30 luglio, GPT-5.6 Luna ($0.20/$1.20) costa circa il 73% in meno di GPT-5.4 mini ($0.75/$4.50) e si allinea a nano. Nei test con gli stessi prompt Luna vince sul costo; mini sulla latenza.
API LLM più economiche per il coding: testati 4 modelli (2026)
DeepSeek V4 Flash è stata l'API più economica per il coding tra quelle testate; Kimi K2.7 Code ha dato la risposta più completa, mentre GPT-5.4 mini è stata la più veloce.
Quando riscrivere e quando accettare un bridge del browser: la scala a tre livelli per integrare codice reverse-engineered
La logica reverse-engineered può essere integrata in tre forme: riscrittura nativa, motore JS locale o bridge passivo del browser. Ogni gradino verso il basso fa salire i costi di un ordine di grandezza: per questo bisogna puntare al livello più alto.
Differential Testing: l’unico controllo che ferma le allucinazioni dei modelli nel reverse engineering
L’ipotesi di un LLM su un algoritmo resta solo un’ipotesi finché non scrivi l’assert. Il differential testing trasforma un “forse” in un “sì/no”: input limite, entropia nascosta, analisi a strati e fixture durature.
Reverse engineering di una firma offuscata: il 90% è standard, il 10% che uccide sono i punti di deviazione
In una firma offuscata, gran parte del codice è standard e si può riprodurre fedelmente; il lavoro vero è nel 10% alterato in modo quasi invisibile. Vediamo quattro tipi di deviazione e perché per trovarli serve un modello capace di ragionare.