Quanto costa dare la ricerca web a un agente AI: prezzi delle API, costo per query e budget cap
Quanto costa davvero la ricerca web per un agente AI: modelli di prezzo delle API, i costi nascosti e come governare il budget con un tetto di spesa.
Il preventivo arriva sempre alla terza settimana. Un'azienda mette in produzione il suo primo agente AI con accesso al web — un assistente che cerca fornitori, monitora prezzi, prepara ricerche — e alla prima fattura delle API scopre che "due centesimi a query" era una storia incompleta. La domanda giusta, quella che il responsabile avrebbe voluto farsi prima, è: quanto costa davvero dare la ricerca web a un agente AI?
La risposta onesta, in tre righe: una singola ricerca costa pochi millesimi o centesimi di euro, ma un agente non fa una ricerca — ne fa dieci per ogni compito, le ripete quando falliscono e le moltiplica per ogni utente. Il costo reale non lo decide il listino: lo decide l'architettura. E si controlla con due strumenti precisi: un tetto di spesa per richiesta e un po' di disciplina ingegneristica. Vediamo i numeri.
Come tariffano davvero le API di ricerca
Sul mercato convivono quattro logiche di prezzo, e confonderle è il primo errore di valutazione:
A query — le SERP API classiche: ogni interrogazione ha un prezzo fisso, tipicamente tra 1 e 10 dollari per mille query. Prevedibile, finché il volume è prevedibile.
A pagina — le API di scraping: paghi ogni pagina scaricata, e il prezzo sale se servono proxy o rendering JavaScript. Qui la fattura dipende da come è fatto il sito che leggi, non solo da quante volte lo leggi.
A crediti — il modello degli aggregatori: compri un pacchetto, ogni operazione ne consuma una quantità variabile. Flessibile in apparenza, opaco in pratica: il credito è una valuta di cui non controlli il cambio.
A step di ricerca — le deep research API: paghi il percorso completo dell'agente (cerca, legge, approfondisce, sintetizza). Un singolo report può costare da pochi centesimi a diversi euro, e la variabilità è la caratteristica, non un difetto.
Il conto vero: tre scenari
Facciamo i conti da manager, con ordini di grandezza realistici.
Uso leggero — 100 compiti al mese. Un agente interno che fa ricerche su richiesta. Con una media di 5–10 query per compito, siamo su 500–1.000 chiamate: pochi euro al mese con qualsiasi fornitore. A questo volume il prezzo unitario è irrilevante; conta solo che il sistema funzioni.
Uso quotidiano — 1.000 compiti al mese. Monitoraggio fornitori, rassegne, verifiche automatiche. Ora sono 5–10 mila chiamate, e i costi nascosti iniziano a pesare più del listino: retry sui fallimenti, paginazione, query duplicate perché nessuno ha messo una cache. È qui che due implementazioni dello stesso servizio possono costare una il triplo dell'altra.
Scala prodotto — 10.000+ compiti al mese. La ricerca web dentro un prodotto venduto ai clienti. A questo punto il costo per query è una voce di conto economico e la domanda cambia: non "quanto costa la API" ma "quanto costa per cliente servito" — e senza un tetto di spesa automatico, un solo utente anomalo può consumare il budget di tutti.
I costi che non stanno nel listino
L'esperienza insegna che la fattura si gonfia sempre negli stessi quattro punti: i retry (un fallimento su dieci significa +10% strutturale, e i fallimenti a catena molto di più), la paginazione (una "ricerca" che scarica cinque pagine è cinque ricerche), i duplicati (agenti diversi — o lo stesso agente smemorato — che rifanno la stessa query nella stessa ora) e il fallback tra provider (la ridondanza è saggia, pagarla doppia quando il primo provider aveva già risposto no).
Nessuna di queste voci compare nei confronti di prezzo online. Tutte compaiono in fattura.
La disciplina che tiene i conti in ordine
Tre pratiche, in ordine di rendimento:
- Tetto di spesa per richiesta. Ogni chiamata parte con un budget massimo esplicito; superato quello, l'operazione si ferma con un risultato parziale invece di continuare a spendere. È la differenza tra un costo variabile e un costo governato — ed è il motivo per cui in NestD API ogni richiesta accetta un
maxCostUsddichiarato dal chiamante: il fornitore che ti fa impostare il tetto sta dalla parte del tuo budget. - Cache e idempotenza. La stessa query nella stessa giornata non deve costare due volte; una richiesta ripetuta per un errore di rete non deve essere rifatturata. Sono ore di sviluppo che si ripagano in settimane.
- Passi limitati per gli agenti. Un agente senza limite di iterazioni è un tassametro senza sportello. Fissare "massimo N ricerche per compito" trasforma il caso peggiore da illimitato a noto.
Domande frequenti
Qual è un budget ragionevole per iniziare?
Per un progetto pilota, poche decine di euro al mese coprono un uso interno serio. La cifra giusta è quella che permette di misurare il valore prodotto: se dopo un mese non sai dire quanto ti ha fatto risparmiare l'agente, il problema non è il costo delle API.
Meglio un fornitore economico o uno con controllo di spesa?
A parità di qualità, il controllo vale più dello sconto: un prezzo unitario più basso senza tetto di spesa è un risparmio teorico con un rischio pratico. Il caso peggiore conta più del caso medio.
I prezzi delle deep research API sono giustificati?
Dipende dal compito: per una sintesi che avrebbe richiesto ore di un analista, alcuni euro sono un affare; per una verifica puntuale, sono uno spreco — basta una ricerca semplice. L'errore è usare lo strumento massimo per il compito minimo.
Come stimo i costi prima di mettere in produzione?
Con un pilota strumentato: due settimane di uso reale con logging di ogni chiamata e del suo costo. La proiezione da lì è aritmetica; la stima fatta a tavolino sul listino, esperienza alla mano, sbaglia sempre per difetto.
Scritto da NestD — Nord-Est Tech Development, studio di sviluppo software AI locale-first in Veneto.