← Tutti gli articoli
nestd-api

Quanto costa dare la ricerca web a un agente AI: prezzi delle API, costo per query e budget cap

Quanto costa davvero la ricerca web per un agente AI: modelli di prezzo delle API, i costi nascosti e come governare il budget con un tetto di spesa.

Il preventivo arriva sempre alla terza settimana. Un'azienda mette in produzione il suo primo agente AI con accesso al web — un assistente che cerca fornitori, monitora prezzi, prepara ricerche — e alla prima fattura delle API scopre che "due centesimi a query" era una storia incompleta. La domanda giusta, quella che il responsabile avrebbe voluto farsi prima, è: quanto costa davvero dare la ricerca web a un agente AI?

La risposta onesta, in tre righe: una singola ricerca costa pochi millesimi o centesimi di euro, ma un agente non fa una ricerca — ne fa dieci per ogni compito, le ripete quando falliscono e le moltiplica per ogni utente. Il costo reale non lo decide il listino: lo decide l'architettura. E si controlla con due strumenti precisi: un tetto di spesa per richiesta e un po' di disciplina ingegneristica. Vediamo i numeri.

Come tariffano davvero le API di ricerca

Sul mercato convivono quattro logiche di prezzo, e confonderle è il primo errore di valutazione:

A query — le SERP API classiche: ogni interrogazione ha un prezzo fisso, tipicamente tra 1 e 10 dollari per mille query. Prevedibile, finché il volume è prevedibile.

A pagina — le API di scraping: paghi ogni pagina scaricata, e il prezzo sale se servono proxy o rendering JavaScript. Qui la fattura dipende da come è fatto il sito che leggi, non solo da quante volte lo leggi.

A crediti — il modello degli aggregatori: compri un pacchetto, ogni operazione ne consuma una quantità variabile. Flessibile in apparenza, opaco in pratica: il credito è una valuta di cui non controlli il cambio.

A step di ricerca — le deep research API: paghi il percorso completo dell'agente (cerca, legge, approfondisce, sintetizza). Un singolo report può costare da pochi centesimi a diversi euro, e la variabilità è la caratteristica, non un difetto.

Il conto vero: tre scenari

Facciamo i conti da manager, con ordini di grandezza realistici.

Uso leggero — 100 compiti al mese. Un agente interno che fa ricerche su richiesta. Con una media di 5–10 query per compito, siamo su 500–1.000 chiamate: pochi euro al mese con qualsiasi fornitore. A questo volume il prezzo unitario è irrilevante; conta solo che il sistema funzioni.

Uso quotidiano — 1.000 compiti al mese. Monitoraggio fornitori, rassegne, verifiche automatiche. Ora sono 5–10 mila chiamate, e i costi nascosti iniziano a pesare più del listino: retry sui fallimenti, paginazione, query duplicate perché nessuno ha messo una cache. È qui che due implementazioni dello stesso servizio possono costare una il triplo dell'altra.

Scala prodotto — 10.000+ compiti al mese. La ricerca web dentro un prodotto venduto ai clienti. A questo punto il costo per query è una voce di conto economico e la domanda cambia: non "quanto costa la API" ma "quanto costa per cliente servito" — e senza un tetto di spesa automatico, un solo utente anomalo può consumare il budget di tutti.

I costi che non stanno nel listino

L'esperienza insegna che la fattura si gonfia sempre negli stessi quattro punti: i retry (un fallimento su dieci significa +10% strutturale, e i fallimenti a catena molto di più), la paginazione (una "ricerca" che scarica cinque pagine è cinque ricerche), i duplicati (agenti diversi — o lo stesso agente smemorato — che rifanno la stessa query nella stessa ora) e il fallback tra provider (la ridondanza è saggia, pagarla doppia quando il primo provider aveva già risposto no).

Nessuna di queste voci compare nei confronti di prezzo online. Tutte compaiono in fattura.

La disciplina che tiene i conti in ordine

Tre pratiche, in ordine di rendimento:

  1. Tetto di spesa per richiesta. Ogni chiamata parte con un budget massimo esplicito; superato quello, l'operazione si ferma con un risultato parziale invece di continuare a spendere. È la differenza tra un costo variabile e un costo governato — ed è il motivo per cui in NestD API ogni richiesta accetta un maxCostUsd dichiarato dal chiamante: il fornitore che ti fa impostare il tetto sta dalla parte del tuo budget.
  2. Cache e idempotenza. La stessa query nella stessa giornata non deve costare due volte; una richiesta ripetuta per un errore di rete non deve essere rifatturata. Sono ore di sviluppo che si ripagano in settimane.
  3. Passi limitati per gli agenti. Un agente senza limite di iterazioni è un tassametro senza sportello. Fissare "massimo N ricerche per compito" trasforma il caso peggiore da illimitato a noto.

Domande frequenti

Qual è un budget ragionevole per iniziare?

Per un progetto pilota, poche decine di euro al mese coprono un uso interno serio. La cifra giusta è quella che permette di misurare il valore prodotto: se dopo un mese non sai dire quanto ti ha fatto risparmiare l'agente, il problema non è il costo delle API.

Meglio un fornitore economico o uno con controllo di spesa?

A parità di qualità, il controllo vale più dello sconto: un prezzo unitario più basso senza tetto di spesa è un risparmio teorico con un rischio pratico. Il caso peggiore conta più del caso medio.

I prezzi delle deep research API sono giustificati?

Dipende dal compito: per una sintesi che avrebbe richiesto ore di un analista, alcuni euro sono un affare; per una verifica puntuale, sono uno spreco — basta una ricerca semplice. L'errore è usare lo strumento massimo per il compito minimo.

Come stimo i costi prima di mettere in produzione?

Con un pilota strumentato: due settimane di uso reale con logging di ogni chiamata e del suo costo. La proiezione da lì è aritmetica; la stima fatta a tavolino sul listino, esperienza alla mano, sbaglia sempre per difetto.

Scritto da NestD — Nord-Est Tech Development, studio di sviluppo software AI locale-first in Veneto.