In breve: DeepSeek è un buon modello per far girare agenti AI come Hermes Agent, OpenClaw e Nanobot perché costa molto meno dei modelli grandi: nel listino ufficiale il modello Flash costa tra $0,15 e $0,30 per milione di token in input (cache non usata) e tra $0,60 e $1,20 in output, a seconda dell'orario. Con lo stesso lavoro, Claude Opus 5.5 costa circa 15-30 volte di più. Io li uso così, tutti e tre con DeepSeek V4 Flash, e funzionano molto bene. Il limite è che per i compiti più difficili un modello più forte può servire ancora.
Perché usare DeepSeek per gli agenti AI?
Un agente non fa una domanda sola: lavora a lungo, richiama strumenti, rilegge il contesto a ogni passo. Per questo consuma molti più token di una normale chat, e il prezzo per milione di token pesa sul conto più della qualità dell'ultimo punto percentuale in un benchmark. DeepSeek ha due caratteristiche che aiutano: i prezzi bassi e una finestra di contesto da 1 milione di token, utile quando l'agente tiene in memoria molti file e conversazioni. Per il modello in sé, i dettagli sono nell'articolo su DeepSeek V4: modelli, prezzi e fasce orarie.
Quanto costa DeepSeek rispetto ai modelli grandi?
I prezzi ufficiali di DeepSeek, per milione di token, sono questi (fascia ridotta e fascia di punta, cioè il doppio):
| Modello | Input (cache non usata) | Output |
|---|---|---|
| DeepSeek Flash (V4.1) | $0,15 / $0,30 | $0,60 / $1,20 |
| DeepSeek V4 Pro | $0,66 / $1,32 | $1,98 / $3,96 |
Le ore di punta sono dalle 01:00 alle 04:00 e dalle 06:00 alle 10:00 UTC, dal lunedì al venerdì, esclusi i festivi cinesi. Se l'input è già in cache, il costo scende ancora: per Flash è $0,003 per milione in fascia ridotta. Per confrontarlo con i modelli grandi ho calcolato un lavoro d'esempio, 1 milione di token in input e 200.000 in output, senza contare la cache:
| Modello | Costo del lavoro d'esempio* |
|---|---|
| DeepSeek Flash (fascia ridotta / di punta) | $0,27 / $0,54 |
| DeepSeek V4 Pro (fascia ridotta / di punta) | $1,06 / $2,11 |
| Claude Haiku 4.5 | $2,00 |
| Claude Sonnet 5.5 | $4,00 |
| Claude Opus 5.5 | $8,00 |
*Calcolo mio sui prezzi ufficiali (Claude: $1/$5, $2/$10 e $4/$20 per milione di token in input/output). Non è un test di qualità: dice solo quanto costa far passare lo stesso numero di token. I prezzi cambiano, quindi controlla sempre le pagine ufficiali di DeepSeek e di Anthropic.
Quanto spendo io davvero?
Ho un registro orario del saldo dell'account DeepSeek che uso con Hermes. I giorni coperti sono 26: dal 3 al 18 giugno e dal 22 settembre al 1° ottobre. In quel periodo il saldo è sceso di circa 11,5 dollari, cioè tra 0,40 e 0,60 dollari al giorno. Sono dati misurati sul mio uso, che include anche periodi di lavoro intenso, e non separano quanto consuma ogni singolo agente: il tuo dipende da quanto fai lavorare l'agente.
Come si collega DeepSeek a Hermes Agent?
Hermes Agent tratta DeepSeek come fornitore integrato: servono la chiave in ~/.hermes/.env e il fornitore nel file di configurazione.
DEEPSEEK_API_KEY=la-tua-chiave
model:
provider: "deepseek"
default: "deepseek-v4-flash"
Io uso la strada alternativa del fornitore personalizzato, con l'indirizzo https://api.deepseek.com/v1 e il modello deepseek-v4-flash. Nell'esempio della documentazione di Hermes il modello è ancora deepseek-v3: sostituiscilo con uno attuale. Usa un modello di riserva diverso se vuoi: Hermes permette anche di affiancare un secondo modello come riferimento.
Come si collega DeepSeek a OpenClaw?
La guida ufficiale di DeepSeek per OpenClaw è semplice: se lo hai già installato, esegui openclaw onboard --install-daemon, scegli DeepSeek come fornitore, inserisci la chiave API e il modello (deepseek-v4-flash o deepseek-v4-pro). Se parti da zero, l'installazione e la procedura guidata QuickStart ti portano allo stesso punto. La chiave si crea su platform.deepseek.com.
Come si collega DeepSeek a Nanobot?
Nanobot è un agente personale open source, leggero e in Python, che funziona da terminale, da interfaccia web e da app di chat come Telegram, Discord e Slack. Si installa con uv tool install nanobot-ai (o pip install nanobot-ai) e il fornitore si sceglie dalle impostazioni della WebUI (Settings, Models) o nel file ~/.nanobot/config.json. Nel mio caso il fornitore predefinito è DeepSeek con il modello deepseek-v4-flash. Poiché Nanobot parla con Telegram, puoi anche seguire la guida per creare un bot Telegram con l'AI per capire come funziona il collegamento alla chat.
Quale modello DeepSeek scegliere: Flash o Pro?
Parti da Flash: costa meno, regge più richieste in parallelo (2.500 contro 500 per Pro, secondo DeepSeek) ed è il modello che uso io per tutti e tre gli agenti. Passa a Pro per i compiti in cui Flash sbaglia o si perde, per esempio analisi lunghe o codice complicato. Un buon compromesso è usare Flash come modello di base e riservare Pro, o un modello più forte, ai passaggi difficili.
Quali sono i limiti di DeepSeek con gli agenti?
- Nomi dei modelli che cambiano. Il nome attuale è
deepseek-flash, come indica la pagina dei prezzi di DeepSeek. Il vecchiodeepseek-v4-flash, che uso io e che usano ancora le guide di OpenClaw, è per ora accettato, ma DeepSeek precisa che quel modello è stato ritirato e le richieste vengono servite dal modello V4.1 Flash e fatturate al prezzo di Flash. Se un nome smette di rispondere, controlla la pagina ufficiale. - Prezzi nelle configurazioni. Alcuni agenti hanno una tabella dei costi interna: se la copi una volta sola, resta ferma. Non fidarti dei costi stimati dall'agente, guarda il saldo sul sito del fornitore.
- Dati in Cina. L'API di DeepSeek è un servizio cinese: non mandare dati sensibili o riservati di clienti senza averne valutato le conseguenze, soprattutto se tratti dati personali nell'Unione Europea.
- Compiti difficili. Per il lavoro più complesso un modello grande, come quelli descritti in Claude Opus 5.5 e Fable 5.1, può ancora fare la differenza.
Se vuoi provare più modelli con una sola chiave, guarda anche OpenRouter. Per capire cosa sono questi strumenti nel dettaglio, leggi agent harness e OpenClaw vs Hermes.
Fonti ufficiali
Risorsa gratuita
Vuoi iniziare con l'AI?
Scarica la guida AI da Zero — PDF gratuito, pratico, senza tecnicismi.