kimik3.io/Prezzi/Calcolatore

Calcolatore dei costi di Kimi K3

Il tuo carico di lavoro, le tariffe ufficiali e quanto fa risparmiare davvero il caching del prompt. Tutto gira nel browser: niente viene inviato da nessuna parte.

Il tuo carico di lavoro

Prompt di sistema + schemi dei tool + documenti: la parte che si ripete byte per byte. È l'unica che può finire in cache.

Il turno dell'utente: sempre fatturato alla tariffa piena di $3.00/1M.

Include il ragionamento — l'abbiamo misurato al 43–77% dell'output (tre prompt, una esecuzione ciascuno). Prevedi diverse volte la lunghezza della risposta.

Quota di token del prefisso serviti dalla cache. I loop agentici stabili la tengono alta; tutto ciò che fa derivare il prefisso la abbassa.

Stima della spesa mensile · 30 giorni

$—
Input: prefisso
Input: parte variabile a $3.00/1M
Output a $15.00/1M, ragionamento incluso
Totale
Stesso carico, zero hit della cache
La cache ti fa risparmiare

Tariffe dalla pagina dei prezzi ufficiale, letta il 2026-07-20 — le stesse tariffe che paghi tramite EvoLink. È una stima, non un preventivo: la prima chiamata di ogni periodo freddo è fatturata a prezzo pieno, fino a 255 token di coda non finiscono mai in cache e la quota reale di ragionamento cambia da prompt a prompt.

Tre carichi di lavoro di riferimento

Gli stessi conti del calcolatore qui sopra, già svolti — per orientarsi e per chi legge senza JavaScript. Tariffe ufficiali del 2026-07-20; mesi da 30 giorni.

Costo mensile = prefisso×(hit·$0.30 + miss·$3.00) + variabile×$3.00 + output×$15.00, per 1M di token.
Carico di lavoroProfiloAl meseSenza cache
Chatbot leggero 1,000 richieste/giorno · 400 di input variabile · 600 di output · nessun prefisso ripetuto $306 $306 (non si ripete nulla)
Loop agentico 200 richieste/giorno · prefisso fisso da 50k al 90% di hit · 500 variabile · 800 di output $252 $981
Domande su documenti lunghi 20 richieste/giorno · documento da 400k al 95% di hit · 200 variabile · 1,000 di output $114 $729

La riga del chatbot è un problema di costo dell'output: la cache non può aiutare un prompt che non si ripete mai, e il ragionamento sta dentro quel numero di output. Le altre due righe sono il motivo per cui la disposizione del prefisso vale un pomeriggio di lavoro: stesso traffico, 4–6× di differenza.

Come funzionano i conti

La formula è nella didascalia della tabella qui sopra; quello che conviene interiorizzare è dove sta la leva. Dei tre flussi di costo, solo il prefisso fisso risponde al tasso di hit della cache: il turno variabile è sempre fatturato alla tariffa di input piena, e l'output (ragionamento incluso) la cache non lo tocca affatto. Più il prefisso è grande rispetto al resto, più il tasso di hit sposta il totale.

La leva più potente è il tasso di hit: trascina il cursore da 0 al 90% e guarda la riga del prefisso. Tenerlo alto è un problema di disposizione, non di budget: byte stabili all'inizio, turno variabile alla fine, nessuna deriva.

Ora provalo sul serio

EvoLink serve kimi-k3 a queste stesse tariffe su un endpoint compatibile con OpenAI — 10 crediti gratuiti e registrazione da qualsiasi paese, senza numero di telefono cinese.

Ottieni una API key EvoLink