kimik3.io/Changelog
Changelog di Kimi K3
Due binari, entrambi datati. Il primo: cosa è cambiato in Kimi K3 — fatti sul modello, prezzi, comportamento dell'API. Il secondo: cosa è cambiato su kimik3.io, il sito che lo misura.
Kimi K3: modifiche al modello e all'API
2026-07-20 — guida rapida ufficiale: architettura, input immagini, data dei pesi
- Architettura dichiarata ufficialmente. Kimi K3 ha 2.8 mila miliardi di parametri, è costruito su Kimi Delta Attention (KDA) — un meccanismo di attenzione lineare ibrida — con Attention Residuals, e attiva 16 esperti su 896 (dalla guida rapida ufficiale di Moonshot, letta 2026-07-20).
- Formato dell'input immagini documentato. L'input immagini non supporta URL pubblici: le immagini si passano in base64 oppure come
ms://<file-id>, concontentsotto forma di array di oggetti (stessa guida rapida, letta 2026-07-20; comportamento documentato, non misurato da noi). - Data dei pesi. I pesi completi del modello saranno rilasciati entro il 27 luglio 2026 (dalla guida rapida di Moonshot, letta 2026-07-20). Li seguiamo dal vivo sulla pagina dei pesi.
2026-07-18 — comportamento dell'API, rimisurato tramite EvoLink
- Un ID modello sbagliato fallisce dandoti una mano. Chiamare
kimi-k3-chatrestituisce HTTP 404 con"did_you_mean":"kimi-k3"nel corpo dell'errore. - I budget oltre il limite vengono troncati in silenzio.
max_completion_tokens= 2,000,000 restituisce HTTP 200: il valore viene troncato, non rifiutato. tool_choiceforzato viene rifiutato. Forzare una funzione specifica restituisce HTTP 400: «tool_choice 'specified' is incompatible with thinking enabled».toolscon selezione automatica funziona.- I blocchi di cache da 256 token si riproducono su EvoLink.
cached_tokensè tornato con 1024 / 4352 / 17408 / 70400 — tutti multipli di 256, in linea con il risultato del 2026-07-16 in collegamento diretto a Moonshot.
2026-07-16 — istantanea dei prezzi ufficiali
- Tariffe lette dalla pagina ufficiale dei prezzi: $3.00 / 1M di input con miss della cache, $0.30 / 1M con hit della cache, $15.00 / 1M di output; finestra di contesto 1,048,576 token (pagina ufficiale dei prezzi, letta 2026-07-16).
Registro del sito kimik3.io
2026-07-18 — verifica in produzione e vigilanza sui pesi
- Gate di pubblicazione riverificato in produzione. Ogni blocco di codice del sito è stato rieseguito alla lettera sull'endpoint di produzione di EvoLink (direct.evolink.ai): guida rapida, streaming e controllo dell'hit di cache sono passati tutti; un prompt ripetuto ha riportato
cached_tokens = 92. - Nuova pagina: Pesi aperti. Moonshot si è impegnata ufficialmente a rilasciare i pesi di K3 entro il 27 luglio 2026. La pagina segue lo stato, fa i conti sull'hardware a partire dalla cifra ufficiale di 2.8T e verrà aggiornata nelle ore successive al rilascio.
- Home page: i fatti «Che cos'è Kimi K3» e una FAQ. Fatti sull'architettura (2.8T parametri totali, 16 esperti su 896, Kimi Delta Attention, comprensione visiva nativa) citati dalla guida rapida ufficiale con data 2026-07-18, più una FAQ da sei domande con dati strutturati FAQPage.
- Nuova pagina: Kimi K3 non funziona? Controlli datati in produzione (2026-07-18: attiva — TTFT mediano 3.35s su tre esecuzioni in streaming e un valore anomalo di 36.1s senza streaming sullo stesso prompt), un'autodiagnosi con curl da 60 secondi eseguita alla lettera in produzione e una tabella di triage per le modalità di guasto che sembrano disservizi ma non lo sono. Dati grezzi pubblicati; script di controllo aggiunto al repository.
- Nuova pagina: Prova Kimi K3 gratis. Le due vie gratuite oneste — l'app di chat di Moonshot (dalla guida rapida ufficiale) oppure l'API con 10 crediti gratuiti alla registrazione — più come far durare di più i crediti.
- Pagina di stato ricostruita attorno a grafici live. Tasso di successo e latenza come grafici a linee su 24 ore, alimentati da un collector che gira da solo (
scripts/collect_status_point.py+ un workflow pianificato); la serie è pubblicata su /data/status-history.json.
2026-07-16 — lancio del sito
- Sito lanciato con undici pagine: home, guida API, prezzi, caching del prompt, finestra di contesto, latenza, riferimento errori, l'approfondimento sulle risposte vuote, calcolatore dei costi, questo changelog e la pagina Chi siamo.
- Pubblicata la prima serie di misurazioni. Abbiamo eseguito
kimi-k3suapi.moonshot.aie registrato:- la trappola della risposta vuota su sei budget;
- la quota di token di ragionamento — 43–77% dell'output;
- la granularità dei blocchi di cache da 256 token su nove prefissi;
- l'assenza di effetti misurabili di
prompt_cache_key; - la persistenza della cache per almeno 210s;
- la latenza da ~90 a 497,718 token di prompt.
- Prezzi verificati sulla pagina ufficiale: $3.00 / $0.30 / $15.00 per 1M, contesto 1,048,576. EvoLink ha confermato di offrire
kimi-k3alle stesse tariffe, senza ricarico (documentazione EvoLink su kimi-k3). - Blog lanciato. /blog/ ha aperto con la sua prima guida — Kimi K3 API from Russia — pubblicata in inglese e in russo lo stesso giorno.
- Correzione, prima della pubblicazione: due voci della tabella errori scritte a partire dalla documentazione prima di avere una key — la validazione di
reasoning_efforte il tetto dimax_completion_tokens— sono state smentite dalle misurazioni (entrambe restituiscono HTTP 200) e sostituite con quello che succede davvero. - Correzione, prima della pubblicazione: il nostro primo test su
prompt_cache_keyriutilizzava un prefisso già scaldato da un test precedente, il che invalidava il risultato. Rieseguito con un prefisso nuovo; quello pubblicato è il test pulito. - Uscita la versione cinese. Tutte e undici le pagine pubblicate in cinese semplificato sotto /zh/, che rispecchiano uno a uno il contenuto inglese e sono collegate via hreflang.
- Uscita la versione russa. Tutte e undici le pagine pubblicate in russo sotto /ru/, che rispecchiano uno a uno il contenuto inglese e sono collegate via hreflang.
Non esistono voci precedenti: questo è il primo giorno. L'impegno da qui in avanti: prezzi riverificati sulla pagina ufficiale e ridatati a ogni cambiamento; nuove misurazioni datate; correzioni elencate qui.