kimik3.io/Stato
Stato di Kimi K3
Kimi K3 funziona in questo momento? Il tasso di successo nel tempo, più un'autodiagnosi da 60 secondi che ti dice se non funziona proprio per te.
In questo momento: verifica in corso… — rilevato dal tuo browser (caricamento pagina), aggiornato ogni 60 secondi.
kimi-k3 (finestra di 5 minuti per punto)Serie grezza raccolta; script di raccolta nel repository.
Dati live non disponibili nel tuo browser (richiesta bloccata o sei offline) — l'autodiagnosi da 60 secondi qui sotto funziona comunque.
L'autodiagnosi da 60 secondi
Una richiesta, senza SDK. Questo è esattamente il comando che abbiamo eseguito il 2026-07-18 (la risposta è subito sotto):
curl https://direct.evolink.ai/v1/chat/completions \
-H "Authorization: Bearer $EVOLINK_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"kimi-k3","messages":[{"role":"user","content":"Reply with the single word: up"}]}'
{
"model": "kimi-k3",
"choices": [{
"message": { "content": "up" },
"finish_reason": "stop"
}],
"usage": { "prompt_tokens": 92, "completion_tokens": 48 }
}
Come leggere il risultato
| Hai ottenuto | Significa | Fai così |
|---|---|---|
200 + content | Nessun disservizio. Il problema in produzione è altrove | Controlla timeout e retry nel tuo client |
401 | È la key, non il modello | Key sbagliata o scaduta, oppure variabile d'ambiente errata — corpo 401 reale |
404 | Errore di battitura nel nome del modello | L'ID è esattamente kimi-k3 — corpo 404 reale |
429 | Limite di frequenza, non un disservizio | Aspetta e riprova; controlla il credito |
5xx / timeout | Forse un incidente vero | Riprova una volta, prova l'URL di base alternativo, poi controlla i canali del provider |
200 + content vuoto | Non è un disservizio — è la trappola di max_completion_tokens, fatturata per intero | Le sei esecuzioni che la mappano |
| 200 ma molto lento | Varianza, non morte — abbiamo misurato 36s su un prompt banale | Usa lo streaming per impostazione predefinita; imposta i timeout del client in minuti — i tempi misurati |
Tre cose che sembrano un disservizio ma non lo sono
- L'attesa silenziosa. K3 ragiona prima di rispondere, a ogni richiesta. Senza streaming sono secondi, a volte minuti, di niente sul filo: una chiamata che sembra bloccata e invece sta lavorando. Lo streaming mostra i token di ragionamento entro ~3s e fa sembrare viva la stessa identica chiamata.
- La risposta vuota. Un
max_completion_tokenstroppo stretto restituisce HTTP 200, una stringa vuota e la fattura piena. Qualsiasi monitoraggio che guarda solo gli status code chiama questo «funzionante»; qualsiasi utente lo chiama «rotto». Non è né l'uno né l'altro: è un'impostazione. - Il timeout dell'SDK. Le chiamate a contesto lungo durano legittimamente 52+ secondi; i timeout predefiniti del client le uccidono e segnalano un errore. Il modello non è caduto: si è arreso il tuo client HTTP. Con contesto lungo imposta i timeout in minuti.
FAQ sullo stato
Kimi K3 non funziona in questo momento?
Rispondono i grafici in cima alla pagina: si aggiornano con dati correnti ogni 60 secondi. Per il tuo stack in particolare, la risposta definitiva è l'autodiagnosi da 60 secondi qui sopra.
Perché Kimi K3 è così lento?
Di solito non è caduto: sta pensando. K3 ragiona su ogni richiesta prima di emettere la risposta; senza streaming sembra un blocco, e abbiamo misurato una varianza reale (3.6s e 36.1s di tempo reale sullo stesso prompt banale in esecuzioni diverse). Usa lo streaming per impostazione predefinita e il primo token di ragionamento arriva in ~3s.
Perché la mia chiamata restituisce HTTP 200 ma content vuoto?
È la trappola di max_completion_tokens, non un disservizio: i budget pari o inferiori a ~1,024 hanno restituito stringhe vuote con finish_reason: "length", fatturate per intero, in tutte e sei le nostre esecuzioni di test. Lascia il parametro al valore predefinito di 131,072.
Ogni quanto viene aggiornata questa pagina?
Il blocco live si aggiorna da solo nel tuo browser ogni 60 secondi, senza alcun intervento da parte nostra. Lo script di verifica è nel repository del sito, quindi puoi eseguire esattamente ciò che eseguiamo noi.
Esegui l'autodiagnosi con la tua key
EvoLink offre kimi-k3 su un endpoint compatibile con OpenAI: una sola key raggiunge GPT, Claude, Gemini e decine dei principali modelli al mondo. 10 crediti gratuiti e registrazione da qualsiasi paese, senza numero di telefono cinese.