kimik3.io/Stato

Stato di Kimi K3

Kimi K3 funziona in questo momento? Il tasso di successo nel tempo, più un'autodiagnosi da 60 secondi che ti dice se non funziona proprio per te.

In questo momento: verifica in corso… — rilevato dal tuo browser (caricamento pagina), aggiornato ogni 60 secondi.

Tasso di successo, ultime 24 h — kimi-k3 (finestra di 5 minuti per punto)

Serie grezza raccolta; script di raccolta nel repository.

L'autodiagnosi da 60 secondi

Una richiesta, senza SDK. Questo è esattamente il comando che abbiamo eseguito il 2026-07-18 (la risposta è subito sotto):

curl · verificato in produzione
curl https://direct.evolink.ai/v1/chat/completions \
  -H "Authorization: Bearer $EVOLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"kimi-k3","messages":[{"role":"user","content":"Reply with the single word: up"}]}'
risposta reale (ridotta) · 2026-07-18
{
  "model": "kimi-k3",
  "choices": [{
    "message": { "content": "up" },
    "finish_reason": "stop"
  }],
  "usage": { "prompt_tokens": 92, "completion_tokens": 48 }
}

Come leggere il risultato

Cosa significa ogni esito e dove andare dopo. I corpi di errore sono reali: li abbiamo provocati uno per uno di proposito.
Hai ottenutoSignificaFai così
200 + contentNessun disservizio. Il problema in produzione è altroveControlla timeout e retry nel tuo client
401È la key, non il modelloKey sbagliata o scaduta, oppure variabile d'ambiente errata — corpo 401 reale
404Errore di battitura nel nome del modelloL'ID è esattamente kimi-k3corpo 404 reale
429Limite di frequenza, non un disservizioAspetta e riprova; controlla il credito
5xx / timeoutForse un incidente veroRiprova una volta, prova l'URL di base alternativo, poi controlla i canali del provider
200 + content vuotoNon è un disservizio — è la trappola di max_completion_tokens, fatturata per interoLe sei esecuzioni che la mappano
200 ma molto lentoVarianza, non morte — abbiamo misurato 36s su un prompt banaleUsa lo streaming per impostazione predefinita; imposta i timeout del client in minuti — i tempi misurati

Tre cose che sembrano un disservizio ma non lo sono

  • L'attesa silenziosa. K3 ragiona prima di rispondere, a ogni richiesta. Senza streaming sono secondi, a volte minuti, di niente sul filo: una chiamata che sembra bloccata e invece sta lavorando. Lo streaming mostra i token di ragionamento entro ~3s e fa sembrare viva la stessa identica chiamata.
  • La risposta vuota. Un max_completion_tokens troppo stretto restituisce HTTP 200, una stringa vuota e la fattura piena. Qualsiasi monitoraggio che guarda solo gli status code chiama questo «funzionante»; qualsiasi utente lo chiama «rotto». Non è né l'uno né l'altro: è un'impostazione.
  • Il timeout dell'SDK. Le chiamate a contesto lungo durano legittimamente 52+ secondi; i timeout predefiniti del client le uccidono e segnalano un errore. Il modello non è caduto: si è arreso il tuo client HTTP. Con contesto lungo imposta i timeout in minuti.

FAQ sullo stato

Kimi K3 non funziona in questo momento?

Rispondono i grafici in cima alla pagina: si aggiornano con dati correnti ogni 60 secondi. Per il tuo stack in particolare, la risposta definitiva è l'autodiagnosi da 60 secondi qui sopra.

Perché Kimi K3 è così lento?

Di solito non è caduto: sta pensando. K3 ragiona su ogni richiesta prima di emettere la risposta; senza streaming sembra un blocco, e abbiamo misurato una varianza reale (3.6s e 36.1s di tempo reale sullo stesso prompt banale in esecuzioni diverse). Usa lo streaming per impostazione predefinita e il primo token di ragionamento arriva in ~3s.

Perché la mia chiamata restituisce HTTP 200 ma content vuoto?

È la trappola di max_completion_tokens, non un disservizio: i budget pari o inferiori a ~1,024 hanno restituito stringhe vuote con finish_reason: "length", fatturate per intero, in tutte e sei le nostre esecuzioni di test. Lascia il parametro al valore predefinito di 131,072.

Ogni quanto viene aggiornata questa pagina?

Il blocco live si aggiorna da solo nel tuo browser ogni 60 secondi, senza alcun intervento da parte nostra. Lo script di verifica è nel repository del sito, quindi puoi eseguire esattamente ciò che eseguiamo noi.

Esegui l'autodiagnosi con la tua key

EvoLink offre kimi-k3 su un endpoint compatibile con OpenAI: una sola key raggiunge GPT, Claude, Gemini e decine dei principali modelli al mondo. 10 crediti gratuiti e registrazione da qualsiasi paese, senza numero di telefono cinese.

Ottieni una API key EvoLink