Kimi K3 est le meilleur modèle jamais créé. Parfois.
Trois points du sommet. Environ un tiers du coût par tâche.
Bonjour,
Kimi K3 vient de sortir avec un score de 57 chez Artificial Analysis, soit trois points du meilleur score affiché dans leur sélection. Son coût pondéré par tâche : 0,94 $, contre 2,75 $ pour Fable 5.
Il prend aussi, à titre préliminaire, la première place de Code Arena WebDev avec 1 679 points.
Donc le meilleur modèle du monde ? Non.
Parfois.
Score Kimi K3
57
À trois points du sommet
Coût par tâche
0,94 $
Contre 2,75 $ pour Fable 5
Le calendrier est presque plus intéressant que les trois barres colorées.
Epoch AI mesurait sept mois de retard chinois en moyenne depuis 2023. Cette fois, cinq semaines séparent Fable 5 et K3. Pendant que Washington gérait son guichet export, Moonshot livrait.
Moi, je ne change pas ma stack aujourd’hui. Les poids sont annoncés, mais pas encore disponibles, et les démonstrations constructeur restent des démonstrations constructeur.
Je vais quand même tester Kimi sur un vrai projet, parce que le marché a tendance à trancher plus vite que les communiqués.
Voir ce que les graphiques ne disent pas.
L’analyse complète de Kimi K3, de son prix et de ce que je veux encore vérifier sur un vrai projet.