Kimi K3-256k : nouveau modèle de code lancé
Original : Kimi K3-256k
Pourquoi c'est important
La réduction de quota de 50 % démocratise l'accès aux grands modèles de codage pour les développeurs.
Moonshot AI a lancé Kimi K3-256k, une version 256 000 tokens du modèle phare Kimi K3 (2,8 billions de paramètres, fenêtre 1M tokens). Ce nouveau modèle réduit la consommation de quota de moitié par rapport à K3 standard, tout en conservant les mêmes performances dans sa fenêtre de contexte.
Moonshot AI propose désormais quatre identifiants de modèles dans Kimi Code : k3 (1M de contexte), k3-256k (256k de contexte), kimi-for-coding et kimi-for-coding-highspeed. Le modèle k3-256k vient d'être lancé en tant que recommandation officielle pour les usages courants : questions-réponses, complétion de code, développement de fonctionnalités routinières et édition de fichiers simples. Sa principale caractéristique est de consommer environ deux fois moins de quota que le modèle k3 standard à fenêtre 1M. En contrepartie, il ne prend pas en charge les entrées vidéo. Concernant la migration entre modèles, Moonshot conseille d'exécuter manuellement la commande compact avant de passer de k3 (1M) à k3-256k afin de comprimer le contexte en dessous de 256k et de préserver les informations clés. Si l'historique contient des fichiers vidéo, le passage direct échoue. À l'inverse, basculer de k3-256k vers k3 (1M) n'affecte pas le cache existant. Le modèle k3-256k est disponible pour tous les membres Moderato et au-dessus, tandis que la fenêtre 1M reste réservée au plan Allegretto et supérieur.