← L'édition
IANouveau2 min de lecture

Claude Code v2.1.243 : contrôle de la consommation des boucles et binaire optimisé

Anthropic publie la version v2.1.243 de son outil en ligne de commande Claude Code. Cette mise à jour introduit un suivi détaillé de la consommation de jetons par boucle, la possibilité de personnaliser les modèles accessibles et une réduction majeure de l'empreinte mémoire et de la taille du fichier exécutable.

Fil « Sortie de Claude Code v2.1.243 »

Illustration de l'article — github.com
Image : github.com

Suivi précis de la consommation des boucles

La commande /usage s'enrichit d'un niveau de détail dédié aux tâches répétitives exécutées via la commande /loop (boucle d'exécution d'instructions automatiques par l'IA). L'interface affiche désormais :

  • Le nombre d'exécutions par boucle ;
  • Le total de jetons (tokens, les unités de texte traitées par le modèle d'IA) ;
  • La consommation de jetons par passage ;
  • L'horodatage de la dernière exécution.

Cette vue permet de repérer immédiatement les tâches automatisées hors de contrôle ou trop consommatrices. En complément, deux nouveaux paramètres permettent de gérer la durée de vie du prompt cache (la mémoire tampon qui conserve les instructions pour éviter de les réémettre à l'API) : promptCacheTtl fixe cette durée à 1 heure sur la conversation principale, tandis que subagentPromptCacheTtl applique un délai de 5 minutes aux sous-agents (subagents, des assistants secondaires lancés pour exécuter des sous-tâches en arrière-plan).

Personnalisation des modèles et règles d'entreprise

La mise à jour introduit la configuration modelPicker pour personnaliser la liste des modèles accessibles dans la commande /model. Il est possible de composer une liste ordonnée incluant des identifiants spécifiques, notamment ceux hébergés sur les services cloud Amazon Bedrock ou Google Cloud Vertex.

{
  "modelPicker": [
    { "id": "vertex/claude-3-5-sonnet", "label": "Sonnet Vertex Interne" }
  ],
  "promptCacheTtl": "1h",
  "subagentPromptCacheTtl": "5m"
}

Pour les entreprises, le paramètre modelPricing permet d'appliquer les tarifs négociés et les remises de l'organisation dans l'estimation des coûts (/cost), au lieu des prix du catalogue public. L'authentification évolue également sous /login avec une connexion sans clé d'API (« Sign in with your Console account »), pensée pour les organisations qui interdisent l'utilisation directe des clés d'API.

Optimisations de performances et résilience

L'exécutable a subi une refonte technique importante. Sur Linux x64, la taille du binaire passe de 340 Mo à environ 75 Mo grâce au passage à la compression zstd (un algorithme de compression de données très rapide). Le chargement du code se fait désormais à la demande plutôt qu'en conservant l'ensemble du programme en mémoire vive, ce qui économise entre 40 et 70 Mo de RAM par session.

Côté réseau, les serveurs MCP (Model Context Protocol, un standard de communication permettant à l'IA d'interagir avec des outils externes) utilisés en mode non interactif (-p) ou via le kit de développement (SDK) se reconnectent désormais automatiquement après une coupure. Enfin, lorsqu'un appel à l'API d'Anthropic ne répond plus, une limite de temps interviendra au bout d'environ 3 minutes, suivie d'un re-test automatique avant d'afficher un message d'erreur clair.