← Le LiveIA CODE LIVE
ARTICLE Par

Les modèles agentiques optimisent désormais le coût d’une tâche complète

Illustration éditoriale — Les modèles agentiques optimisent désormais le coût d’une tâche complète

Les sorties de cette semaine déplacent la comparaison des modèles vers le coût d’une tâche agentique complète. Meta annonce que Muse Spark 1.3 utilise environ 20 % de tool calls et 25 % de tokens en moins que 1.2 sur ses comparaisons internes, tout en visant davantage de travail long-horizon.

Google maintient Gemini 3.8 Flash au tarif introductif de 0,75 $/M tokens en entrée et 3,75 $ en sortie, avec de meilleurs résultats sur le code et les tâches multi-étapes. Anthropic baisse de 75 % le prix des cache reads de Fable 5.1, estimant l’économie jusqu’à 45 % sur les workloads très agentiques.

Pour les développeurs, le prix affiché par million de tokens devient donc insuffisant. Il faut mesurer le nombre de tours, les tool calls, les relectures de contexte et le taux de réussite jusqu’au résultat vérifié. Le modèle le moins cher par token peut coûter davantage s’il boucle plus longtemps ou échoue plus souvent.

Références

Sources

Chaque onglet présente la publication d’origine et son lien direct.

Meta AI Research

Introducing Muse Spark 1.3

Meta présente Muse Spark 1.3, entraîné davantage sur les tâches de code longues et sur plusieurs harnesses. Dans ses comparaisons internes avec 1.2, l’entreprise mesure environ 20 % de tool calls et 25 % de tokens en moins, avec moins de tours inutiles et une meilleure tenue des workflows longs.

Ouvrir la source ↗