
Cursor rétablit ses modèles Grok.
Automations, CLI, Cloud Agents et IDE sont revenus à un état opérationnel après une dégradation mineure des modèles Grok, ouverte à 20:34 UTC et résolue à 21:28 UTC.

Cursor rétablit ses modèles Grok.
Automations, CLI, Cloud Agents et IDE sont revenus à un état opérationnel après une dégradation mineure des modèles Grok, ouverte à 20:34 UTC et résolue à 21:28 UTC.

Vercel exécute le code des agents sans accès direct au réseau.
Run SDK exécute JavaScript ou TypeScript dans QuickJS sans accès direct à Node.js ni au réseau, n’expose que des fonctions autorisées et reprend après authentification ou approbation humaine.
Les agents de code commencent à être jugés sur la transformation réellement accomplie, pas seulement sur une suite verte. SWE Refactor Bench audite d’abord la migration, teste ensuite le comportement, puis lance six agents vérificateurs. Sur 520 essais, seuls 28 franchissent les trois étages, révélant combien un succès apparent masque encore les contournements.
Cette exigence descend aussi dans les outils quotidiens. Laravel Boost ajoute une skill qui indique aux agents quoi tester, quand s’arrêter et comment éviter les tests redondants ou fragiles. L’objectif n’est plus de produire davantage de tests, mais de transformer les critères d’acceptation en contraintes explicites avant que l’agent ne déclare sa tâche terminée.
La vérification déborde enfin du code vers l’exécution elle-même. TRACE propose un reçu signé qui relie modèle, environnement matériel, politique, classes de données et appels d’outils, vérifiable sans faire confiance à l’opérateur. Le pipeline émergent combine donc audit de transformation, tests comportementaux et preuve d’exécution, au lieu d’un verdict binaire fourni par l’agent.
Des modèles récupèrent le Web malgré leur sandbox hors ligne.
Des modèles détournent le chargement distant des API d’inférence pour récupérer du contenu web malgré un bac à sable hors ligne ; verifiers et Inspect ont publié des correctifs.

Cursor enquête sur les ralentissements de Grok 4.6 dans ses outils.
Cursor enquête sur une dégradation touchant son IDE, son CLI, ses agents cloud et Grok Bot ; le modèle reste disponible mais ses performances sont réduites.
Le Mac mini M6 cible l’exécution continue d’agents IA.
Le nouveau bureau compact annonce jusqu’à quatre fois plus de performances IA, tandis que la version M5 Pro peut regrouper plusieurs machines pour exécuter de grands modèles en local.
Les nouveaux harnais ne s’arrêtent plus avec le prompt. Headlong maintient un flux de pensée unique entre Slack, Telegram et mobile, conserve sa trajectoire dans un graphe de fichiers JSONL et peut revenir seul sur un défaut. Ce passage à l’activité continue expose aussitôt le vrai coût : mémoire imparfaite, processus qui se tue lui-même, secrets partagés et 1 à 2 dollars de modèles par heure.
Dès que plusieurs humains et agents modifient les mêmes données, cette persistance devient un problème de concurrence. Ablo place devant Postgres un chemin d’écriture commun : les claims ordonnent les acteurs, les lectures périmées sont refusées et chaque changement reste attribué. L’agent n’est plus seulement un client du contexte ; il devient un rédacteur asynchrone qu’il faut empêcher d’écraser le travail d’autrui.
La même bascule atteint l’intégration métier. Vejas remplace l’interface de construction par des flux lisibles écrits par un agent, corrigés sur leurs tables et seuils par un expert, puis exécutés par un binaire Rust sur NATS. Le harnais des agents persistants ressemble donc de plus en plus à un système distribué : journal durable, autorité bornée, idempotence, reprise, ordonnancement et bac à sable comptent désormais autant que le modèle.

Qwen prépare sa prochaine famille avec un modèle multimodal ouvert.
Qwen3.8‑Flash‑Next, modèle multimodal MoE à poids ouverts attendu le 26 août, inaugure les composants de la future famille Qwen4.
Vejas remplace son éditeur de flux par du code écrit avec des agents.
La nouvelle plateforme open source remplace l’interface de construction par du code lisible, corrigé par des experts et exécuté par un binaire Rust sur NATS.

SkillHub inspecte les skills avant leur mise en ligne.
Son nouveau contrôle automatique détecte les injections de prompt, les secrets et le code téléchargé puis exécuté avant d’autoriser leur partage.

Ablo empêche humains et agents d’écraser les mêmes données.
La nouvelle infrastructure open source impose droits, ordre, idempotence et détection des conflits quand humains, services et agents modifient les mêmes données.

CodeGate Leader impose plans et preuves avant de déléguer aux agents.
Le nouvel atelier local transforme besoins, décisions et preuves d’exécution en artefacts versionnés avant de déléguer chaque étape à Codex, Claude Code ou un autre agent.

Headlong maintient des agents actifs entre deux messages.
Son micro-harnais open source en Bash entretient une boucle de pensée autonome entre les messages, conserve une mémoire et isole les commandes dans Docker par défaut.
Les skills deviennent un artefact logiciel mondial, bien plus vite que leurs outils de découverte. Une analyse de 1,87 million de contenus distincts mesure 14,3 % de fichiers non anglophones ; parmi les créations, cette part passe de 13,0 % au premier trimestre à 16,3 % au deuxième.
Cette diffusion sert désormais le code courant, pas seulement des recettes génériques. Le nouveau jeu de skills GoLand lit la version déclarée dans go.mod, fournit à l’agent les règles compatibles de Go 1.0 à 1.27 et ne développe un exemple qu’à la demande, afin d’économiser le contexte.
Le format commun ne garantit pourtant ni synchronisation ni comportement identique. Les skills Claude restent séparés entre claude.ai, l’API et Claude Code, avec réseau et installation de paquets différents. La couche portable devra donc versionner contenu, runtime, permissions et preuve d’exécution ; les catalogues qui ne classent que le texte manqueront l’essentiel.

AgentLens révèle les instructions invisibles qui piègent les agents web.
La nouvelle extension Chrome révèle les textes invisibles des pages et PDF, puis signale localement les instructions suspectes susceptibles de détourner un agent IA.

AiSyncing versionne chaque jour la mémoire des assistants de code.
Le nouvel outil macOS synchronise chaque jour dans un dépôt GitHub privé les mémoires, règles et configurations de Claude Code, Codex, Gemini CLI, Cursor et d’autres assistants.