
Sopro V2 lance un modèle TTS de 120 millions de paramètres.
Le modèle open source clone une voix à partir de 5 à 20 secondes d’audio, fonctionne sur CPU et prend en charge l’anglais, le français, l’allemand et le portugais européen.

Sopro V2 lance un modèle TTS de 120 millions de paramètres.
Le modèle open source clone une voix à partir de 5 à 20 secondes d’audio, fonctionne sur CPU et prend en charge l’anglais, le français, l’allemand et le portugais européen.
Les connecteurs d’agents commencent à reprendre les permissions des applications qu’ils ouvrent. Fern limite son serveur MCP privé à une organisation et aux données visibles par le compte connecté. Caspio fait passer son serveur MCP sur une API conçue pour les agents, avec des garde-fous sur les écritures et suppressions en masse.
Nutanix pousse la même logique au niveau infrastructure. Enterprise AI 2.8 rend son MCP Gateway disponible pour gouverner l’accès des agents aux applications et aux données. Son Agent Gateway centralise aussi politiques, filtrage des outils, audit et contrôle d’usage, au lieu de laisser chaque agent appeler directement les services métier.
Pour les développeurs, brancher un MCP ne suffit donc plus : il faut définir précisément ce que l’agent peut lire, modifier et supprimer. Les mécanismes utiles deviennent familiers — portée d’organisation, droits hérités, conditions obligatoires sur les écritures, journalisation et filtrage par outil — et déplacent la sécurité du prompt vers l’intégration elle-même.
Anthropic ouvre MHS pour faire piloter du matériel physique par des agents.
Le standard relie microscopes, bras robotiques et autres instruments programmables à des agents, avec une interface commune et des protocoles compatibles MCP.
Plus de 100 entreprises IA appellent à coordonner la cyberdéfense.
OpenAI, Anthropic, Google, Microsoft et d’autres signataires demandent une coopération public-privé pour détecter les menaces IA et accélérer de nouvelles défenses.

Google rend Gemini Omni 1.1 Flash disponible par API avec sortie 4K.
Le modèle vidéo ajoute extension de scènes jusqu’à 40 secondes, contrôle des première et dernière images, brouillons 360p et export 1080p ou 4K.
Keenable lance NEEDLE, un benchmark vivant pour la recherche des agents.
Le benchmark open source renouvelle chaque heure ses requêtes d’actualité et compare les moteurs sur les mêmes recherches, résultats, prix et latence.

Une injection de prompt dans Amazon Kiro pouvait exfiltrer des données locales.
Un dépôt piégé pouvait pousser l’agent à lire un secret puis à l’envoyer via Kiro Powers ; Amazon a corrigé le chemin dans Kiro 0.8.140.
Cohere lance Parse pour convertir les documents en Markdown.
Le modèle multimodal de 2,3 milliards de paramètres extrait textes, tableaux, formulaires et images, avec bounding boxes, via API, AWS SageMaker et Microsoft Foundry.
Hugging Face ouvre les précommandes de Microduck à 399 dollars.
Le bipède open source de Pollen Robotics mesure 25 cm, embarque caméra et LiDAR, et permet de réentraîner ses comportements via son SDK et sa pile RL.
En quarante-huit heures, deux briques devenues essentielles aux développeurs ont concentré l’attention des acquéreurs. L’une héberge modèles et jeux de données IA ; l’autre place un moteur analytique embarqué au cœur des pipelines modernes. La valeur recherchée dépasse le code : communautés, habitudes et distribution comptent désormais comme des actifs d’infrastructure.
AWS a signé l’acquisition de DuckLabs tout en laissant DuckDB sous licence MIT et sous la DuckDB Foundation. Reuters rapporte parallèlement un accord de 12,9 milliards de dollars entre NVIDIA et Hugging Face, encore non confirmé publiquement par les deux entreprises. Dans les deux cas, l’ouverture formelle coexiste avec un rapprochement industriel majeur.
Pour les équipes IA, la diligence change donc de niveau : une licence ouverte protège le droit de forker, pas la neutralité d’une plateforme, l’emploi des mainteneurs ni les priorités d’hébergement. Il faut suivre séparément propriété intellectuelle, gouvernance, distribution et dépendances cloud ou GPU avant de traiter un écosystème ouvert comme infrastructure réellement indépendante.

SourceHut bannira le code produit avec des LLM dès le 10 septembre.
Dès le 10 septembre, ses nouvelles conditions prohiberont les contenus et logiciels produits avec ou facilitant l’IA générative.
Les agents de code se transforment en piles interchangeables. Un modèle ouvert vise le coût et le contexte, un runtime exécute des évaluations dans des environnements isolés, puis un modèle de computer-use choisit entre interface, terminal, outils et scripts. Chaque couche progresse désormais sans imposer le même fournisseur aux autres.
GLM-5.3-Flash illustre la couche de raisonnement : 18 milliards de paramètres actifs sur 320, un million de tokens de contexte et des poids MIT. Vercel Run sépare, lui, l’évaluation du produit avec un bac à sable reproductible et une API TypeScript, afin de tester un agent sur de vraies commandes plutôt que sur des réponses statiques.
Navigator n2 ferme la boucle d’action sur Linux, macOS et Windows. Il alterne interface graphique, terminal, outils et code, puis expose ce comportement par API. Le différenciateur se déplace ainsi du modèle isolé vers la compatibilité entre moteurs, environnements vérifiables et surfaces d’exécution capables d’accomplir une tâche entière.

HumanSH propose des commandes terminal à vérifier avant exécution.
L’outil open source insère une commande modifiable depuis ChatGPT, Claude ou Cursor, puis attend l’approbation avant toute exécution.

Contextual indexe localement le code et les décisions pour les agents.
Le moteur indexe dépôts, commits, décisions et documentation sur la machine, puis expose aux agents une recherche sémantique et temporelle via MCP.
OpenAgents partage tâches, fichiers et navigateurs entre trois agents.
Workspace 1.0 synchronise les fils, fichiers et navigateurs entre humains et agents, avec tâches visualisées, flux personnalisés et accès sur ordinateur ou mobile.
SecRTL-Gen teste la sécurité du code matériel généré par les LLM.
Le benchmark publie 392 tâches sur cinq familles CWE et quatre langages HDL ; les modèles passent 73–79 % des tests fonctionnels mais seulement 14–35 % des tests de sécurité.
Les modèles visuels quittent les interfaces de démonstration pour devenir des briques directement appelables dans les produits. Alibaba expose Wan 2.7 par API pour générer, éditer et combiner plusieurs images ; Vercel ajoute Muse Image à son AI Gateway. Le même workflow peut désormais choisir un modèle visuel comme il choisit un LLM.
Cette industrialisation ne concerne plus seulement l’image fixe. Kira 5.7 met à jour ses modèles vidéo Nova et Ultra, avec génération et édition renforcées et des temps annoncés d’environ une minute sur Ultra. Côté développeurs, le point commun est la réduction des étapes entre prompt, référence visuelle, génération puis nouvelle édition.
Pour les équipes produit, la conséquence est concrète : image et vidéo entrent dans les mêmes pipelines programmables que le texte. Les API acceptent des références, conservent davantage de contexte d’édition et exposent coût ou vitesse comme paramètres de choix. Il devient possible de construire un workflow multimodal sans enfermer toute la chaîne dans un seul outil créatif.
GitHub rétablit Actions et les merges de pull requests.
Les mitigations relancent les workflows et débloquent les merges à 00 h 01 UTC ; GitHub confirme ensuite un retour complet du service avant de clore l’incident.