🔥 Focus
Lilian Weng annonce son départ de Thinking Machines pour cause d’épuisement : La cofondatrice de Thinking Machines, Lilian Weng, a annoncé son départ de l’entreprise en raison d’un épuisement physique. Dans sa lettre d’adieu, elle a déclaré que les 20 mois de travail sous haute pression passés au sein de l’entreprise avaient gravement affecté sa santé. À l’avenir, elle cherchera un travail avec des limites plus claires et plus prévisibles, et ne sera plus cofondatrice. Cette décision a suscité de larges discussions dans la Silicon Valley sur la concurrence intense dans les start-ups d’IA et la fuite des talents (Source : Qbitai)

Huawei et ses partenaires publient la famille de modèles multimodaux Boogu-Image-0.1 : L’équipe Xiaoyi du Leibniz Research Institute de Huawei à Hong Kong, en collaboration avec l’Université de Hong Kong (HKU) et l’Université des sciences et technologies de Hong Kong (HKUST), a publié Boogu-Image-0.1. Ce modèle utilise Qwen3-VL-8B comme encodeur d’instructions et prend en charge la génération native en 2K. Pré-entraîné avec seulement 208 millions d’images indépendantes pour un coût d’entraînement théorique d’environ 400 000 dollars, il approche le niveau des modèles propriétaires dans plusieurs benchmarks et a été open-sourcé sous licence Apache 2.0 (Source : Jiqizhixin)
.jpg)
BeingBeyond publie Being-H0.8, le premier modèle d’action du monde tactile implicite : BeingBeyond a publié le modèle Being-H0.8. Ce modèle intègre pour la première fois la modalité tactile dans une représentation d’espace latent. Il s’appuie sur un ensemble de données vidéo UniHand-3.0 de plus de 500 000 heures et génère des annotations de contact via TactoHand, permettant aux robots d’ajuster leurs mouvements en temps réel en fonction des retours tactiles pendant l’exécution des actions, réussissant ainsi des opérations de précision comme saisir un objet dans un sac (Source : Qbitai)

🎯 Tendances
Microsoft lance le modèle de sécurité MAI-Cyber-1-Flash et la plateforme Perception : Suite à la création de l’alliance de sécurité open-source, Microsoft a officiellement lancé le modèle MAI-Cyber-1-Flash (137 milliards de paramètres, 5 milliards activés), intégré à son système de sécurité d’agents MDASH. Lors des tests CyberGym, cette combinaison a surpassé des modèles comme Mythos 5 d’Anthropic avec un score de 95,95 %, tout en réduisant les coûts de moitié. En parallèle, Microsoft a lancé la plateforme Perception, qui utilise un mécanisme multi-agents d’équipes rouge/bleue/verte pour automatiser la détection et la correction des vulnérabilités (Source : THE DECODER)

Volcengine ouvre les capacités de recherche de Doubao aux entreprises et aux développeurs : Volcengine a officiellement ouvert les capacités de recherche de l’application Doubao aux entreprises et aux développeurs sous forme d’API, de MCP et de Skill. Ce service fournit des champs riches tels que le niveau d’autorité, la date de publication, le résumé du corps du texte et des extraits Markdown originaux, aidant les AI Agents à obtenir et filtrer plus efficacement les informations externes en temps réel, tout en réduisant la consommation de Tokens inutiles (Source : Qbitai)

🧰 Outils
Perplexity publie pplx, son outil CLI officiel en un seul fichier : Perplexity a publié son outil officiel en ligne de commande pplx, permettant d’exécuter des recherches web et du scraping de contenu directement dans le terminal, avec des résultats retournés au format JSON standard. Conçu pour les développeurs humains et les AI Agents de codage, cet outil prend en charge le contrôle du budget de Tokens et la sauvegarde de fichiers locaux via la variable d’environnement PPLX_OUTPUT_DIR et le paramètre --stdout-preview (Source : MarkTechPost)
Kando AI lance un système de décision auto-évolutif : Fondée par des équipes de l’Université Tsinghua et de l’Université de Pékin, Kando AI a lancé un système de décision auto-évolutif destiné aux scénarios de décision à haute valeur ajoutée (tels que la recherche en investissement financier et la recherche scientifique). En enregistrant et en analysant les trajectoires de décision et les retours des utilisateurs, le système réalise la numérisation et l’auto-évolution de la cognition. Positionné comme le « Cursor du domaine de la décision », il a déjà levé plusieurs dizaines de millions de yuans lors d’un tour de table d’amorçage (Source : 36kr)

📚 Études
Publication CausalGame : aucun des 30 modèles de pointe n’a réussi le test de raisonnement causal : Une publication acceptée pour une présentation orale à l’ICML 2026, intitulée CausalGame et co-écrite par MBZUAI, CMU et l’Université Tsinghua, présente un tout nouveau benchmark de jeu interactif pour tester le raisonnement causal de 30 LLM Agents de pointe. Les résultats montrent que face aux biais de sélection et aux facteurs de confusion cachés, tous les modèles peinent encore à découvrir les véritables mécanismes causaux physiques, avec un taux de survie moyen inférieur au seuil de victoire de 75 % (Source : causalgame.github.io)
Publication VISReg : résoudre le problème de l’« effondrement de la représentation » dans les modèles de monde JEPA : Une nouvelle recherche en apprentissage auto-supervisé, VISReg, résout le problème de la disparition du gradient lors de l’effondrement rencontré dans les méthodes précédentes en découplant le terme de régularisation anti-effondrement en deux composants indépendants : « échelle » et « forme ». Cette méthode a obtenu d’excellents résultats sur 15 ensembles de données, égalant DINOv2 sur les benchmarks hors distribution (OOD) avec seulement un dixième des données. Elle a été recommandée et partagée à plusieurs reprises par Yann LeCun (Source : 36kr)

Publication RepLLM : convertir automatiquement des articles sur les réseaux en code exécutable : L’équipe du professeur Xiang Qiao de l’Université de Xiamen, en collaboration avec l’Université Jiao Tong de Shanghai et l’Université Tsinghua, a publié un article à SIGCOMM 2026 présentant RepLLM, un framework multi-agents pour la reproduction de recherches sur les réseaux. Grâce à la collaboration de quatre agents (analyse de contenu, conception d’architecture, génération de code et audit/correction), ce framework peut convertir automatiquement des articles sur les réseaux en code système exécutable, réalisant la reproduction en seulement 2 heures au plus vite (Source : 机器之心)

Publication ABBEL : améliorer l’efficacité de l’apprentissage par auto-résumé dans les interactions à long terme : Le Berkeley AI Research Lab (BAIR) a publié un article intitulé ABBEL: Learning Natural-Language Belief States for Memory-Efficient Interaction, proposant le framework ABBEL qui utilise les « états de croyance » en langage naturel comme contrainte d’information. En introduisant un score de croyance de type auto-encodeur, ce framework améliore considérablement la mémoire et l’efficacité d’apprentissage des agents lors d’interactions à long terme (Source : BAIR Blog)

💼 Business
Delta Intelligence lève près de 500 millions de yuans lors d’un tour de table Angel++ : Delta Intelligence, une entreprise spécialisée dans le développement de modèles de fondation pour robots humanoïdes polyvalents natifs, a annoncé la clôture d’un tour de table Angel++ de près de 500 millions de yuans, avec la participation de plusieurs sociétés cotées et d’institutions financières de premier plan. Les fonds seront utilisés pour l’itération des modèles, la production de masse d’équipements de collecte de données développés en interne et la construction d’une boucle fermée de données, afin de promouvoir le déploiement de robots humanoïdes dans des scénarios industriels (Source : 36kr)

Fish Audio lève 50 millions de dollars lors d’un tour de table d’amorçage : La start-up de modèles vocaux d’IA Fish Audio a annoncé avoir levé 50 millions de dollars lors d’un tour de table d’amorçage, mené par Coreline Ventures et Capital Today. L’entreprise a déjà lancé le modèle de génération vocale open-source Fish Speech et dispose de plus de 15 000 instructions de contrôle en langage naturel, visant à fournir des services de clonage de voix à faible latence et hautement expressifs pour les créateurs et les entreprises (Source : TechCrunch)

Recursive Superintelligence signe un accord de calcul de 400 millions de dollars avec Amazon AWS : Recursive Superintelligence, spécialisée dans le développement de systèmes d’IA auto-améliorés, a annoncé la signature d’un accord pluriannuel de puissance de calcul de 400 millions de dollars avec Amazon AWS. Cet accord fournira le support de calcul nécessaire pour entraîner les systèmes d’IA auto-améliorés à grande échelle de Recursive, l’aidant à lancer ses premiers produits d’agents pratiques d’ici la fin de l’année (Source : TechCrunch)
🌟 Communauté
« Rétrogradation de la consommation » au niveau de l’entreprise et montée de la Tokenomics : Les réseaux sociaux s’animent autour du fait que les entreprises américaines cessent collectivement de dépenser sans compter dans les appels aux grands modèles, se tournant plutôt vers la « Tokenomics » pour un contrôle précis des coûts. Les entreprises ont tendance à orienter les tâches simples vers de petits modèles ou des modèles open-source, réservant la planification centrale aux modèles propriétaires phares et coûteux. Le déploiement hybride devient ainsi la norme, forçant les fournisseurs de grands modèles à baisser leurs prix et à optimiser l’efficacité des tâches (Source : 36kr)
Les assistants de codage IA redéfinissent les processus de développement logiciel et la structure des talents : Les discussions au sein de la communauté soulignent que la popularisation du codage par IA et des assistants agents est en train de brouiller les frontières entre produit, design et ingénierie, favorisant l’émergence de talents techniques « full-stack » et « généralistes ». Dans le processus traditionnel de développement logiciel, l’introduction de l’IA abaisse la barrière à l’écriture de code, tandis que la définition du produit, l’esthétique et le « goût » — des jugements typiquement humains — deviennent les nouveaux goulets d’étranglement clés (Source : 36kr)
Les nouvelles réglementations sur les interactions anthropomorphes suscitent des discussions sur le retrait des agents IA et la dépendance affective : Avec l’entrée en vigueur officielle des nouvelles réglementations nationales sur la supervision des interactions anthropomorphes, certaines plateformes majeures ont retiré les fonctionnalités d’agents IA personnalisés, déclenchant de larges discussions parmi les utilisateurs sur le fait de « télécharger un amant cybernétique » et la dépendance affective virtuelle. Les divergences profondes entre utilisateurs et plateformes sur la définition de la propriété virtuelle, le transfert affectif et les limites de conformité mettent en évidence la complexité des liens émotionnels homme-machine à l’ère de l’IA (Source : 36kr)
💡 Divers
Le premier robot humanoïde de BYD sera officiellement dévoilé en août : BYD a officiellement confirmé que son premier robot humanoïde fera ses débuts début août au pavillon de Zhengzhou de « Di Space ». Ce robot devrait être déployé dans le réseau de concessionnaires pour l’accueil des clients et la présentation des modèles de véhicules, avec des perspectives de commercialisation d’ici un à deux ans (Source : 36kr)
Sigmastar accélère sa transition vers des puces IA embarquées à haute puissance de calcul : Sigmastar, leader mondial des SoC d’IA visuelle, accélère sa transition vers la puissance de calcul embarquée (edge), avec des livraisons de puces de vision robotique dépassant déjà les dix millions d’unités. L’entreprise a lancé une puce de 8 TOPS prenant en charge l’exécution locale de grands modèles et une puce de 32 TOPS destinée à l’automobile, et prévoit de lancer la production d’essai (tape-out) de sa puce de lunettes IA de deuxième génération d’ici la fin de l’année (Source : 36kr)

Nvidia et OpenAI discutent d’une garantie de financement de 250 milliards de dollars pour un supercalculateur : Des médias étrangers ont révélé que Nvidia est en négociation avec OpenAI pour fournir jusqu’à 250 milliards de dollars de garanties de financement pour son centre de supercalcul de 10 gigawatts dans l’Ohio, dont le coût total dépasse 500 milliards de dollars. Ce projet sera développé par une filiale d’énergie de SoftBank, visant à sécuriser le plus grand client de demande de calcul au monde grâce à l’adossement du crédit de Nvidia (Source : 36kr)
