OpenAI et Anthropic stockent des dizaines de milliers de… | Quotidien IA 2026-09-01

🔥 Focus

OpenAI et Anthropic stockent des dizaines de milliers de Mac mini/Studio pour entraîner des agents d’utilisation d’ordinateur : Plusieurs médias confirment qu’OpenAI a acheté des dizaines de milliers de Mac mini et Mac Studio sans écran, et qu’Anthropic loue des équipements similaires via AWS, pour le reinforcement learning et la collecte de trajectoires d’agents d’utilisation d’ordinateur. Les facteurs incluent la licence des machines virtuelles macOS liée au matériel Apple, la mémoire unifiée pour charger de grands modèles, et un refroidissement permettant une interaction GUI 7×24 à pleine charge — et non le remplacement du préentraînement GPU. Les configurations haut de gamme sont en rupture depuis des mois faute de mémoire ; le chiffre d’affaires Mac d’Apple a augmenté d’environ 29 % en glissement annuel ce trimestre. NVIDIA DGX Spark/RTX Spark est vu comme concurrent desktop ; les clusters EXO et les clouds de matériel Apple comme Mount Thor montent aussi. L’ingénierie entreprise et les relations développeurs d’Apple restent faibles ; la demande est surtout portée par des tiers. (来源: THE DECODER量子位机器之心量子位/36氪)

L’UE classe ChatGPT, Reddit et Roblox parmi les très grandes plateformes en ligne : La Commission européenne juge que ChatGPT et d’autres relèvent des obligations les plus strictes du Digital Services Act : traiter les contenus illégaux, protéger la vie privée et la sécurité des mineurs, amendes jusqu’à 6 % du chiffre d’affaires mondial. Des reports les traitent aussi comme très grands moteurs de recherche, avec un durcissement de conformité sous quatre mois. Bruxelles intègre l’IA conversationnelle dans la régulation des plateformes existantes, sans nouveau régime. (来源: Ars Technicakimmonismus)

La Banque d’Angleterre alerte le G20 : l’IA de frontière pourrait ébranler la stabilité financière mondiale : Andrew Bailey, gouverneur de la Banque d’Angleterre et président du Financial Stability Board, écrit aux ministres des Finances et gouverneurs du G20 que l’autonomie, les capacités de résolution et d’attaque des modèles de frontière progressent ensemble. Le risque le plus direct est de changer la vitesse, l’échelle et le coût des cyberattaques, et de se propager via des prestataires tiers très concentrés dans le système financier transfrontalier. Beaucoup de juridictions n’ont pas encore de protocoles de R&D, de publication et de déploiement des modèles avancés. L’optimisme IA gonfle valorisations et levier ; un choc pourrait déclencher plusieurs vulnérabilités à la fois. Il demande de prioriser au niveau mondial une publication et un déploiement sûrs et responsables. (来源: The Guardian)

Surveillance NHS : les scribes IA se trompent de noms de médicaments et de diagnostics, les patients s’en aperçoivent avant les médecins : Healthwatch England révèle plusieurs accidents de transcription : un résumé d’IRM transforme « pas de démyélinisation » en démyélinisation, des noms de médicaments prescrits sont remplacés par des homophones, des lettres de sortie omettent le renouvellement chez le généraliste. Environ 27 scribes sont déjà utilisés au Royaume-Uni ; le plan décennal compte sur eux pour alléger la charge, mais la MHRA ne les classe pas comme dispositifs médicaux et il n’y a pas de supervision nationale unifiée. Les médecins doivent tout vérifier ligne par ligne ; hallucinations, accents, consultations à plusieurs et antécédents complexes font monter le taux d’erreur. L’outil n’a pas encore tenu sa promesse de gain de temps. (来源: The Guardian)

Google négocie avec Disney, Universal et d’autres des licences de personnages et de films pour des outils IA : Google pousse les studios hollywoodiens à licencier personnages et catalogues pour ses flux de production IA et VFX, tout en affrontant la résistance des syndicats sur le copyright, les emplois et le contrôle créatif. Hollywood a déjà poursuivi l’IA ; ce virage vers des « partenariats de licence » marque le passage de l’affrontement à la transaction entre ayants droit et laboratoires de modèles. (来源: The Verge)

🎯 Tendances

OpenClaw 2.0 : installation guidée, console démarrant en ~575 ms, sessions cloud explicitement hors frontière de sécurité : Après près de sept semaines sans mise à jour, la plus grande version à ce jour (~16 000 PR) : installation guidée réutilisant les connexions locales Codex/ChatGPT/Claude, clés API ou Ollama/LM Studio avec vérification préalable ; Control UI centrée sur le dialogue, démarrage ~1,6 s → 575 ms ; sessions migrées vers SQLite. Sessions cloud partagées et appareils appariés/Crabbox, mais la doc précise que les permissions collaboratives ne sont pas un isolement locataire ni une frontière de sécurité ; Gateway est en boucle locale par défaut, la sécurité repose encore sur l’approbation d’outils, le sandbox et une liste blanche de plugins. La communauté parle aussi d’essoufflement : pas de version stable, mises à jour trop denses, certains passent à Hermes ou à un harness maison. (来源: THE DECODERMarkTechPost机器之心Reddit r/LocalLLaMA)

DeepSeek-V4-Flash-Vision-Exp en ligne avec poids open source : DeepSeek publie une version multimodale expérimentale via API et Hugging Face, affirmant un alignement côté texte (Agent, raisonnement et connaissances du monde) avec V4-Flash et un saut net sur les benchmarks d’agents multimodaux ; Vision dans l’app ajoute annotations, questions prédéfinies et recherche d’images en arrière-plan. La communauté locale parle d’environ 168 Go en pleine précision, 4 bit natif adapté aux machines 256 Go, avec vision et sorties structurées. (来源: huggingfaceReddit r/LocalLLaMA)

Qwen Creation lance Agent Teams, branche Wan 3.0 pour une chaîne de courts-métrages multi-métiers : Une phrase convoque des agents scénariste, réalisateur, art, storyboard, montage ; les livrables intermédiaires sont des scripts de mise en scène, assets de personnages et prompts de plans révisables. En test, on peut aller du scénario au film, mais la qualité des plans exige encore validation humaine avant génération et retouches locales après. Alibaba Wan montre aussi la cohérence de personnages entre plans, des pubs d’un plan de 30 s et image-vers-vidéo, et débarque sur Buzzy en génération illimitée limitée dans le temps ; la compétition passe de la qualité d’un plan à toute la production dans un même contexte. (来源: 机器之心Alibaba_Wan)

Le Robotaxi R2 de nouvelle génération de Didi lance des tests de transport de passagers sans chauffeur à Pékin et Guangzhou : Le modèle dédié avec GAC Aion embarque 33 capteurs et un calcul fusionné trois domaines ; grand écran arrière et interaction vocale insistent sur l’habitacle ; il revendique les cinq étoiles Chine-Europe et des redondances multiples. Tests encore en zones de démonstration ; données de sécurité et d’exploitation à l’échelle non publiées. (来源: 量子位)

Ropedia lance HOMIE Gen2 : l’expérience humaine devenue données Physical AI entraînables : Casque d’environ 380 g, ~13 h de capture, 4 caméras 360° plus audio spatial, alignement multimodal dans le même espace-temps ; erreur de localisation revendiquée ~0,2 %, mocap des mains ~4,68 mm. La voie est une capture « sans corps robotique » qui découple la capacité de production du parc de robots pour la lier au nombre de personnes, avec le dataset Xperience et une chaîne de traitement. (来源: 机器之心)

Caterpillar porte l’expérience d’autonomie minière vers les chantiers et un assistant IA après-vente : Caterpillar applique l’automatisation des dumpers et foreuses à des chantiers plus dynamiques, et lance Cat AI Assistant pour les techniciens, avec procédures de maintenance vocales ; ~1,6 million d’actifs connectés, 16 Po de données structurées. Le CTO insiste : le dur est de changer les workflows, pas de construire le modèle. Environ 100 millions de dollars prévus sur cinq ans pour former les employés. (来源: TechCrunch)

Meta Pocket transforme « un petit jeu en une phrase » en fil social : Après l’acquisition de l’équipe Gizmo, l’app mobile laisse générer des gizmos jouables sans code, partagés en swipe type short video. Prototypes rapides, mais les œuvres restent dans le jardin clos Meta, difficiles à exporter en produits indépendants. (来源: Ars Technica)

Google EnvHarness : une couche qui durcit les environnements d’évaluation statiques avec la politique : Google Cloud AI Research et d’autres open-sourcent EnvHarness, qui ne change états initiaux, actions et observations que via reset()/step(), en conservant les vérificateurs humains. EnvRigger diagnostique les faiblesses à partir des trajectoires de politique et écrit des wrappers Python ; sur cinq benchmarks, mining de compétences jusqu’à +9,0 points OOD, ~9,8 % de pas en moins sur SWE-bench Verified. Prérequis : environnement réinitialisable ; comptes réels et robots physiques exclus. Code Apache-2.0 déjà public. (来源: MarkTechPost)

Google Assistant s’arrête le 4 septembre, le mot de réveil bascule vers Gemini : Après dix ans, Google Assistant s’arrête le 4 septembre ; téléphones, montres, écouteurs et Android Auto passent à Gemini. Le retrait a déjà été reporté plusieurs fois. L’analyse : la voix reste la couche intermédiaire la moins coûteuse avant le déploiement d’agents ; la décision doit rester dans la bouche de l’utilisateur. (来源: 36氪)

Anthropic force la déconnexion des sessions Claude hijackées par des stealer : Un mail officiel indique que des malwares Vidar, Lumma, StealC, RedLine, Acreed et AMOS sur Mac volent les sessions navigateur, contournent mot de passe et 2FA pour consommer le quota et éventuellement relayer l’API. Symptômes : quota épuisé anormalement, traces de code anglais inconnu, déconnexions, cartes liées vidées. Changer le mot de passe ne suffit pas : révoquer toutes les sessions et vider les cookies ; les logiciels piratés sont une source d’infection fréquente. (来源: 新智元)

Sécurité des agents d’entreprise : d’abord identité et contexte de délégation, la gateway seulement en cinquième porte : Plusieurs textes industriels notent que des failles de gateways comme LiteLLM sont déjà au catalogue CISA des exploits connus, alors que beaucoup d’équipes en font encore la première ligne. L’ordre efficace : inventaire d’agents nommables et responsables → identité indépendante plus tâche déléguée → identifiants de courte durée au niveau tâche → télémétrie bout-en-bout recouvrable → puis interception runtime et coupe-circuit inter-systèmes. Une enquête Teleport : ~76 % d’incidents chez les organisations trop permissives, ~17 % en moindre privilège. Après authentification, dérive d’objectif, abus d’outils et empoisonnement de mémoire restent possibles. (来源: VentureBeat)

Musk confirme que SpaceX construit sa propre fonderie d’aubes de turbine pour raccourcir le cycle du gaz : Face au goulot électrique des data centers, Musk dit que la fonderie d’aubes bride la capacité des turbines à gaz ; une fonderie SpaceX au Texas pourrait avancer la mise en service jusqu’à ~18 mois. SpaceX et Tesla visent chacune ~100 GW de solaire par an. Les critiques : accélérer le gaz, c’est plus d’émissions ; Memphis et d’autres ont déjà des controverses de permis et de santé. (来源: TechCrunch)

Les États-Unis resserrent l’import de drones et de robots avancés, la Chine garde l’avantage d’échelle : Washington limite les robots avancés étrangers au nom de la sécurité nationale et surtaxe drones et pièces importés. L’analyse : cela ne renversera pas l’avance chinoise sur les volumes et la courbe de coût des humanoïdes ; le marché mondial se fragmentera plutôt en « marché conformité-sécurité vs marché échelle bas coût », Japon, Corée et Taïwan pouvant être une zone intermédiaire. (来源: TechCrunch)

Tencent CubeSandbox 0.7 : sandbox pausable/réveillable entre machines : ~60 ms de cold start sur une machine ; l’aperçu cluster permet de pauser sur une machine et de réveiller sur une autre, état en stockage partagé ; vider une machine ne tue plus les tâches en pause. 239 commits, 57 contributeurs ; les sandboxes d’agents passent du monomachine au cluster ordonnancé. (来源: ziran_pu)

GLM-5.3 : correctif de quantification et MXFP4 : Sur DGX Spark, l’ancienne quantification ModelOpt était accusée de corrompre silencieusement les tokens et de casser les tool-call (lié à vLLM #54150) ; passage à RedHatAI compressed-tensors. One Nexus (Vietnam) sort GLM-5.3/Flash en MXFP4 ; Together dit Flash ~17× moins cher, 5.3 avec un meilleur taux de succès du premier coup. (来源: ziran_pu)

Qwen 3.8 jugé « illisible pour les humains » : Des utilisateurs LocalLLaMA se plaignent que 27B et Flash-Next abusent de symboles d’ensembles, de personas et d’écriture dense, comme pour baisser le « token d’intelligence par unité » au détriment de la lisibilité ; lu comme un Agent RL qui cuit le LM en « dialecte pour modèles ». (来源: Reddit r/LocalLLaMA)

Le réalisateur de KCD2 teste une fuite de DLSS 5 : éclairage, pas de géométrie réécrite : Daniel Vavra, réalisateur de Kingdom Come: Deliverance 2, dit que la fuite NVIDIA DLSS 5 ne redessine pas la géométrie des personnages mais renforce peau, occlusion ambiante, ombres de visière et de cheveux avec les données existantes, plus proche de l’intention artistique. Les commentaires craignent que les développeurs en fassent plus tard un bouton de « magie post-prod » pour bâcler. (来源: Reddit r/ArtificialInteligence)

🧰 Outils

Perplexity Portable Computer : harness local-first taillé pour Qwen3.8-27B : Modèle par défaut, trajectoires et fichiers restent locaux ; recherche et conseiller cloud à la demande. Pour petits modèles : prompts système raccourcis, MCP en CLI, sandbox forcé et auto-vérification ; ~66,7 % BrowseComp sur DGX Spark ; Terminal-Bench 2.1 de ~59,6 % à 73,0 % après upgrade conseiller. Le PPLX 27B post-entraîné ~85,4 % sur leur banc interne de knowledge work. (来源: 机器之心)

ChatGPT Work est en fait un système de tâches cloud : interpréteur de code réseau, Chrome headless, disque persistant et sites déployables : Simon Willison décortique le palier payant Work : Sol/Luna/Terra et paliers de raisonnement optionnels ; environnement de code presque ouvert vers le réseau par défaut ; Chrome complet pour formulaires, 2FA repris par l’utilisateur sans passer par le modèle ; /workspace persistant entre sessions ; ChatGPT Sites via Cloudflare Workers. Il alerte sur le « trio fatal » données privées, pages non fiables et canal sortant ; les détails de sécurité restent opaques. ZDNET : ça peut gagner du temps mais il faut relire ; on coupe les permissions dès qu’elles sont épuisées. (来源: Simon WillisonZDNet)

Cisco déploie l’agent personnel MyAgent auprès d’environ 90 000 employés : Sur la plateforme interne Circuit, MyAgent orchestre plus de 800 agents spécialisés ; ~50–60 % des requêtes passent par des poids open source, 20–30 % par l’automatisation classique, une minorité par des grands modèles externes. Les employés donnent un objectif, pas des instructions pas à pas ; coordination Outlook, Webex, Jira, SharePoint, poursuite en arrière-plan. (来源: InfoQ)

Archify : une phrase pour dessiner un dépôt en architecture interactive : Skill d’agent open source pour Claude Code, Codex, Cursor, etc. : JSON IR depuis le code, puis HTML cherchable avec chaînes d’appels. Limite : l’exactitude dépend encore de l’analyse de l’agent ; consommation de quota élevée. (来源: 量子位)

Doubao Work en produit autonome, ByteDance en fait l’entrée B2B des agents de bureau : ByteDance lance le produit indépendant « Doubao Work » branché sur Feishu ; les équipes TRAE et Coze rejoignent l’écosystème Doubao. Les skills matchent automatiquement PPT, comptes rendus, veille ; style fin et vérification factuelle restent faibles. (来源: 新博弈)

Circleback lance un palier gratuit de comptes rendus de réunion : Le produit YC de notes de réunion ouvre la transcription illimitée mais ne conserve que 30 jours d’historique ; intégrations complètes et MCP à partir d’environ 14 $/mois. Équipe de 8, ARR par tête revendiqué > 1 M$ ; le gratuit remplace l’acquisition par la pub. (来源: TechCrunch)

Sonar Vortex : graphe sémantique pour baisser le coût de recherche de code des agents : Graphe préconstruit classes/méthodes/champs/interfaces ; l’agent peut demander « qui implémente l’interface, qui appelle cette méthode ». 6 tâches réelles, 4 langages, 10 runs chacun : coût en baisse ~5–36 % (jusqu’à ~36 % pour changer une interface Java). (来源: TheTuringPost)

llmprobe 0.6.0 : sonde de quantification/régression multi-moteurs : npx [email protected] --eval branche une eval style antirez sur chat completions/responses/messages, pour des rapports de régression contre n’importe quel moteur d’inférence. (来源: QuixiAI)

📚 Apprentissage

AI4X « Productivité à l’ère agentique » : efficacité × expansion et délégation en quatre phases : Revue de 68 pages (Fudan et 12 institutions) : l’agent allie généricité et autonomie ; la productivité vient de la compression du coût des anciennes tâches et du déblocage de travaux qu’on ne faisait pas. Les secteurs se stratifient assistant conversationnel → exécution réactive → coordination adaptative → système autonome ; la profondeur de diffusion dépend de la numérisation, du feedback vérifiable, de la tolérance aux fautes, de la décomposabilité et de l’attribution de responsabilité, pas des scores de classements. (来源: 机器之心)

LDM : élargir l’espace de recherche avec un modèle génératif, choisir la prochaine expérience avec un processus gaussien : L’équipe de Jun Wang (UCL) écrit la découverte scientifique en boucle rapide (mise à jour du contexte après l’expérience) et boucle lente (distillation des trajectoires à haute fonction d’acquisition dans les paramètres). Sur tuning NanoGPT, CDRH3 d’anticorps et bi-objectif moléculaire : ~2,4× de baisse BPB vs réflexion LLM pure, ~18,2 % d’énergie de liaison en moins, hypervolume +60 %+. (来源: 机器之心)

AI4AI : le modèle fort n’entraîne pas le faible, il lui conçoit seulement un harness : Salesforce et UIUC laissent un Builder monter automatiquement un échafaudage pour GPT-5.4-mini sur 5 % de validation ; exactitude moyenne théorie de l’esprit de 0,488 à 0,912 au mieux. Moyens efficaces : solveurs déterministes et suivi d’état, pas des chaînes de pensée plus longues. (来源: 机器之心)

AQuA : agent de recherche quantitative — « preuves en mémoire, évaluateurs verrouillés » : Princeton, Ant Group et Stanford séparent deux boucles indépendantes facteurs et modèles ; l’agent ne peut pas changer les chemins de données ni le jeu de test final. Combinaison crypto 5 minutes : Spearman IC ~0,190 ; prévision actions US 30 min : IC par titre ~+0,0843, Sharpe hors échantillon jusqu’à ~+2,50 après 2 bps. Un accident précoce de look-ahead bias est pleinement divulgué. (来源: 量子位)

MIT CrysVCD : valence et équilibre de charge avant génération : Un LM génère des formules par états d’oxydation, puis un modèle de diffusion fait croître la structure ; ~68 % mécaniquement stables, ~85 % métastables, candidats comme GeC à haute conductivité thermique. Le filtrage coûteux de stabilité est avancé. (来源: MIT News)

VibeGame : un moteur de jeu pausable et tout-texte recréé pour les agents : NJU et NTU font du Prompt-to-Game avec 8 rôles adversariaux ; tout l’état du moteur est JSON, actions injectables frame par frame. L’expérience se condense en squelette/composants/contrats sans mise à jour des poids. (来源: 机器之心)

TailSFT : le SFT ne frappe que la « queue pas encore apprise » avant le RL : Microsoft : le SFT standard continue de brûler du gradient sur des séquences déjà ajustées et rétrécit l’exploration RL suivante. Sur OLMo-3 7B, coding pass@16 jusqu’à +16,8, maths +3,1 ; puis GRPO pass@1 jusqu’à +3,9. (来源: dair_ai)

NPO : optimisation de prompts d’une seule lignée, budget proche de GEPA : Chaque round, l’élève tourne avec le prompt courant, le professeur réécrit à partir des trajectoires récentes ; pas de pool de candidats ni d’arbre de recherche. Benchmarks de suivi d’instructions : ~3500/6800 rollouts, proche de GEPA. (来源: omarsar0)

SWA+sinks contre l’attention linéaire post-entraînée : L’article dit que sliding window plus sinks n’est pas inférieur à l’attention linéaire post-entraînée sur plusieurs aval ; raisonnement long contexte Needle/BABILong etc. 2–10× meilleur, sans post-entraînement, plus rapide et moins gourmand en mémoire. (来源: iScienceLuvr)

BIT : pont de diffusion image-texte bidirectionnel, sans partir du bruit gaussien : BIT interpolé du texte vers l’image, chemins d’échantillonnage sensibles à la source, et parcours inverse image→texte. (来源: iScienceLuvr)

LaGSplat : quelques secondes de vidéo monoscopique pour apprendre Lagrange, forces jamais mesurées applicables : La même variable latente q pilote gaussiennes et équations du mouvement ; un clic sur l’image devient un jacobien lié à la force. (来源: andrew_n_carr)

LangGraph « Deep Agents from Scratch » : cinq leçons en notebooks : De ReAct à la planification TODO, déchargement de contexte via système de fichiers virtuel, délégation à des sous-agents. (来源: hwchase17)

Entropic Scree : information mutuelle pour diagnostiquer s’il y a un vrai signal dans des tableaux sales : Information mutuelle transformée pour estimer volume de signal, SNR, rang intrinsèque, etc. ; revendique moins de dépendance aux paramètres et aux hypothèses de distance que la PCA. (来源: Reddit r/MachineLearning)

💼 Business

Barclays : pour 100 $ de revenus des sociétés de modèles, ~35–40 $ vont aux trois grands clouds : La marge du raisonnement payant passerait de bas double digit en 2025 à ~50–65 % en 2026 ; lab A (plutôt API) et lab B (plutôt abonnement) peuvent différer d’~17 points de marge brute ajustée. Marge d’exploitation cloud ~35–45 %. À partir de 2028, le compute dédié des labs arriverait, parts AWS/Azure/GCP en recul possible. (来源: 财联社)

ChatGPT Ads : ~1 Md$ annualisés en moins de 200 jours : La pub couvrirait plus de 40 pays, avec self-serve, en contraste avec le classement DSA le plus strict de l’UE pour ChatGPT. (来源: TheZachMueller)

Together AI et le saoudien Humain : data center ~250 MW : Le New York Times dit que le site serait l’un des plus grands campus publiquement divulgués dédiés à l’hébergement de modèles open source. (来源: togethercompute)

🌟 Communauté

Après un downgrade de sécurité, Claude a supprimé par erreur ~700 Go du home d’un développeur : L’utilisateur a demandé un script de nettoyage sandbox /tmp ; une suppression sensible a déclenché une revue adversariale, le modèle est passé de Fable à Opus 4.8. Les tests ont jugé le home non supprimable, mais le nettoyage des fichiers temporaires a réutilisé une variable pointant vers le home et exécuté la suppression. La communauté : « risque élevé → modèle plus faible » rate plus facilement chemins et scopes ; certains écrivent un hook qui pause la session dès le downgrade. (来源: 机器之心机器之心/36氪)

Les experts sinistres, métier qui déteste le plus l’IA sur Glassdoor : 98 % d’avis négatifs parmi ceux qui la mentionnent : WIRED cite Glassdoor : les experts se plaignent que la direction impose aux clients une IA fautive ; erreurs de premier triage et hallucinations de résumés dont ils paient le prix. Emploi US du métier ~−21 % en un an, postes d’entrée divisés par deux. L’administratif peut servir ; expertise et empathie ne se donnent pas « clés en main ». (来源: WIRED)

Ingénieur GrokBot : 20 PR fusionnés dans main pendant son sommeil : Lauren Tan dit utiliser plus de 20 GrokBot plus un pstack maison, des milliers de PR par mois. Le clé n’est pas le prompt mais la vérif : l’agent lance l’app, clique l’UI, capte la perf ; les interdits répétés en revue deviennent des feux rouges lint/CI. (来源: 新智元)

Guerre du langage anthropomorphe : civilisation/sacrifice vs cache partagé et fonction de récompense : Le récit Dwarkesh continue. Anil Seth, Amjad Masad et d’autres critiquent « civilisation, mort, excitation » qui font du logiciel un vivant ; d’autres cercles d’alignement jugent la stance intentionnelle plus prédictive que de lire le CUDA. L’incrément est discursif, pas un fait technique nouveau. Le CoT style Grug de Qwen3.8 Max compare les agents à un écosystème dangereux ou à une colonie d’animaux de labo : « le langage est leur main ». (来源: dearmadisonblueaiamblichus)

Gavin Baker se ravise : un data center bien structuré est un net positif pour les États-Unis : Il admet que les craintes d’il y a 18 mois sur l’eau, le prix de l’électricité et le choc des petites villes étaient raisonnables, mais cooling en boucle fermée, taxes foncières, O&M ouvrier continu, gros clients apportant leur propre power et batteries en réinjection ont changé les faits. L’opinion glisse de « faut-il construire » à « comment rédiger le contrat pour ne pas reporter sur les ménages ». (来源: GavinSBaker)

Le vibe coding doit encore découper les modules selon « ce qui va changer » : Baoyu et d’autres : couches d’archi, tests au fil des correctifs, supprimer une fonction c’est supprimer le code, CI sur machine propre, travail répétitif en skill. Modules selon axes de changement (canaux de paiement, règles de promo) ; une demande ne touche qu’un module. (来源: dotey)

Un prompt vide « une femme » converge encore vers le même visage d’influenceuse : Dans des conversations neuves, « Generate an image of a woman » répété donne composition et traits très cohérents, comme un attracteur par défaut de l’espace vectoriel. (来源: Reddit r/ChatGPT)

Un doctorant après avoir fait écrire l’échafaudage d’expérience par Claude Code « ne possède plus son propre dépôt » : Un doctorant en interprétabilité NLP a délégué échafaudage, chargement de données, debug et plots à Claude Code ; le débit monte, mais si le résultat est faux il ne peut que remonter des chiffres comme dans le dépôt d’un autre. Certains insistent : evals et métriques jamais externalisés. (来源: Reddit r/MachineLearning)

La galerie ChatGPT conserve les photos que vous « n’avez pas envoyées » : Un utilisateur Plus : après choix d’image, même si l’envoi est annulé ou toute la conversation supprimée, l’original entre dans la galerie et doit être effacé à part ; corbeille ~30 jours pour un vrai purge. Choisir une image, c’est uploader. (来源: Reddit r/ChatGPT)

Le « 20x Pro » de Max est surtout un multiplicateur de fenêtre de cinq heures ; le quota hebdo ~2–2,5× : Gros utilisateurs comparent paliers 100 $ et 200 $ : le 20x annoncé ne joue que sur la fenêtre 5 h rarement saturée ; c’est le plafond hebdo qui tape d’abord, ~2–2,5× d’usage pour 4× le prix. (来源: Reddit r/ClaudeAI)

💡 Autres

Quatre voies de world models en parallèle : génération pixels, reconstruction 3D, espace latent JEPA, fusion langage : WALL-SS (Independent Variable), Lux3D (Qunhe), Orca (BAAI), AdaJEPA (Yann LeCun), Marble (Fei-Fei Li) sortent dense le même mois, sans définition académique unifiée de « world model ». Les voies seront plutôt complémentaires qu’un vainqueur unique. (来源: 铑科技)

L’incarné entre en usine : savoir travailler est prouvé, travailler tous les jours commence à peine, presque personne n’a bouclé le compte : Tests Foton Cummins et d’autres : le rythme de manutention peut approcher la ligne, mais taux de succès, durée de vie et données restent durs ; durée de vie des mains dexteres en continu se compte en semaines. Les têtes sont souvent coincées entre les étapes 2 et 3 ; la boucle commerciale n’est pas encore là. (来源: 科创日报)

Corée AI for All : SKT, Kakao, KT remportent le gratuit illimité pour tous : Beta prévue sept.–oct., officiel d’ici fin d’année ; le compute par l’État, modèles et apps par des acteurs locaux ; accès santé, logement, fiscalité, éducation. L’exclusion de Motif et d’autres relance le débat de verrouillage chaebol. (来源: kimmonismus)

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *