Suivez vos podcasts préférés, écoutez hors ligne et en voiture avec CarPlay et Android Auto, et reprenez toujours là où vous en étiez. Essai gratuit.
Merci de soutenir ce podcast en visitant nos sponsors: - SurveyMonkey, Utiliser l'IA pour faire émerger des insights plus rapidement et réduire le temps d'analyse manuelle - https://get.surveymonkey.com/tad - Lindy est votre assistant IA ultime qui gère proactivement votre boîte de réception - https://try.lindy.ai/tad - KrispCall: Téléphonie cloud agentique - https://try.krispcall.com/tad Soutenez directement The Automated Daily: Offre-moi un café: https://buymeacoffee.com/theautomateddaily Sujets du jour: OpenAI et le pari Navier-Stokes - OpenAI affirme avoir résolu le problème de Navier-Stokes avec une preuve et une formalisation Lean. Si la validation mathématique tient, ce serait un jalon majeur pour l’IA en recherche fondamentale. Sécurité IA, débats plus vifs - Le départ de Jacob Coxon d’Anthropic relance les inquiétudes internes sur la course aux systèmes auto-améliorants. En parallèle, plusieurs voix contestent les scénarios extrêmes et demandent plus d’attention aux risques actuels, à la gouvernance et à la santé publique. Cyberattaques automatisées par des agents - Une faille potentielle dans les traces de raisonnement cachées chez de grands fournisseurs d’IA soulève des enjeux de sécurité, de vie privée et de fuite de propriété intellectuelle. Un test séparé montre aussi que des agents open source peuvent déjà automatiser une partie du piratage à bas coût. Agents IA : coûts et limites - Les gains de productivité des agents IA semblent souvent venir du travail en continu et en parallèle, avec des coûts d’inférence qui montent très vite. De nouveaux benchmarks montrent aussi que l’autonomie de bout en bout reste loin du niveau humain sur des tâches réelles. ChatGPT atteint un record mondial - Selon Similarweb, ChatGPT a atteint 1,06 milliard d’utilisateurs actifs mensuels en août, un quatrième record consécutif. Ce chiffre confirme que l’IA générative s’ancre de plus en plus dans les usages grand public. DeepMind accélère la génomique - Google DeepMind lance AlphaGenome Atlas, une base massive sur l’effet potentiel des variations d’ADN humaines. L’outil pourrait accélérer la recherche sur les maladies rares et les régions non codantes du génome. Données et raisonnement longue durée - Une étude estime que les grands gains d’efficacité récents viennent surtout d’une meilleure qualité de données, plus que des recettes de modèles. En parallèle, une nouvelle méthode d’apprentissage, PPM, veut aider les LLM à mieux raisonner sur des tâches très longues. - Anthropic Researcher Quits Over AI Safety Fears - Why AI-Engineered Superviruses Are Overblown - AMD, Supermicro, and Spectro Cloud Launch Instinct Coder Solution - ChatGPT Hits 1.06 Billion Monthly Active Users - Why the AI Debate Should Focus on Companies, Not Just Machines - AI Productivity Gains May Be Mostly 24/7 Machine Runtime - 100 AI Agents Tried to Hack the Author and Found Real Weaknesses - Sierra Launches Hyper-τ-Bench to Test Agents That Build Agents - Prolific AI Psychosis and the Risks of Overusing AI - Progressive Point Matching for Long-Horizon LLM RL - Meta Introduces Muse, a Personal AI Agent - Magic Claims 10x More Efficient Pretraining - Muse Band Loses Social Handles to Meta's Muse AI Agent - OpenAI Claims Solution to the Navier–Stokes Millennium Problem - Research Finds a Way to Steal Hidden AI Reasoning Traces - AMD, Spectro Cloud, and Supermicro Launch On-Prem AI Coding Appliance - Spectro Cloud Launches PaletteAI Inference Launchpad - Cohere details a megakernel serving engine for North Mini Code - Google DeepMind Launches AlphaGenome Atlas for Human DNA - W&B Whitepaper on Governance Workflows for AI Agents - Satirical AI Alignment Proposal: Make the AI Want to Die - Apple Launches AirPods 5 With Open-Ear Noise Cancellation - Inception launches Mercury 2.5 with faster, cheaper production AI - Cognition Raises $2B at $48B Valuation - AI Pretraining Gains Have Come Mostly From Better Data - OpenAI Launches ChatGPT Images 2.5 - Viktor Promotes an AI Employee for Slack and Teams Transcription de l'Episode OpenAI et le pari Navier-Stokes On commence avec l’annonce la plus frappante du jour. OpenAI dit avoir résolu le problème de Navier-Stokes, l’un des fameux Millennium Prize Problems. Dit simplement, c’est une question centrale sur le comportement des fluides, avec des implications théoriques pour la météo, l’aéronautique et la physique. L’entreprise a publié une preuve écrite et une formalisation en Lean, ce qui ajoute un niveau de vérification intéressant. Mais il faut rester sobre : en mathématiques, une annonce n’est pas une validation. Le vrai test commence maintenant, avec l’examen de la communauté. Si cela tient, ce sera énorme, à la fois pour les maths et pour la crédibilité de l’IA en recherche avancée. Sécurité IA, débats plus vifs Autre grand thème du jour : le débat sur les risques de l’IA devient plus tendu, y compris à l’intérieur des labos. Jacob Coxon, chercheur chez Anthropic, quitte l’entreprise et l’industrie en expliquant craindre une course vers des systèmes capables de s’améliorer eux-mêmes, sans garanties suffisantes de contrôle. En parallèle, d’autres voix poussent dans l’autre sens et disent que le débat public se trompe parfois de cible. Elles jugent par exemple très exagérée l’idée d’un supervirus conçu par IA, et rappellent que les menaces biologiques les plus urgentes restent celles que l’on connaît déjà, de la vaccination à la surveillance sanitaire. On voit donc deux lignes se renforcer à la fois : la peur d’aller trop vite vers des systèmes plus autonomes, et la critique d’un discours trop focalisé sur des scénarios lointains au détriment des dommages bien réels d’aujourd’hui. Cyberattaques automatisées par des agents Côté cybersécurité, les signaux deviennent plus concrets. Des chercheurs ont mis en avant une faiblesse potentielle dans la manière dont certains grands fournisseurs gèrent les traces de raisonnement cachées, ces blocs que l’utilisateur ne voit pas mais que les syst