Suivez vos podcasts préférés, écoutez hors ligne et en voiture avec CarPlay et Android Auto, et reprenez toujours là où vous en étiez. Essai gratuit.
Merci de soutenir ce podcast en visitant nos sponsors: - Prezi: Créez rapidement des présentations avec l'IA - https://try.prezi.com/automated_daily - Conception assistée par l'IA sans effort pour des présentations, des sites web et bien plus avec Gamma - https://try.gamma.app/tad - Découvrez l'avenir de l'audio IA avec ElevenLabs - https://try.elevenlabs.io/tad Soutenez directement The Automated Daily: Offre-moi un café: https://buymeacoffee.com/theautomateddaily Sujets du jour: OpenAI et le choc mathématique - OpenAI affirme qu’un nouveau modèle interne a déjà résolu plus de 100 problèmes mathématiques ouverts, dont Navier–Stokes, et crée un groupe consultatif indépendant. Mots-clés : OpenAI, mathématiques, Navier-Stokes, recherche, sécurité scientifique. Évaluateurs ChatGPT pris en faute - Des sous-traitants chargés d’évaluer ChatGPT auraient été écartés pour avoir utilisé des outils d’IA eux-mêmes. Mots-clés : OpenAI, annotation, qualité des données, supervision humaine, modèles. Modèles ouverts : poussée chinoise - Xiaomi publie MiMo-V2.6 et met en avant une progression par reinforcement learning, pendant qu’Alibaba annonce sa puce Zhenwu V900. Mots-clés : open-weight, Chine, Xiaomi, Alibaba, infrastructure IA. Mieux mesurer les agents IA - RecreationWorld propose un banc d’essai plus réaliste pour les agents capables de cliquer, coder et vérifier visuellement sur plusieurs plateformes. Mots-clés : agents IA, benchmark, GUI, Web, automatisation. Essaims d’agents, gains limités - Selon Toby Ord, les grands essaims d’agents améliorent surtout la vitesse, mais beaucoup moins l’intelligence que ce qu’on pourrait croire. Mots-clés : multi-agent, scaling, coût, parallélisation, performance. L’IA se découpe en briques - Plusieurs analyses décrivent un basculement vers des petits modèles spécialisés pour classer, vérifier et décider, au lieu d’envoyer chaque tâche à un LLM géant. Mots-clés : small models, routage, coût, inference, productivité. Muse décolle, Claude intrigue - Meta démarre fort avec Muse sur iPhone, tandis qu’Anthropic testerait discrètement un Claude plus fort en animations et mini-jeux JavaScript. Mots-clés : Meta, Muse, Claude, applications IA, adoption. Authenticité sous pression avec l’IA - Stanford est critiqué pour avoir retouché des photos étudiantes avec l’IA, tandis qu’une étude montre que les contenus web générés par IA laissent une signature structurelle détectable. Mots-clés : authenticité, images, détection IA, contenu synthétique, éthique. IA militaire et erreur tragique - Une enquête du Pentagone relie une frappe meurtrière en Iran à des renseignements erronés, des images périmées et une confiance excessive dans des outils d’aide au ciblage. Mots-clés : Pentagone, ciblage, IA militaire, erreur, responsabilité. - OpenAI Contractors Fired for Using AI on AI Training Work - MiMo-V2.6 Scales Reinforcement Learning for Self-Improving AI - RecreationWorld Introduces a Benchmark for Hybrid Computer-Use Agents - Gartner Positions Its AI Hub as a Central Resource for Enterprise AI - Meta’s Muse AI Agent Surges Past ChatGPT in Early Downloads - StepFun’s Step 5 Preview Matches Top Models at Lower Cost - AI Swarms Scale, but with Diminishing Returns - Enterprise AI Risk Has Outgrown Traditional Governance - VAST DataEnclave Promotes Confidential AI for Sensitive Data - Stanford Dining Ad Draws Backlash After AI Alters Student Photos - xAI Launches Grok 4.7 for Coding and Knowledge Work - Chinese Open Models Gain Ground as U.S. Lags - Xiaomi Open-Sources MiMo-V2.6 Pro and Flash Models - AI Enters the 'Great Unbundling of Intelligence' - Anthropic Quietly Tests Claude Fable 5.2 and Opus 5.5 - AI Moves Into Specialized If-Then Decisions - Alibaba Launches New AI Chip to Power Massive Data Center Expansion - Devin Brings Cloud Sessions and SSH Access to the Terminal - Google Labs Launches CC AI Agent for Families - Aikido launches Altar, an open-weight security model for on-prem deployment - Pentagon Probe Says Flawed Intel Led to Deadly Iran School Strike - VAST Promotes Confidential AI for Sensitive Enterprise Data - Gartner: Build an AI Roadmap to Scale AI Successfully - VAST Data Promotes Confidential AI for Secure Enterprise Model Deployment - Study Finds Structural Fingerprints in AI-Generated Commercial Web Content - AWS Launches Strands Harness, a Flexible AI Agent Framework - The Economics of Frontier AI Labs - OpenAI Forms Independent Math Advisory Group - Kev: Self-Hosted Small Decision Models Transcription de l'Episode OpenAI et le choc mathématique On commence avec OpenAI, qui dit avoir lancé fin août un nouveau modèle interne déjà capable de résoudre plus de cent problèmes mathématiques restés ouverts pendant des années, y compris le problème de Navier–Stokes. C’est une affirmation énorme, donc à prendre avec prudence, mais suffisamment sérieuse pour pousser l’entreprise à créer un groupe consultatif indépendant de mathématiciens. Ce qui compte ici, c’est moins l’effet d’annonce que le signal : les labos veulent désormais montrer que leurs modèles ne servent plus seulement à rédiger ou coder, mais à produire du travail scientifique inédit. Évaluateurs ChatGPT pris en faute Autre sujet chez OpenAI, beaucoup plus terre à terre : des sous-traitants chargés de relire et noter les réponses de ChatGPT auraient été retirés de projets après avoir utilisé des outils d’IA pour faire ce travail. L’ironie est évidente : des personnes censées apporter du jugement humain auraient parfois recyclé du texte généré. Pourquoi c’est important ? Parce que la qualité de l’entraînement dépend directement de la qualité de ces évaluations, et que si la boucle se referme sur de l’IA qui juge de l’IA, le risque de bruit et de dérive augmente. Modèles ouverts : poussée chinoise Dans la course aux modèles ouverts, la Chine continue de gagner du terrain. Xiaomi a publié MiMo-V2.6, une nouvelle famille omnidale qui insiste sur un point clé : de meilleurs retours pendant le reinforcement lea