Suivez vos podcasts préférés, écoutez hors ligne et en voiture avec CarPlay et Android Auto, et reprenez toujours là où vous en étiez. Essai gratuit.
Merci de soutenir ce podcast en visitant nos sponsors: - Lindy est votre assistant IA ultime qui gère proactivement votre boîte de réception - https://try.lindy.ai/tad - Investissez comme les professionnels avec StockMVP - https://www.stock-mvp.com/?via=ron - Consensus: IA pour la recherche. Obtenez un mois gratuit - https://get.consensus.app/automated_daily Soutenez directement The Automated Daily: Offre-moi un café: https://buymeacoffee.com/theautomateddaily Sujets du jour: Coût d’inférence et modèles ouverts - GLM 5.2 de Z.ai apparaît comme un concurrent crédible face à Opus et GPT sur le code et les usages agentiques. Mots-clés : inférence, open weights, coûts par token, marges, API compatibles, compute. IA locale du mini-PC au téléphone - AMD pousse une plateforme d’IA locale plus simple à utiliser, pendant que des stations multi-GPU et de petits modèles sur smartphone élargissent les usages réels. Mots-clés : Ryzen AI Halo, LLM local, NPU, edge AI, confidentialité, faible latence. Open source IA et distillation - Une nouvelle Gap Map de l’open source IA montre où l’écosystème est solide et où il manque encore des briques importantes. La distillation revient aussi au centre du jeu pour rendre les modèles moins chers et plus faciles à déployer. Agents de code et vérification - Dans les outils de code, le modèle seul ne suffit plus : le harnais logiciel, la vérification autonome et la délégation vers des sous-agents deviennent décisifs. Mots-clés : coding agents, browser testing, auditabilité, subagents, workflow. GPT-5.6, Claude Code, contrôle - OpenAI semble préparer GPT-5.6 dans Codex, tandis qu’Alibaba écarterait Claude Code en interne. Mots-clés : Codex, raisonnement, sécurité, géopolitique, contrôle fournisseur, développeurs. Gemini Inbox et vidéo longue - Google teste un espace Gemini centré sur l’Inbox et la revue de tâches, pendant que ByteDance viserait des vidéos IA beaucoup plus longues avec Seedance 2.5. Mots-clés : productivité, email, agent, génération vidéo, storytelling. Pourquoi l’IA frotte partout - Le cadre des Pace Layers aide à comprendre pourquoi l’IA avance plus vite que l’énergie, les institutions et même les sources de données humaines. Mots-clés : infrastructure, gouvernance, data centers, données synthétiques, adoption. - AMD Ryzen AI Halo Puts Local AI Development in a Mini-PC - GLM 5.2 Could Trigger an AI Inference Margin Collapse - Current AI Releases Open Source AI Gap Map - Guide to Building a High-End Local LLM Workstation - CData Unveils New Governance Features for Connect AI - AI Compute Sales Don’t Signal the End of Scarcity - ByteDance Expected to Launch Seedance 2.5 with Longer AI Video Generation - Pace Layers Reveal the AI Ecosystem’s Speed Mismatch - Article Traces the History of AI Model Distillation - Closing the Verification Loop for AI-Assisted Development - Article Argues AI Coding Agents Depend on Their Harnesses - Claude Code Learns to Delegate Work to Smaller Models - Alibaba Reportedly Bans Claude Code for Employees - Claude Fable 5 and the Limits of the Map - Small AI Models Bring Practical AI to Low-Infrastructure Regions - OpenAI Hints at GPT-5.6 Preview in Codex Ahead of Possible Launch - OfficeCLI Brings AI-Native Office Document Automation to the Command Line - Google Tests a Gemini Inbox for Workspace Task Triage Transcription de l'Episode Coût d’inférence et modèles ouverts On commence par l’économie de l’IA, parce que c’est probablement là que la bataille se déplace vraiment. Une analyse estime que le point sensible n’est plus tant l’entraînement des modèles que l’inférence, autrement dit le coût de chaque usage réel. Au centre du débat, GLM 5.2 de Z.ai, un modèle open weights que certains jugent déjà assez bon pour concurrencer les offres premium sur le code et les tâches agentiques. Comme il peut s’intégrer via des API familières, changer de fournisseur devient beaucoup plus simple. Et si ce type de modèle continue à progresser, la pression sur les marges des grands labos pourrait devenir très sérieuse. En parallèle, les ventes ponctuelles de capacité chez Meta ou xAI ne veulent pas dire que le compute est soudain abondant : les prix restent élevés et la demande reste très vive. En clair, le marché pourrait se couper en deux, entre tokens bon marché pour le volume et tokens chers pour les usages critiques. IA locale du mini-PC au téléphone Deuxième thème, l’IA locale continue de gagner du terrain, mais pas uniquement grâce à la puissance brute. Le mini-PC Ryzen AI Halo d’AMD n’impressionne pas surtout par ses performances pures, qui restent globalement dans la norme de sa catégorie, surtout face aux Mac Studio sur certains modèles très gourmands en bande passante. Ce qui ressort, c’est plutôt l’effort logiciel : outils de configuration, recettes prêtes à l’emploi et installation simplifiée pour lancer des LLM, du PyTorch ou du développement à distance sans passer des heures à régler des dépendances. Dans le même temps, des passionnés montrent qu’un vrai serveur local multi-GPU peut désormais faire tourner des modèles très ambitieux, à condition d’accepter le coût et la complexité. Et à l’autre extrémité, de petits modèles exécutés directement sur téléphone servent déjà à vérifier des médicaments, détecter des maladies des cultures ou suivre des signaux de santé dans des zones où le cloud n’est pas fiable. La tendance est nette : l’IA sort du datacenter et s’adapte enfin au contexte réel. Open source IA et distillation Côté open source, il y a aussi un signal intéressant de maturité. Current AI a publié une Gap Map qui passe en revue des dizaines de milliers de projets pour repérer les zones solides et les manques dans la pile open source, depuis les modèles de base jusqu’au déploiement, en passant par les jeux de données, l’évaluation et la sécurité. L’intérêt, ce n’est pas seulement de faire un inventaire, c’est de montrer où l’effort collectif serait le plus utile. Dans le même esprit, la distillation revient au premier p