Suivez vos podcasts préférés, écoutez hors ligne et en voiture avec CarPlay et Android Auto, et reprenez toujours là où vous en étiez. Essai gratuit.
Merci de soutenir ce podcast en visitant nos sponsors: - KrispCall: Téléphonie cloud agentique - https://try.krispcall.com/tad - Investissez comme les professionnels avec StockMVP - https://www.stock-mvp.com/?via=ron - Consensus: IA pour la recherche. Obtenez un mois gratuit - https://get.consensus.app/automated_daily Soutenez directement The Automated Daily: Offre-moi un café: https://buymeacoffee.com/theautomateddaily Sujets du jour: OpenAI et Anthropic au coude-à-coude - Anthropic prolonge l’accès à Claude Fable 5 jusqu’au 19 juillet, tandis qu’OpenAI assouplit temporairement les limites de GPT-5.6 Sol. Mots-clés : Anthropic, OpenAI, Claude Fable 5, GPT-5.6 Sol, compute, abonnements IA. La mémoire active des agents - LangChain lance OpenWiki Brains et des chercheurs proposent une mémoire proactive pour agents longue durée. Mots-clés : agents IA, mémoire proactive, OpenWiki, LangChain, contexte, automatisation. Les assistants quittent le code - Claude Code ajoute un navigateur intégré et Cursor testerait Sand, un agent orienté travail de bureau. Mots-clés : Claude Code, Cursor, agent IA, navigateur intégré, productivité, email. Évaluer l’IA avec nuance - Google Cloud présente Discovery Bench pour mesurer les chutes de performance face à l’ambiguïté, pendant qu’un nouveau cadre de vérification affine l’évaluation des réponses. Mots-clés : benchmark IA, Discovery Bench, vérification LLM, évaluation agents, fiabilité. Pourquoi posséder ses poids - Le débat sur la propriété des poids de modèles revient au centre de la stratégie IA d’entreprise. Mots-clés : own your weights, Alex Karp, Palantir, souveraineté IA, dépendance fournisseur. Coder avec l’IA, vraiment - Jacquard imagine un langage pensé pour du code généré par modèles, alors que la valeur réelle du code IA reste contestée. Mots-clés : Jacquard, programmation IA, audit du code, fiabilité logicielle, développement logiciel. Procès, sécurité et consentement - OpenAI réorganise sa sécurité interne, Apple attaque l’entreprise en justice et Meta retire une fonction d’image IA après un tollé. Mots-clés : OpenAI safety, Apple procès, Meta Instagram, vie privée, consentement, gouvernance IA. - Clouded Judgement Argues Companies Should Own Their AI Weights - Anthropic Extends Claude Fable Access Again as OpenAI Raises Pressure - LangChain Launches OpenWiki Brains for Proactive AI Memory - Jason Says Sol Is Built for Multi-Tool Work - Jacquard Open-Source Language Targets AI-Written, Human-Reviewed Code - Google Cloud Proposes Information-Theoretic Benchmarking for AI Agents - Apple sues OpenAI over alleged trade secret theft - Thinking Machines Argues for Human-Centered, Customizable AI - LLM Verification Framework Boosts Benchmark Performance Across Coding, Robotics, and Medicine - OpenAI Reorganizes Safety Teams as Safety Chief Departs - Cursor Reportedly Building General-Purpose AI Agent Sand - Big Mouth Billy Bass Gets Turned Into a Voice Assistant - OpenAI Temporarily Lifts GPT-5.6 Sol Usage Cap - Proactive Memory Agent Boosts Long-Horizon AI Task Performance - Claude Code Desktop Adds In-App Browser - Granola Positions Itself as an AI Notepad for Meetings - HUMAN Named Leader in Forrester Wave for Bot and Agent Trust Management - Greg Brockman Takes Bigger Role at OpenAI Ahead of IPO - Meta removes Instagram AI image tool after privacy backlash - Opinion: AI Is Exposing Weaknesses in Software Development - sx 2.0 Turns Shared Folders Into an AI Skills Server Transcription de l'Episode OpenAI et Anthropic au coude-à-coude Commençons par la bataille entre OpenAI et Anthropic. Anthropic prolonge finalement l’accès à Claude Fable 5 pour les offres payantes jusqu’au 19 juillet, après avoir laissé entendre qu’il faudrait réduire sa disponibilité à cause de contraintes de calcul. En face, OpenAI desserre temporairement les limites d’usage de GPT-5.6 Sol et promet un modèle plus efficace. Ce que cela montre, c’est que dans l’IA grand public et pro, la qualité du modèle ne suffit plus : la disponibilité réelle, au bon moment, devient un avantage concurrentiel décisif. Et Sol gagne aussi du terrain comme outil généraliste, au-delà du simple usage code. La mémoire active des agents Autre tendance forte : la mémoire des agents devient active. LangChain lance OpenWiki Brains, un système qui va chercher du contexte dans des sources comme Gmail, Notion, des dépôts Git ou le web, puis l’organise localement pour qu’un agent retrouve plus facilement ce qui compte. En parallèle, des chercheurs proposent un module de mémoire proactive capable de décider lui-même quand rappeler un fait important à un agent qui travaille sur une tâche longue. L’idée est simple mais importante : un agent utile ne doit pas seulement répondre vite, il doit aussi rester cohérent dans le temps. Les assistants quittent le code Dans le même esprit, les assistants IA sortent progressivement du monde strictement développeur. Claude Code intègre désormais un navigateur directement dans l’application, ce qui lui permet de consulter de la documentation, des maquettes ou d’autres pages web sans casser le flux de travail. Et selon plusieurs informations, Cursor teste en interne un agent plus généraliste, nommé Sand, capable d’aider sur des emails, des feuilles de calcul ou d’autres tâches de bureau. En clair, le marché vise de plus en plus le travail quotidien complet, pas seulement le code. Évaluer l’IA avec nuance Côté recherche, on voit aussi des avancées utiles dans la manière de mesurer l’IA. Google Cloud présente Discovery Bench, une approche qui regarde non seulement si un agent réussit, mais aussi à quel moment il décroche quand une question devient plus floue. De leur côté, d’autres chercheurs proposent LLM-as-a-Verifier, un cadre qui juge la qualité d’une réponse avec plus de finesse qu’un simple oui ou non. Le point commun est clair : les scores globaux sont pratiques, mais ils cachent souvent les moments exacts où un système devient peu fiable. Pourquoi posséder ses poids Su