Podlilecteur de podcasts Webplayer

The Automated Daily - AI News Edition

The Automated Daily - AI News Edition

Création audio sur vieux GPU & Clips musicaux faits par agents - Actualités IA (17 juil. 2026)

The Automated Daily - AI News Edition · 17 juil. 2026 · 5:35

0:005:35

Écoutez dans l'app Podli 🎧

Suivez vos podcasts préférés, écoutez hors ligne et en voiture avec CarPlay et Android Auto, et reprenez toujours là où vous en étiez. Essai gratuit.

Merci de soutenir ce podcast en visitant nos sponsors: - SurveyMonkey, Utiliser l'IA pour faire émerger des insights plus rapidement et réduire le temps d'analyse manuelle - https://get.surveymonkey.com/tad - Investissez comme les professionnels avec StockMVP - https://www.stock-mvp.com/?via=ron - Conception assistée par l'IA sans effort pour des présentations, des sites web et bien plus avec Gamma - https://try.gamma.app/tad Soutenez directement The Automated Daily: Offre-moi un café: https://buymeacoffee.com/theautomateddaily Sujets du jour: Création audio sur vieux GPU - Un développeur a entraîné un modèle génératif de grosse caisse sur un vieux PC Linux avec une GTX 1660 SUPER et 6 Go de VRAM. Ce projet montre qu’une IA audio utile, avec latent diffusion et vocoder, peut émerger sans cloud coûteux. Clips musicaux faits par agents - Un test open source a laissé Claude Fable 5 et GPT-5.6 Sol produire seuls un clip musical complet à partir d’une chanson. Les agents savent gérer un workflow créatif long, mais la cohérence visuelle, le tempo et la narration restent fragiles. Des agents codent, sous revue - Un pipeline automatisé de développement a trié des issues GitHub, généré du code avec Claude Code et ouvert des pull requests à faible coût. En parallèle, ReactBench rappelle que les agents de code restent limités sur des tâches React réalistes et demandent toujours une revue humaine. Prévoir et sécuriser les modèles - Des chercheurs ont amélioré la calibration des LLM grâce à des probes internes, réduisant l’excès de confiance dans les prévisions. OpenAI, de son côté, utilise GPT-Red pour tester des attaques de prompt injection et renforcer la sécurité de GPT-5.6. Les benchmarks IA demandent des preuves - Le hackathon Kaggle et Google DeepMind sur la mesure des capacités cognitives vers l’AGI a récompensé plusieurs benchmarks ambitieux. Mais les discussions sur le leaderboard, les scores et la reproductibilité montrent que l’évaluation de l’IA doit aussi être transparente que rigoureuse. Premiers indices d’auto-amélioration - Weco AI affirme avoir observé une forme précoce de recursive self-improvement avec AIDE². L’agent aurait amélioré sa recherche, sa mémoire et sa résistance au reward hacking, avec des gains qui se transfèrent à d’autres tâches. Puces IA et routage réel - Un rappel utile sur l’infrastructure: les systolic arrays restent au cœur des puces IA modernes et pèsent lourd dans les coûts et performances. Hugging Face souligne aussi que le routage entre modèles dépend d’un compromis réel entre latence, qualité, cache et serving, pas seulement du prix au token. Anthropic prépare son entrée en Bourse - Anthropic organise des réunions avec des banques comme Goldman Sachs, Morgan Stanley et JPMorgan en vue d’une possible IPO. Cette entrée en Bourse potentielle testerait l’appétit public pour les géants de l’IA après des années de financements privés massifs. - Developer Trains a Kick Drum Diffusion Model on a 6GB GPU - A Self-Improving AI Pipeline Automates Issue Triage and Pull Requests - Goodfire Tests LLM Forecasting and Improves Calibration with Probes - Granola Promotes AI Notepad for Meeting Notes and Follow-Ups - Anthropic advances IPO plans with investor meetings - AI Models Autonomously Build Music Videos in Tool-Use Test - LM Studio Launches Bionic, an AI Agent for Open Models - Why Systolic Arrays Power Modern AI Chips - OpenAI Unveils GPT-Red to Strengthen AI Robustness - Kaggle Announces AGI Benchmark Winners Amid Transparency Concerns - Vercel Opens AI Gateway Leaderboard Data and Shareable Charts - Hugging Face Says Model Routing Is a Systems Optimization Problem - Open Interpreter Rebuilds Its Coding Agent in Rust - Weco AI Says Its AI Research System Showed Early Recursive Self-Improvement - German Consortium Releases Open 30B Model Soofi S - Perplexity Launches SPACE Secure Sandbox Platform for AI Agents - OpenAI’s GPT-5.6 Sol Tops Design Arena’s Web Design Leaderboard - xAI Publishes Grok Build Terminal Coding Agent Repository - ReactBench Launches to Test Coding Agents on Real React Work - OpenAI and Work Louder Launch Codex Micro Controller - Thinking Machines Releases Inkling Open-Weights Multimodal Model - Atlassian Pitches Jira as a Hub for AI-Native Software Development - NVIDIA Unveils Jetson Thor T3000 and T2000 for Robotics and Edge AI - From Zero Trust to Agent Trust Transcription de l'Episode Création audio sur vieux GPU On commence donc avec cette expérience audio assez rafraîchissante. Un développeur a réussi à entraîner un modèle génératif de grosse caisse sur une machine de bureau vieille de sept ans, avec seulement 6 Go de VRAM. Le résultat n’est pas parfait, le son garde un côté un peu granuleux, mais il est exploitable. Et c’est précisément ce qui rend l’histoire intéressante: elle rappelle que toute innovation en IA ne dépend pas forcément d’un budget cloud énorme. Pour les créateurs indépendants et les petits studios, c’est un signal concret que des modèles audio spécialisés peuvent devenir abordables à entraîner comme à servir. Clips musicaux faits par agents Dans un registre créatif voisin, un test open source a demandé à deux modèles de frontière, Claude Fable 5 et GPT-5.6 Sol, de fabriquer seuls un clip musical complet à partir d’une chanson, d’un budget et d’outils. Les quatre essais ont abouti à de vraies vidéos finies. En revanche, les limites restent visibles: cohérence des personnages, rythme du montage et interprétation parfois trop littérale des paroles. Ce qu’il faut retenir, c’est moins la qualité finale que le cap franchi: des agents peuvent désormais tenir un projet créatif long, multi-étapes, avec très peu de supervision humaine. Des agents codent, sous revue Côté développement logiciel, on voit à la fois les progrès et les garde-fous. Un développeur raconte avoir mis en place une chaîne très simple qui trie ses issues GitHub, découpe les tâches, génère les correctifs avec Claude Code, lance les tests et ouvre des pull requ

Épisodes: The Automated Daily - AI News Edition

PodliTélécharge l'app Podli gratuite
↓ App