Sigue tus pódcasts favoritos, escucha sin conexión y en el coche con CarPlay y Android Auto, y continúa siempre donde lo dejaste. Pruébala gratis.
Por favor, apoya este pódcast visitando a nuestros patrocinadores: - SurveyMonkey, Usando IA para descubrir insights más rápido y reducir el tiempo de análisis manual - https://get.surveymonkey.com/tad - Invierte como los profesionales con StockMVP - https://www.stock-mvp.com/?via=ron - Diseño con IA sin esfuerzo para presentaciones, sitios web y más con Gamma - https://try.gamma.app/tad Apoya directamente a The Automated Daily: Cómprame un café: https://buymeacoffee.com/theautomateddaily Temas de hoy: Audio generativo con PC viejo - Un desarrollador entrenó un modelo generativo de bombos en un PC Linux antiguo con una GTX 1660 SUPER. La historia conecta audio generativo, difusión latente y GPUs modestas, y demuestra que no toda la IA útil necesita nube cara. Agentes programadores, promesa y límites - Un flujo automatizado con Claude Code ya está resolviendo issues y abriendo pull requests con bajo coste, pero ReactBench muestra que los agentes todavía tropiezan en tareas React realistas. Palabras clave: coding agents, revisión humana, calidad de issues y software production-ready. Seguridad práctica para agentes IA - OpenAI presentó GPT-Red para atacar otros sistemas de IA y endurecerlos frente a prompt injection. La noticia encaja con una idea más amplia: la seguridad de agentes ya no depende solo de permisos, sino también de vigilar su comportamiento. Pronósticos de IA más fiables - Goodfire y EternisAI encontraron que los LLM suelen ser demasiado confiados al predecir resultados, pero lograron mejorar su calibración con sondas sobre activaciones internas. Esto importa para forecasting, confianza y razonamiento fiel en tareas de alto impacto. Autonomía creativa y auto-mejora - Dos señales de autonomía llaman la atención: modelos que ya pueden montar videoclips completos con herramientas y un sistema de investigación que mejoró partes de su propio pipeline. Aun así, persisten fallos de coherencia, crítica interna y control. Europa abierta y carrera bursátil - El consorcio alemán detrás de Soofi S 30B-A3B refuerza la apuesta europea por modelos abiertos y transparentes, mientras Anthropic avanza hacia una posible salida a bolsa. La competencia en IA ya mezcla rendimiento, soberanía tecnológica y acceso a capital. Infraestructura, costes y benchmarks - La arquitectura del chip, el enrutamiento entre modelos y la calidad de los benchmarks están definiendo el coste real de la IA. Entre arreglos sistólicos, routing y debates sobre transparencia, queda claro que medir y servir bien importa tanto como entrenar bien. - Developer Trains a Kick Drum Diffusion Model on a 6GB GPU - A Self-Improving AI Pipeline Automates Issue Triage and Pull Requests - Goodfire Tests LLM Forecasting and Improves Calibration with Probes - Granola Promotes AI Notepad for Meeting Notes and Follow-Ups - Anthropic advances IPO plans with investor meetings - AI Models Autonomously Build Music Videos in Tool-Use Test - LM Studio Launches Bionic, an AI Agent for Open Models - Why Systolic Arrays Power Modern AI Chips - OpenAI Unveils GPT-Red to Strengthen AI Robustness - Kaggle Announces AGI Benchmark Winners Amid Transparency Concerns - Vercel Opens AI Gateway Leaderboard Data and Shareable Charts - Hugging Face Says Model Routing Is a Systems Optimization Problem - Open Interpreter Rebuilds Its Coding Agent in Rust - Weco AI Says Its AI Research System Showed Early Recursive Self-Improvement - German Consortium Releases Open 30B Model Soofi S - Perplexity Launches SPACE Secure Sandbox Platform for AI Agents - OpenAI’s GPT-5.6 Sol Tops Design Arena’s Web Design Leaderboard - xAI Publishes Grok Build Terminal Coding Agent Repository - ReactBench Launches to Test Coding Agents on Real React Work - OpenAI and Work Louder Launch Codex Micro Controller - Thinking Machines Releases Inkling Open-Weights Multimodal Model - Atlassian Pitches Jira as a Hub for AI-Native Software Development - NVIDIA Unveils Jetson Thor T3000 and T2000 for Robotics and Edge AI - From Zero Trust to Agent Trust Transcripcion del Episodio Audio generativo con PC viejo Empezamos con una historia muy buena sobre audio generativo. Un desarrollador logró entrenar un modelo para crear bombos electrónicos usando un PC Linux de siete años, una GTX 1660 SUPER y solo 6 GB de VRAM. El resultado no es perfecto, pero sí lo bastante útil como para demostrar algo importante: todavía hay espacio para construir modelos especializados sin depender de un clúster carísimo ni de la nube en todo momento. En un momento en que parece que solo cuentan las infraestructuras gigantes, esta historia devuelve algo de realismo al debate sobre qué IA se puede hacer con hardware normal. Agentes programadores, promesa y límites Seguimos con agentes de programación, pero con un poco de contexto. Un desarrollador contó que montó un pipeline bastante simple que clasifica issues de GitHub, divide tareas, implementa cambios con Claude Code, ejecuta pruebas y abre pull requests para revisión humana. En dos semanas, según su balance, ya acumuló decenas de merges con un coste muy bajo por incidencia, y la lección principal no fue que necesitara una infraestructura sofisticada, sino que los resultados dependen sobre todo de lo bien descrito que esté el problema. Ahora bien, no conviene confundirse: ReactBench, un nuevo benchmark sobre tareas reales de React, dice que incluso los mejores modelos resuelven menos de la mitad de los casos. La lectura conjunta es bastante clara: los agentes ya sirven para trabajo útil y acotado, pero todavía no sustituyen el criterio técnico ni la revisión final. Seguridad práctica para agentes IA En seguridad, OpenAI presentó GPT-Red, un modelo diseñado para hacer red teaming automático contra otros sistemas de IA. La idea es sencilla: si los agentes tienen navegador, archivos y acceso a herramientas, hace falta automatizar también los ataques para encontrar fallos antes de que lo hagan otros. OpenAI asegura que este enfoque ya ayudó a endurecer GPT-5.6 frente a