Sigue tus pódcasts favoritos, escucha sin conexión y en el coche con CarPlay y Android Auto, y continúa siempre donde lo dejaste. Pruébala gratis.
La industria dejó de fingir que el tamaño importa cuando AirLLM demostró que un modelo de 2,8 billones de parámetros puede ejecutarse con apenas 4 GB de VRAM, rompiendo efectivamente la barrera hardware para la inferencia local. Nvidia adquenta talento de Poolside para acelerar el desarrollo de Nemotron y publica un marco de trabajo para asegurar agentes de IA autónomos. Alibaba DAMO Academy lanza 4DAnyone para expandir aún más los límites de la generación. DeepSeek añade capacidades visuales a V4-Flash para un razonamiento más fundamentado. SenseNova entra en esta dinámica con U1.5-8B-MoT para la generación multimodal nativa, desafiando la necesidad de arquitecturas más grandes. Tencent Zhuque Lab responde lanzando el conjunto de seguridad AI-Infra-Guard para garantizar que la velocidad no supere los protocolos de seguridad.