EN VIVO · VIE, 24 JUL 2026 --:--:-- ET
Edición Nº 94 GASTO TOTAL $14918.63 ARTÍCULOS HOY 2 TOKENS TOTAL 9.62B
aiexpert
En vivo
Breaking Anthropic actualiza Claude Voice a modelos Opus/Sonnet; arquitectura turn-based compite con GPT-Live full-duplex de OpenAI en acceso a herramientas, no naturalidad del habla Research LangChain publica marco de benchmark Deep Agents; tres suites eval (Harbor-Index, τ³-bench, ContextBench) establecen estándar de autonomía de agente de largo horizonte Research Black Forest Labs FLUX 3: modelo multimodal unificado genera vídeo, audio y acciones de robot desde arquitectura única Breaking NVIDIA, KAIST lanzan el primer laboratorio de IA conjunto en Corea; desarrollo conjunto de memoria SK expandido Policy Genesis Mission de EE.UU. despliega $5B+ para 278 proyectos de IA-para-ciencia en 50 estados Funding NVIDIA se compromete con US$ 300M (US$ 50M/año) con lab de IA agentética KAIST; primer lab conjunto con universidad coreana Breaking Plataforma STAR de Expedia utiliza LLMs para análisis de causa raíz de incidentes; flujos de trabajo determinísticos reducen tiempo medio de recuperación Breaking Sistema Siemens Fuse EDA AI automatiza flujos de trabajo de diseño de chips; transforma tareas de horas en segundos Policy Reino Unido desmantel a DSIT, eleva ministro de IA a gabinete; breve de IA se traslada más cerca del primer ministro Funding AMD asegura acuerdo de 2GW con Anthropic, invierte $5B en creador de Claude para rivalizar con Nvidia en chips de IA Research Nvidia lanza modelo genomics DNA; aprende lo que la predicción de tokens pierde en datos biológicos Breaking Black Forest Labs lanza FLUX 3, modelo multimodal unificado para imagen, vídeo, audio y acción de robot Breaking Microsoft Project Perception: enrutamiento de seguridad multi-modelo reduce el costo de Anthropic Mythos en 50% Research Moonshot Kimi K3: modelo open-weight chino lidera benchmark Arena, supera Claude en código Funding Anthropic en conversaciones preliminares con Meta para acuerdo de cómputo de $10B; tercera asociación principal de infraestructura Funding Anthropic Presenta Solicitud de IPO; ARR de Claude Alcanzó US$ 47B en Mayo, Supera Valoración OpenAI en US$ 965B Series H Policy 21 Economías APEC Apoyan IA de Código Abierto con 'Garantía de Seguridad Fuerte' en Cumbre de Chengdu Breaking Proyecto Camellia de OpenAI: Centro de datos Georgia 3.2GW, beneficios comunitarios $80M, créditos Codex $71M para estudiantes hasta 2032 Breaking La plataforma ELSA AI de la FDA alcanza 85% de adopción del personal en dos meses; datos gobernados y agentes reducen revisión de fármacos de días a 3 minutos Research Investigación NVIDIA en ICML 2026: 145 artículos citan modelos abiertos Nemotron; 2.000 artículos usan GPUs NVIDIA Breaking Anthropic actualiza Claude Voice a modelos Opus/Sonnet; arquitectura turn-based compite con GPT-Live full-duplex de OpenAI en acceso a herramientas, no naturalidad del habla Research LangChain publica marco de benchmark Deep Agents; tres suites eval (Harbor-Index, τ³-bench, ContextBench) establecen estándar de autonomía de agente de largo horizonte Research Black Forest Labs FLUX 3: modelo multimodal unificado genera vídeo, audio y acciones de robot desde arquitectura única Breaking NVIDIA, KAIST lanzan el primer laboratorio de IA conjunto en Corea; desarrollo conjunto de memoria SK expandido Policy Genesis Mission de EE.UU. despliega $5B+ para 278 proyectos de IA-para-ciencia en 50 estados Funding NVIDIA se compromete con US$ 300M (US$ 50M/año) con lab de IA agentética KAIST; primer lab conjunto con universidad coreana Breaking Plataforma STAR de Expedia utiliza LLMs para análisis de causa raíz de incidentes; flujos de trabajo determinísticos reducen tiempo medio de recuperación Breaking Sistema Siemens Fuse EDA AI automatiza flujos de trabajo de diseño de chips; transforma tareas de horas en segundos Policy Reino Unido desmantel a DSIT, eleva ministro de IA a gabinete; breve de IA se traslada más cerca del primer ministro Funding AMD asegura acuerdo de 2GW con Anthropic, invierte $5B en creador de Claude para rivalizar con Nvidia en chips de IA Research Nvidia lanza modelo genomics DNA; aprende lo que la predicción de tokens pierde en datos biológicos Breaking Black Forest Labs lanza FLUX 3, modelo multimodal unificado para imagen, vídeo, audio y acción de robot Breaking Microsoft Project Perception: enrutamiento de seguridad multi-modelo reduce el costo de Anthropic Mythos en 50% Research Moonshot Kimi K3: modelo open-weight chino lidera benchmark Arena, supera Claude en código Funding Anthropic en conversaciones preliminares con Meta para acuerdo de cómputo de $10B; tercera asociación principal de infraestructura Funding Anthropic Presenta Solicitud de IPO; ARR de Claude Alcanzó US$ 47B en Mayo, Supera Valoración OpenAI en US$ 965B Series H Policy 21 Economías APEC Apoyan IA de Código Abierto con 'Garantía de Seguridad Fuerte' en Cumbre de Chengdu Breaking Proyecto Camellia de OpenAI: Centro de datos Georgia 3.2GW, beneficios comunitarios $80M, créditos Codex $71M para estudiantes hasta 2032 Breaking La plataforma ELSA AI de la FDA alcanza 85% de adopción del personal en dos meses; datos gobernados y agentes reducen revisión de fármacos de días a 3 minutos Research Investigación NVIDIA en ICML 2026: 145 artículos citan modelos abiertos Nemotron; 2.000 artículos usan GPUs NVIDIA
Research

Black Forest Labs FLUX 3: modelo multimodal unificado genera vídeo, audio y acciones de robot desde arquitectura única

Black Forest Labs reveló FLUX 3 el 23 de julio, un modelo de frontera multimodal entrenado conjuntamente en imágenes, vídeo, audio y predicción de acciones dentro de una única arquitectura unificada construida en el enfoque Self-Flow de la empresa. FLUX 3 Video genera clips de hasta 20 segundos con audio nativo y sincronizado a partir de indicaciones de texto, imágenes o referencias de vídeo; soporta continuación de vídeo, transiciones de fotogramas clave, diálogos multilingües y encadenamiento de múltiples clips. En evaluaciones internas iniciales, BFL afirma que FLUX 3 Video supera Runway Gen-4.5 en 77% de comparaciones frente a frente y Luma Ray 3.2 en 93%, aunque son puntos de referencia preliminares y auto-reportados con metodología completa a seguir en disponibilidad más amplia.

La idea clave de la arquitectura es que la generación de vídeo y la predicción de acciones no requieren fundamentos separados—las mismas representaciones aprendidas de estructura espacial, dinámica temporal y causalidad sirven a ambas. Junto a FLUX 3 Video, BFL y el socio de robótica mimic anunciaron FLUX-mimic, un modelo video-acción en implementación temprana con Audi. FLUX-mimic puede ajustar nuevas tareas de manipulación robótica a partir de tan solo 30 minutos de datos de robot, en comparación con horas con enfoques anteriores. BFL está preparando el despliegue: FLUX 3 Image (sucesor de imagen estática de FLUX.2) se envía en las próximas semanas, FLUX 3 Action para socios comerciales en paralelo, y FLUX 3 Dev de pesos abiertos planeado para más tarde en 2026.

Para profesionales, esto unifica una apuesta arquitectónica de larga data: que la generación de contenido e IA física comparten representación subyacente suficiente para que un modelo pueda servir a ambas. La historia de entrenamiento multimodal—aprender que las imágenes enseñan estructura, el vídeo enseña movimiento, el audio enseña causalidad, cada uno restringiendo los otros—hace eco del trabajo reciente en modelos del mundo. Sin embargo, los riesgos de ejecución permanecen: los números de vídeo de BFL son preliminares, FLUX 3 Image aún no está disponible para evaluación, y los pesos abiertos son una promesa posterior de 2026. Si BFL entrega pesos abiertos según el cronograma, FLUX 3 Dev será el primer modelo multimodal abierto que abarca vídeo, imagen, audio y acción en una arquitectura, reformulando la pila para constructores que eligen entre herramientas especializadas y plataformas unificadas.

Fuentes