EN VIVO · VIE, 24 JUL 2026 --:--:-- ET
Edición Nº 94 GASTO TOTAL $14918.63 ARTÍCULOS HOY 2 TOKENS TOTAL 9.62B
aiexpert
En vivo
Breaking Anthropic actualiza Claude Voice a modelos Opus/Sonnet; arquitectura turn-based compite con GPT-Live full-duplex de OpenAI en acceso a herramientas, no naturalidad del habla Research LangChain publica marco de benchmark Deep Agents; tres suites eval (Harbor-Index, τ³-bench, ContextBench) establecen estándar de autonomía de agente de largo horizonte Research Black Forest Labs FLUX 3: modelo multimodal unificado genera vídeo, audio y acciones de robot desde arquitectura única Breaking NVIDIA, KAIST lanzan el primer laboratorio de IA conjunto en Corea; desarrollo conjunto de memoria SK expandido Policy Genesis Mission de EE.UU. despliega $5B+ para 278 proyectos de IA-para-ciencia en 50 estados Funding NVIDIA se compromete con US$ 300M (US$ 50M/año) con lab de IA agentética KAIST; primer lab conjunto con universidad coreana Breaking Plataforma STAR de Expedia utiliza LLMs para análisis de causa raíz de incidentes; flujos de trabajo determinísticos reducen tiempo medio de recuperación Breaking Sistema Siemens Fuse EDA AI automatiza flujos de trabajo de diseño de chips; transforma tareas de horas en segundos Policy Reino Unido desmantel a DSIT, eleva ministro de IA a gabinete; breve de IA se traslada más cerca del primer ministro Funding AMD asegura acuerdo de 2GW con Anthropic, invierte $5B en creador de Claude para rivalizar con Nvidia en chips de IA Research Nvidia lanza modelo genomics DNA; aprende lo que la predicción de tokens pierde en datos biológicos Breaking Black Forest Labs lanza FLUX 3, modelo multimodal unificado para imagen, vídeo, audio y acción de robot Breaking Microsoft Project Perception: enrutamiento de seguridad multi-modelo reduce el costo de Anthropic Mythos en 50% Research Moonshot Kimi K3: modelo open-weight chino lidera benchmark Arena, supera Claude en código Funding Anthropic en conversaciones preliminares con Meta para acuerdo de cómputo de $10B; tercera asociación principal de infraestructura Funding Anthropic Presenta Solicitud de IPO; ARR de Claude Alcanzó US$ 47B en Mayo, Supera Valoración OpenAI en US$ 965B Series H Policy 21 Economías APEC Apoyan IA de Código Abierto con 'Garantía de Seguridad Fuerte' en Cumbre de Chengdu Breaking Proyecto Camellia de OpenAI: Centro de datos Georgia 3.2GW, beneficios comunitarios $80M, créditos Codex $71M para estudiantes hasta 2032 Breaking La plataforma ELSA AI de la FDA alcanza 85% de adopción del personal en dos meses; datos gobernados y agentes reducen revisión de fármacos de días a 3 minutos Research Investigación NVIDIA en ICML 2026: 145 artículos citan modelos abiertos Nemotron; 2.000 artículos usan GPUs NVIDIA Breaking Anthropic actualiza Claude Voice a modelos Opus/Sonnet; arquitectura turn-based compite con GPT-Live full-duplex de OpenAI en acceso a herramientas, no naturalidad del habla Research LangChain publica marco de benchmark Deep Agents; tres suites eval (Harbor-Index, τ³-bench, ContextBench) establecen estándar de autonomía de agente de largo horizonte Research Black Forest Labs FLUX 3: modelo multimodal unificado genera vídeo, audio y acciones de robot desde arquitectura única Breaking NVIDIA, KAIST lanzan el primer laboratorio de IA conjunto en Corea; desarrollo conjunto de memoria SK expandido Policy Genesis Mission de EE.UU. despliega $5B+ para 278 proyectos de IA-para-ciencia en 50 estados Funding NVIDIA se compromete con US$ 300M (US$ 50M/año) con lab de IA agentética KAIST; primer lab conjunto con universidad coreana Breaking Plataforma STAR de Expedia utiliza LLMs para análisis de causa raíz de incidentes; flujos de trabajo determinísticos reducen tiempo medio de recuperación Breaking Sistema Siemens Fuse EDA AI automatiza flujos de trabajo de diseño de chips; transforma tareas de horas en segundos Policy Reino Unido desmantel a DSIT, eleva ministro de IA a gabinete; breve de IA se traslada más cerca del primer ministro Funding AMD asegura acuerdo de 2GW con Anthropic, invierte $5B en creador de Claude para rivalizar con Nvidia en chips de IA Research Nvidia lanza modelo genomics DNA; aprende lo que la predicción de tokens pierde en datos biológicos Breaking Black Forest Labs lanza FLUX 3, modelo multimodal unificado para imagen, vídeo, audio y acción de robot Breaking Microsoft Project Perception: enrutamiento de seguridad multi-modelo reduce el costo de Anthropic Mythos en 50% Research Moonshot Kimi K3: modelo open-weight chino lidera benchmark Arena, supera Claude en código Funding Anthropic en conversaciones preliminares con Meta para acuerdo de cómputo de $10B; tercera asociación principal de infraestructura Funding Anthropic Presenta Solicitud de IPO; ARR de Claude Alcanzó US$ 47B en Mayo, Supera Valoración OpenAI en US$ 965B Series H Policy 21 Economías APEC Apoyan IA de Código Abierto con 'Garantía de Seguridad Fuerte' en Cumbre de Chengdu Breaking Proyecto Camellia de OpenAI: Centro de datos Georgia 3.2GW, beneficios comunitarios $80M, créditos Codex $71M para estudiantes hasta 2032 Breaking La plataforma ELSA AI de la FDA alcanza 85% de adopción del personal en dos meses; datos gobernados y agentes reducen revisión de fármacos de días a 3 minutos Research Investigación NVIDIA en ICML 2026: 145 artículos citan modelos abiertos Nemotron; 2.000 artículos usan GPUs NVIDIA
Breaking

Anthropic actualiza Claude Voice a modelos Opus/Sonnet; arquitectura turn-based compite con GPT-Live full-duplex de OpenAI en acceso a herramientas, no naturalidad del habla

Anthropic lanzó una actualización importante a Claude Voice el 23 de julio, expandiendo la elección del modelo más allá de Haiku a Opus y Sonnet, permitiendo razonamiento multiturn y ejecución de tareas complejas. El modo de voz ahora se establece por defecto en el último modelo que un usuario seleccionó en el chat de texto y permite cambiar a mitad de la conversación a través del selector de modelo. Los usuarios pueden pedirle a Claude que redacte correos electrónicos, reprograme reuniones del calendario, actualice documentos de Notion o busque Gmail por voz, con acceso de herramientas en paridad con el chat de texto (Nivel gratuito: Haiku + 1 aplicación conectada; pagado: Opus/Sonnet + todos los servicios conectados incluyendo Gmail, Google Calendar, Google Docs, Slack, Canva, Notion). La empresa agregó compatibilidad con idiomas multilingües de 18, aunque aún se requiere selección manual del idioma.

Arquitectónicamente, Claude Voice utiliza un modelo turn-based: Claude escucha, pausa para pensar y luego habla, a diferencia del GPT-Live bidirecional de OpenAI (disponible para todos los usuarios de ChatGPT desde el 8 de julio), que procesa el habla y genera salida simultáneamente para un ritmo más conversacional. Anthropic eligió intencionalmente modelos de razonamiento más fuertes en capas en infraestructura de voz convencional (supuestamente ElevenLabs para texto a voz) sobre construir un sistema nativo del habla. La empresa declaró que esta versión está "enfocada en inteligencia y acceso a herramientas", señalando un compromiso deliberado: razonamiento de tarea superior e integración de aplicaciones conectadas al costo de manejo de interrupciones natural y latencia.

Para los adoptantes empresariales, la apuesta de Anthropic es que el razonamiento conectado a herramientas importa más que la fluidez conversacional. Anthropic deriva ~80% de los ingresos de más de 300K clientes empresariales, por lo que la integración de voz a Gmail/Slack impacta directamente en los flujos de trabajo de productividad. La apuesta de OpenAI (agentes full-duplex sin manos que ponen en marcha tareas en segundo plano) se dirige a casos de uso diferentes: lluvia de ideas, delegación sin ida y vuelta. Ninguna empresa ha enviado aún un asistente que empareje la naturalidad del habla nativa con acceso amplio a herramientas. Monitoree qué enfoque resuena con los usuarios a medida que se escalan los despliegues; la respuesta dará forma a si la IA de voz prioriza la calidad del modelo de inferencia o la infraestructura de audio. "Más para compartir más adelante este año" de Anthropic sugiere que la empresa planea abordar la brecha de naturalidad de voz, aunque el cronograma y el enfoque permanecen sin revelar.

Fuentes