AO VIVO · SEX., 24 DE JUL. DE 2026 --:--:-- ET
Edição Nº 94 GASTO TOTAL $14918.63 ARTIGOS HOJE 2 TOKENS TOTAL 9.62B
aiexpert
Na linha
Breaking Anthropic atualiza Claude Voice para modelos Opus/Sonnet; arquitetura turn-based compete com GPT-Live full-duplex de OpenAI em acesso a ferramentas, não naturalidade de fala Research LangChain publica framework de benchmark Deep Agents; três suite eval (Harbor-Index, τ³-bench, ContextBench) estabelecem padrão de autonomia de agente longo-horizonte Research Black Forest Labs FLUX 3: modelo multimodal unificado gera vídeo, áudio e ações robô de arquitetura única Breaking NVIDIA, KAIST lançam primeiro lab de IA conjunta na Coréia; co-desenvolvimento de memória SK expandido Policy Genesis Mission dos EUA implanta $5B+ para 278 projetos de IA-para-ciência em 50 estados Funding NVIDIA se compromete com US$ 300M (US$ 50M/ano) com lab de IA agentífca KAIST; primeiro lab conjunto com universidade coreana Breaking Plataforma STAR da Expedia usa LLMs para análise de causa raíz de incidentes; fluxos de trabalho determinísticos reduzem tempo médio de recuperação Breaking Sistema Siemens Fuse EDA AI automatiza fluxos de trabalho de design de chips; transforma tarefas de horas em segundos Policy Reino Unido desmantel a DSIT, eleva ministro de IA para gabinete; breve de IA se move mais perto do primeiro-ministro Funding AMD garante acordo de 2GW com Anthropic, investe $5B no criador do Claude para rivalizar com Nvidia em chips de IA Research Nvidia lança modelo genomics DNA; aprende o que predição token perde em dados biológicos Breaking Black Forest Labs lança FLUX 3, modelo multimodal unificado para imagem, vídeo, áudio e ação de robô Breaking Microsoft Project Perception: roteamento de segurança multi-modelo reduz custo do Anthropic Mythos em 50% Research Moonshot Kimi K3: modelo open-weight chinês lidera benchmark Arena, ultrapassa Claude em código Funding Anthropic em conversas preliminares com Meta para acordo de compute de $10B; terceira parceria maior de infraestrutura Funding Anthropic Protocola para IPO; ARR de Claude Atingiu US$ 47B em Maio, Ultrapassa Avaliação OpenAI em US$ 965B Series H Policy 21 Economias APEC Apoiam IA de Código Aberto com 'Garantia de Segurança Forte' na Cúpula de Chengdu Breaking Projeto Camellia OpenAI: Datacenter Georgia 3.2GW, $80M de benefrísios comunitários, créditos Codex de $71M para estudantes até 2032 Breaking Plataforma ELSA AI da FDA atinge 85% de adoção de pessoal em dois meses; dados regidos e agentes reduzem revisão de fármacos de dias para 3 minutos Research Pesquisa NVIDIA em ICML 2026: 145 artigos citam modelos abertos Nemotron; 2.000 artigos usam GPUs NVIDIA Breaking Anthropic atualiza Claude Voice para modelos Opus/Sonnet; arquitetura turn-based compete com GPT-Live full-duplex de OpenAI em acesso a ferramentas, não naturalidade de fala Research LangChain publica framework de benchmark Deep Agents; três suite eval (Harbor-Index, τ³-bench, ContextBench) estabelecem padrão de autonomia de agente longo-horizonte Research Black Forest Labs FLUX 3: modelo multimodal unificado gera vídeo, áudio e ações robô de arquitetura única Breaking NVIDIA, KAIST lançam primeiro lab de IA conjunta na Coréia; co-desenvolvimento de memória SK expandido Policy Genesis Mission dos EUA implanta $5B+ para 278 projetos de IA-para-ciência em 50 estados Funding NVIDIA se compromete com US$ 300M (US$ 50M/ano) com lab de IA agentífca KAIST; primeiro lab conjunto com universidade coreana Breaking Plataforma STAR da Expedia usa LLMs para análise de causa raíz de incidentes; fluxos de trabalho determinísticos reduzem tempo médio de recuperação Breaking Sistema Siemens Fuse EDA AI automatiza fluxos de trabalho de design de chips; transforma tarefas de horas em segundos Policy Reino Unido desmantel a DSIT, eleva ministro de IA para gabinete; breve de IA se move mais perto do primeiro-ministro Funding AMD garante acordo de 2GW com Anthropic, investe $5B no criador do Claude para rivalizar com Nvidia em chips de IA Research Nvidia lança modelo genomics DNA; aprende o que predição token perde em dados biológicos Breaking Black Forest Labs lança FLUX 3, modelo multimodal unificado para imagem, vídeo, áudio e ação de robô Breaking Microsoft Project Perception: roteamento de segurança multi-modelo reduz custo do Anthropic Mythos em 50% Research Moonshot Kimi K3: modelo open-weight chinês lidera benchmark Arena, ultrapassa Claude em código Funding Anthropic em conversas preliminares com Meta para acordo de compute de $10B; terceira parceria maior de infraestrutura Funding Anthropic Protocola para IPO; ARR de Claude Atingiu US$ 47B em Maio, Ultrapassa Avaliação OpenAI em US$ 965B Series H Policy 21 Economias APEC Apoiam IA de Código Aberto com 'Garantia de Segurança Forte' na Cúpula de Chengdu Breaking Projeto Camellia OpenAI: Datacenter Georgia 3.2GW, $80M de benefrísios comunitários, créditos Codex de $71M para estudantes até 2032 Breaking Plataforma ELSA AI da FDA atinge 85% de adoção de pessoal em dois meses; dados regidos e agentes reduzem revisão de fármacos de dias para 3 minutos Research Pesquisa NVIDIA em ICML 2026: 145 artigos citam modelos abertos Nemotron; 2.000 artigos usam GPUs NVIDIA
Research

Black Forest Labs FLUX 3: modelo multimodal unificado gera vídeo, áudio e ações robô de arquitetura única

Black Forest Labs revelou FLUX 3 em 23 de julho, um modelo de fronteira multimodal treinado conjuntamente em imagens, vídeo, áudio e predição de ação dentro de uma arquitetura unificada única construída na abordagem Self-Flow da empresa. FLUX 3 Video gera clips de até 20 segundos com áudio nativo e sincronizado a partir de prompts de texto, imagens ou referências de vídeo; suporta continuação de vídeo, transições keyframe, diálogo multilíngue e encadeamento de múltiplos clips. Em avaliações internas iniciais, BFL alega que FLUX 3 Video supera Runway Gen-4.5 em 77% de comparações frente a frente e Luma Ray 3.2 em 93%, embora sejam benchmarks preliminares e auto-relatórios com metodologia completa para seguir em disponibilidade mais ampla.

O insight chave da arquitetura é que geração de vídeo e predição de ação não requerem fundamentos separados—as mesmas representações aprendidas de estrutura espacial, dinâmica temporal e causalidade servem ambas. Ao lado de FLUX 3 Video, BFL e parceiro de robótica mimic anunciaram FLUX-mimic, um modelo video-ação em implantação inicial com Audi. FLUX-mimic pode afinar tarefas de manipulação robótica novas a partir de tão pouco quanto 30 minutos de dados de robô, comparado a horas com abordagens anteriores. BFL está preparando o rollout: FLUX 3 Image (sucessor de imagem estática para FLUX.2) envia em semanas que vem, FLUX 3 Action para parceiros comerciais em paralelo, e FLUX 3 Dev de peso aberto planejado para mais tarde em 2026.

Para profissionais, isto unifica uma aposta arquitetural de longo prazo: que geração de conteúdo e IA física compartilham representação subjacente suficiente que um modelo pode servir ambas. A história de treinamento multimodal—aprender imagens ensinam estrutura, vídeo ensina movimento, áudio ensina causalidade, cada uma restringindo as outras—ecoa trabalho recente em modelos do mundo. Entretanto, riscos de execução permanecem: números de vídeo de BFL são preliminares, FLUX 3 Image ainda não está disponível para avaliação, e pesos abertos são promessa posterior de 2026. Se BFL entregar pesos abertos no cronograma, FLUX 3 Dev será o primeiro modelo multimodal aberto abrangendo vídeo, imagem, áudio e ação em uma arquitetura, reformulando a pilha para construtores escolhendo entre ferramentas especialistas e plataformas unificadas.

Fontes