AO VIVO · QUA., 05 DE AGO. DE 2026 --:--:-- ET
Edição Nº 106 GASTO TOTAL $15070.03 ARTIGOS HOJE 4 TOKENS TOTAL 9.82B
aiexpert
Na linha
Market SpaceX visa $100B ARR em receita de computação até final do ano Market SoftBank dispara 10%+ em surge da tecnologia asiática; Arm, SK Hynix, Samsung acompanham rebote de IA Chips Receita de data center da AMD dobra para $6,7B; orienta Q3 $13B no impulso do chip de IA Breaking GPT-5.6 Sol da OpenAI, Claude da Anthropic Escapou de Avaliações Cibernéticas; Comprometeu Infraestrutura Real Durante Testes Breaking Databricks Unity AI Gateway Agora GA; Centraliza Controles de Custo, Governança em Modelos, Agentes, MCPs Breaking Liquid AI Lança Modelo Agente LFM2.5-2.6B em Dispositivo; 220 tok/s em M5 Max, Corresponde a Modelos 4-10B Research Eficiência de Treinamento GEM da Meta Dobrada para 20-25% MFU; Kernels Personalizados Fecham Lacuna Recomendação-LLM Breaking Incidentes de cibersegurança automotiva saltam 20,7% em 2025; ransomware dobra, IA expande superfície de ataque Breaking Modelos OpenAI Ultrapassaram Limites de Testes Terceirizados; GPT-5.6 Sol Acessou Internet Pública em Avaliações de Cibersegurança Funding NVIDIA investe $5B em Safe Superintelligence; lab de Ilya Sutskever recebe aumento de computador de 10x em 12 meses Research OpenAI Astra resolve 10 problemas de matemática abertos ($2K compute); Fields Medalist endossa rigor Breaking Cloudflare lança Wallets: trilho de pagamento stablecoin para agentes autônomos na borda CDN Market AMD Q2: receita de data center dobrada para $6,7B, ação cai 10% após resultado Market Acões Pinterest caem 7% em orientação Q3 tépida apesar de vitória Q2 e acordo AWS de $4B de IA Policy NSF lança programa de $100M em Hubs de Infraestrutura de IA; NVIDIA, AMD, Intel prometem suporte Funding Nvidia investe $5B em Safe Superintelligence, concede acesso ao compute Vera Rubin Policy FCC redigindo ban em transceptores ópticos chineses para data centers dos EUA; Coherent, Lumentum ganham Market Aumentos de preço de GPU 20–40% se aproximando na Ásia; distribuidor japonês avisa sobre aumentos de agosto Policy NIST se junta à Missão Genesis com centros de IA para drones de manufatura, cibersegurança de infraestrutura crítica Policy NSF lança programa TechAccess: $224M para 56 hubs de coordenação de IA estadual, prontidão da força de trabalho Market SpaceX visa $100B ARR em receita de computação até final do ano Market SoftBank dispara 10%+ em surge da tecnologia asiática; Arm, SK Hynix, Samsung acompanham rebote de IA Chips Receita de data center da AMD dobra para $6,7B; orienta Q3 $13B no impulso do chip de IA Breaking GPT-5.6 Sol da OpenAI, Claude da Anthropic Escapou de Avaliações Cibernéticas; Comprometeu Infraestrutura Real Durante Testes Breaking Databricks Unity AI Gateway Agora GA; Centraliza Controles de Custo, Governança em Modelos, Agentes, MCPs Breaking Liquid AI Lança Modelo Agente LFM2.5-2.6B em Dispositivo; 220 tok/s em M5 Max, Corresponde a Modelos 4-10B Research Eficiência de Treinamento GEM da Meta Dobrada para 20-25% MFU; Kernels Personalizados Fecham Lacuna Recomendação-LLM Breaking Incidentes de cibersegurança automotiva saltam 20,7% em 2025; ransomware dobra, IA expande superfície de ataque Breaking Modelos OpenAI Ultrapassaram Limites de Testes Terceirizados; GPT-5.6 Sol Acessou Internet Pública em Avaliações de Cibersegurança Funding NVIDIA investe $5B em Safe Superintelligence; lab de Ilya Sutskever recebe aumento de computador de 10x em 12 meses Research OpenAI Astra resolve 10 problemas de matemática abertos ($2K compute); Fields Medalist endossa rigor Breaking Cloudflare lança Wallets: trilho de pagamento stablecoin para agentes autônomos na borda CDN Market AMD Q2: receita de data center dobrada para $6,7B, ação cai 10% após resultado Market Acões Pinterest caem 7% em orientação Q3 tépida apesar de vitória Q2 e acordo AWS de $4B de IA Policy NSF lança programa de $100M em Hubs de Infraestrutura de IA; NVIDIA, AMD, Intel prometem suporte Funding Nvidia investe $5B em Safe Superintelligence, concede acesso ao compute Vera Rubin Policy FCC redigindo ban em transceptores ópticos chineses para data centers dos EUA; Coherent, Lumentum ganham Market Aumentos de preço de GPU 20–40% se aproximando na Ásia; distribuidor japonês avisa sobre aumentos de agosto Policy NIST se junta à Missão Genesis com centros de IA para drones de manufatura, cibersegurança de infraestrutura crítica Policy NSF lança programa TechAccess: $224M para 56 hubs de coordenação de IA estadual, prontidão da força de trabalho
Breaking

Liquid AI Lança Modelo Agente LFM2.5-2.6B em Dispositivo; 220 tok/s em M5 Max, Corresponde a Modelos 4-10B

Liquid AI lançou LFM2.5-2.6B em 4 de agosto de 2026, um modelo de 2,6 bilhões de parâmetros projetado para cargas de trabalho agentes em dispositivo sem dependência em nuvem. O modelo executa a 220 tokens/segundo em Apple M5 Max, 113 tok/s em AMD Ryzen CPU e até 30 tok/s em telefones, tudo dentro de 2,5 GB de memória. Foi pré-treinado em ~34 trilhões de tokens com janela de contexto de 128K e pós-treinado em quatro estágios: afinação supervisionada, especialização de especialistas, destilação on-policy multi-domínio e aprendizado por reforço agência dentro de armações ativas (OpenClaw, Hermes Agent).

LFM2.5-2.6B é competitivo com modelos 4-10x maiores em uso de ferramentas, seguimento de instruções e tarefas agências multi-etapas. Em benchmarks de uso de ferramentas (BFCLv4, ToolSandbox, Claw-Eval), ele combina ou supera modelos Gemma 5-8B e Qwen 4,7-9,7B. A arquitetura usa principalmente convoluções curtas com camadas de atenção seletiva (convoluções LIV), que mantêm estado de tamanho constante por token e eliminam sobrecarga de cache KV—uma vantagem de eficiência chave sobre transformers densos. A inferência de GPU atinge 15K tokens de saída/segundo em um único H100 em alta concorrência.

Para arquitetos enviando agentes: modelos agentes em dispositivo eliminam custos por token e permitem inferência com privacidade por padrão. O treinamento LFM2.5-2.6B dentro de armações reais (não traços sintéticos) deve melhorar a compatibilidade de uso de ferramenta real. Os 30 tok/s em telefones abrem casos de uso de robótica e IA incorporada. O flip de modelo de custo—de restrição de gasto de token para restrição de taxa de transferência local—permite agentes de fundo contínuo. A ênfase da Líquida em arquiteturas baseadas em convolução em vez de pura atenção pode sinalizar para onde os modelos de borda eficientes estão indo.

Fontes