AO VIVO · SEX., 24 DE JUL. DE 2026 --:--:-- ET
Edição Nº 94 GASTO TOTAL $14932.67 ARTIGOS HOJE 6 TOKENS TOTAL 9.63B
aiexpert
Na linha
Market Tesla Q2 fluxo de caixa livre torna-se negativo $1,1B conforme capex explode 142% financiando Robotaxi, Optimus, fábrica de chips Market BlackRock comercializa $12,3B em títulos para data center El Paso da Meta conforme débito de IA alimenta expansão de infraestrutura Market Waymo lança app independente em Atlanta e Austin conforme exclusividade com Uber termina em janeiro 2028 Funding Etched levanta $300M em valorização de $10,3B; visa inferência de IA em escala de fronteira com menor potência, maior densidade Funding Atoms levanta $1,7B da a16z para IA física em mineração, alimentos e transporte Funding Augustus fecha $180M Série B a $1B valuação; carta OCC habilita banco de compensação nativo de IA Policy OpenAI, Anthropic ausentes da coalição de pesos abertos enquanto Huang estreia no X Funding Meshy AI fecha $400M Série B a $1.5B avaliação; ARR acima de 12x YoY com 12M usuários Research Kimi K3 atinge 68.5% em DeepSWE, custa 2.8x menos por tarefa que Claude Fable 5 Market Alphabet aumenta capex para $205B; mercado de títulos sinaliza limites de gastos com IA Funding Moonshot AI mira avaliação de $50B em rodada pré-IPO, olha para listagem Hong Kong até final de 2026 Market Backlog do Google Cloud atinge $514B, acima de $54B em um trimestre; receita operacional triplicada para $8,8B Market Alphabet aumenta orientação de capex para $190–205B em 2026; registra primeiro FCF trimestral negativo da história Funding Atoms levanta $1,7B em Series da Andreessen Horowitz para robótica de IA física Chips Intel se compromete com produção em massa 14A em 2028, registra crescimento de receita de 25% com demanda forte em data centers Policy NVIDIA + 24 empresas assinam carta de pesos abertos se opondo a restrições de modelos de IA enquanto Jensen Huang se junta a X Funding SoftBank considera aquisição da Gravis Robotics em avaliação de $500M, aprofundando foco em autonomia de construção Policy Trump lança investigação 301 contra multas de IA da UE, ameaça tarifas 'substanciais' no bloco Market Moody's avisa que boom de capex em IA está corroendo qualidade de crédito em hyperscalers, projeta gastos de $1T até 2027 Breaking Anthropic atualiza Claude Voice para modelos Opus/Sonnet; arquitetura turn-based compete com GPT-Live full-duplex de OpenAI em acesso a ferramentas, não naturalidade de fala Market Tesla Q2 fluxo de caixa livre torna-se negativo $1,1B conforme capex explode 142% financiando Robotaxi, Optimus, fábrica de chips Market BlackRock comercializa $12,3B em títulos para data center El Paso da Meta conforme débito de IA alimenta expansão de infraestrutura Market Waymo lança app independente em Atlanta e Austin conforme exclusividade com Uber termina em janeiro 2028 Funding Etched levanta $300M em valorização de $10,3B; visa inferência de IA em escala de fronteira com menor potência, maior densidade Funding Atoms levanta $1,7B da a16z para IA física em mineração, alimentos e transporte Funding Augustus fecha $180M Série B a $1B valuação; carta OCC habilita banco de compensação nativo de IA Policy OpenAI, Anthropic ausentes da coalição de pesos abertos enquanto Huang estreia no X Funding Meshy AI fecha $400M Série B a $1.5B avaliação; ARR acima de 12x YoY com 12M usuários Research Kimi K3 atinge 68.5% em DeepSWE, custa 2.8x menos por tarefa que Claude Fable 5 Market Alphabet aumenta capex para $205B; mercado de títulos sinaliza limites de gastos com IA Funding Moonshot AI mira avaliação de $50B em rodada pré-IPO, olha para listagem Hong Kong até final de 2026 Market Backlog do Google Cloud atinge $514B, acima de $54B em um trimestre; receita operacional triplicada para $8,8B Market Alphabet aumenta orientação de capex para $190–205B em 2026; registra primeiro FCF trimestral negativo da história Funding Atoms levanta $1,7B em Series da Andreessen Horowitz para robótica de IA física Chips Intel se compromete com produção em massa 14A em 2028, registra crescimento de receita de 25% com demanda forte em data centers Policy NVIDIA + 24 empresas assinam carta de pesos abertos se opondo a restrições de modelos de IA enquanto Jensen Huang se junta a X Funding SoftBank considera aquisição da Gravis Robotics em avaliação de $500M, aprofundando foco em autonomia de construção Policy Trump lança investigação 301 contra multas de IA da UE, ameaça tarifas 'substanciais' no bloco Market Moody's avisa que boom de capex em IA está corroendo qualidade de crédito em hyperscalers, projeta gastos de $1T até 2027 Breaking Anthropic atualiza Claude Voice para modelos Opus/Sonnet; arquitetura turn-based compete com GPT-Live full-duplex de OpenAI em acesso a ferramentas, não naturalidade de fala
Research

Kimi K3 atinge 68.5% em DeepSWE, custa 2.8x menos por tarefa que Claude Fable 5

Together AI lançou uma análise de benchmark DeepSWE em 24 de julho mostrando o Kimi K3 de peso aberto da Moonshot AI igualando o Claude Fable 5 de Anthropic em tarefas de codificação de engenharia de software a um desconto de custo nítido. Em pass@1, Kimi K3 pontuou 68.5% versus 69.9% de Fable — uma lacuna de 1.4 pontos. Mas quando benchmarks permitem múltiplas tentativas (pass@2 e pass@4), Kimi avança: 82.0% vs 80.2% em pass@2 e 89.4% vs 88.5% em pass@4.

O custo é a manchete: Kimi K3 custa $4.65 por rollout de tarefa versus $13.41 para Claude Fable 5 no ajuste xhigh. Medido por tarefa resolvida, Kimi entregou 14.7 soluções por $100 contra 5.3 de Fable — 2.8x a saída por dólar. A lacuna de desempenho reflete uma diferença estratégica: Fable é mais confiável em tentativas únicas (pass@1 mais alto, mais soluções quatro-para-quatro); Kimi lança uma rede mais ampla sobre tentativas e alcança melhor cobertura pass@2/4. Ambos os modelos falham em tipos de tarefa quase idênticos (correlação 0.72).

Kimi K3 é de peso aberto, implantado através da plataforma de inferência Together AI, enquanto Fable 5 é fechado e disponível apenas através de Anthropic. Isso torna Kimi adequado para equipes construindo fluxos de trabalho agênticos onde múltiplas tentativas e auto-hospedagem são aceitáveis — agentes de voz, loops de geração de código, tarefas de busca-e-iteração. Fable permanece preferido para caminhos de produção de tiro único exigindo determinismo.

Para arquitetos escolhendo entre LLMs de peso aberto e fechado para tarefas de raciocínio e codificação, isso sinaliza um marco: modelos de peso aberto agora alcançam capacidade de raciocínio de nível de ponta em proporções de custo/token de produção mais próximas de modelos pequenos. DeepSWE é um benchmark estreito, mas mede engenharia de software real. A vantagem de custo ($4.65 vs $13.41) pode impulsionar adoção entre equipes construindo agentes CI/CD e sistemas de programação autônoma, especialmente onde tentativa de tarefa é tolerável.

Fontes