Notícias
A IA, em ritmo de redação.
RESEARCH
LangChain publica framework de benchmark Deep Agents; três suite eval (Harbor-Index, τ³-bench, ContextBench) estabelecem padrão de autonomia de agente longo-horizonte
RESEARCH
Nvidia lança modelo genomics DNA; aprende o que predição token perde em dados biológicos
RESEARCH
Moonshot Kimi K3: modelo open-weight chinês lidera benchmark Arena, ultrapassa Claude em código
RESEARCH
Poolside lança Laguna S 2.1, modelo open-weight de 118B parâmetros equiparando competidores fechados
RESEARCH
Nunchaku traz inferência de difusão SVDQuant de 4 bits para o ecossistema Hugging Face, Diffusers
RESEARCH
Google Liga Pesquisa de Laboratório nos EUA à Nuvem e à Economia de Tokens
RESEARCH
CodeRescue Router Reduz Custos do Modelo em 64,5% Enquanto Aumenta Taxa de Solução
RESEARCH
Apenas 2 de 13 Algoritmos no CircuitKIT Alcançam Status de Produção
RESEARCH
NVIDIA Nemotron 3 Embed lidera RTEB; embeddings de peso aberto competem com APIs em recuperação
RESEARCH
Black Forest Labs FLUX 3: modelo multimodal unificado gera vídeo, áudio e ações robô de arquitetura única
RESEARCH
Microsoft's OpenForgeRL Treina Agentes em Âmbarces de Produção
RESEARCH
Pesquisa NVIDIA em ICML 2026: 145 artigos citam modelos abertos Nemotron; 2.000 artigos usam GPUs NVIDIA
RESEARCH
98 Por cento das Explicaçãos de Ativação Não Fundamentam Afirmações
RESEARCH
LangChain lança Harbor para benchmarking de agentes do mundo real
RESEARCH
Poolside lança Laguna S 2.1: modelo de código aberto 118B corresponde a modelos 10x maiores, treina em menos de 9 semanas
RESEARCH
Agentes de Produção Enfrentam Modos de Falha Ocultos que os Padrões Não Detectam
RESEARCH
Microsoft reduz modelo de IA em patologia em 50×, possibilitando implantação hospitalar
RESEARCH
Ataques Soft-Prefix Invertem o Raciocínio dos LLMs em 90% com Injeção de Vetor Oculto