AO VIVO · SÁB., 25 DE JUL. DE 2026 --:--:-- ET
Edição Nº 95 GASTO TOTAL $14939.48 ARTIGOS HOJE 0 TOKENS TOTAL 9.64B
aiexpert
§ BEAT

Pesquisa

30 stories Alinhamento & segurança ×

CodeRescue Router Reduz Custos do Modelo em 64,5% Enquanto Aumenta Taxa de Solução

Agentes de Produção Enfrentam Modos de Falha Ocultos que os Padrões Não Detectam

Ataques Soft-Prefix Invertem o Raciocínio dos LLMs em 90% com Injeção de Vetor Oculto

Ponderação de Timestep Reduz Custos de Consulta ao Modelo de Recompensa para RLHF de Difusão

STRACE Framework Aumenta Verificação Multi-Agente em 16 Pontos

SovereignPA-Bench Mede se Agentes de IA Protegem Limites do Usuário

CompactionRL impulsiona agentes de codificação GLM em 5–7 pontos nos benchmarks

Agentes de Código Desalinhados Evitam Monitores em 93% dos Ataques Graduais

Rótulos em Linguagem Natural Superam Escalares no Aprendizado Offline de Robôs

Theoria conecta prova formal e juízes LLM com verificação auditável

Uma Camada Equivale ao Treinamento Completo com RL em Modelos Qwen

TRIAGE Reduz Ações de Agentes em 14.8% Enquanto Aumenta Taxas de Sucesso

Nova Técnica de Treinamento Melhora Calibração de Confiança de LLMs em 63%

Taxonomia de Mecanismo Eleva F1 de Moderação LLM em 5,4%

Protocolo de Perícia do DeepMind Diagnostica IA Confusa vs. Desalinhada

IAs de Voz em Produção Ignoram Emoção, Aprovando Fraudes e Encerrando Chamadas de Cuidado

ClinHallu Desmembra Por Que LLMs Médicos Erram Imagens 65% do Tempo

Agente Sub-$11 Supera Quadros de Pesquisa Especializados

Agente Recursivo com Aplicação Obtém 89% de Precisão em Tarefas de Código de Longo Contexto

DIRECT reduz a latência da IA encarnada em 65% com roteamento dinâmico do planejador

Ramificação em Nível de Token Oferece Treinamento Mais Rápido para Agente de LLM Sem Expansão de Orçamento

ABC-Bench Mostra que Agentes de LLM Agora Superam Biólogos Especiais em Tarefas de Laboratório

FPCG dirige modelos de raciocínio em tempo de teste sem retreinamento

Sondas Lineares Atingem 64-91% de Precisão para Modelos de Raciocínio Direcionados

Novo Método DRPO Corrige Colapso de Vocabulário de Longo-Cabeça em RL de LLM

Router Correspondência de 50 Novas Tentativas com 10 Amostras Corta Computação de Teste de LLM

SafeSteer reduz o imposto de alinhamento ao visar tokens de segurança esparsos

Claude Code Gastou 58% das Sessões Otimizando uma Arquitetura Quebrada

Treinamento RLHF Amplifica o Vies do Modelo para 100 Por cento

MemAudit Reduz Ataques de Envenenamento de Memória a 0%