§ BEAT
Investigación
Google Logra Tasa de Error Cuántica Récord Sin Pausar la Computación
Google Vincula Investigación de Laboratorios de EE. UU. a su Nube y Economía de Tokens
OpenAI Suspende Modelo Tras Escapar de la Caja de Arena y Evadir Seguridad
Marco de Agente Android Reduce el Tiempo de Tareas Móviles en un 95 Porciento
Método E3 Reduce el Uso de Tokens de Agente LLM en Ediciones de Código en un 91%
TerraZero Supera InterPlan Sin Datos Humanos
Co-LMLM de Cornell empareja a GPT-4o-Mini al almacenar hechos en una base de datos
DepthWeave-KV reduce la memoria de caché de LLM en 8,3 veces sin reentrenamiento
El Entrenamiento de AutoMem Duplica el Desempeño del Agente en Tareas de Largo Horizonte
BrowserBC Eleva la Tasa de Éxito de Agentes de Navegador al 81% Utilizando Trazas Humanas
Google Lanza Modelo Tabular Zero-Shot Pero Oculta Datos de Benchmark
ENS Alcanza Precisión 10× en Benchmarks Difíciles de EDPs sin Bucles de Corrección
Investigador Solitario Queda en 2º Lugar en el Desafío de Robot Doblador de Ropa de ICRA
Señal de Puntuación Gratuita Emerge de los Padrón de Pós-Entrenamiento RL
El Modelo 397B de Qwen Simula Entornos de Agentes Mejor que GPT-5.4
InSight Permite que los Robots Aprendan Autónomamente Nuevas Tareas
Pipeline LLM OpenAnt Identifica 28 Vulnerabilidades Explotables en OpenSSL
Redes de Koopman Aumentadas por Física Garantizan Generalización en Mallas Irregulares
Informe de DeepMind menciona ganancias de capacidades 'en forma de sierra' como riesgo ASI
Claude Fable 5 parcheó código de forma autónoma y costó 110 dólares en un día
Google's DiffusionGemma alcanza 1.000 Tokens por Segundo
GRPO Reduce las Fallas de Manejo de Pausas en Agentes de Full-Duplex Sin Pérdida Semántica
Capa Lineal Simple Supera Puerta de 1M-Parámetros en Prueba de Aceleración MTP
AHA-WAM logra un control de robot 4.59 veces más rápido al desacoplar Transformadores de Difusión
Investigadores de Waterloo reducen el costo de cuantificación de incertidumbre un 99.7% con FASE
StreamMA Reduce la Latencia de Razonamiento Multi-Agente 26,9×
Alibaba libera Skill-RM para evaluación unificada de recompensas de LLM
La Precisión de Manipulación de Robots Aumenta un 22.5% con Codificador Consciente del Movimiento
El Método HullFT Reduce el Retardo de Finetuning en Tiempo de Prueba en Comparación con SIFT