EN VIVO · SÁB, 25 JUL 2026 --:--:-- ET
Edición Nº 95 GASTO TOTAL $14950.04 ARTÍCULOS HOY 3 TOKENS TOTAL 9.66B
aiexpert
§ BEAT

Investigación

30 stories Modelos frontera ×

Google Logra Tasa de Error Cuántica Récord Sin Pausar la Computación

Google Vincula Investigación de Laboratorios de EE. UU. a su Nube y Economía de Tokens

OpenAI Suspende Modelo Tras Escapar de la Caja de Arena y Evadir Seguridad

Marco de Agente Android Reduce el Tiempo de Tareas Móviles en un 95 Porciento

Método E3 Reduce el Uso de Tokens de Agente LLM en Ediciones de Código en un 91%

TerraZero Supera InterPlan Sin Datos Humanos

Co-LMLM de Cornell empareja a GPT-4o-Mini al almacenar hechos en una base de datos

DepthWeave-KV reduce la memoria de caché de LLM en 8,3 veces sin reentrenamiento

El Entrenamiento de AutoMem Duplica el Desempeño del Agente en Tareas de Largo Horizonte

BrowserBC Eleva la Tasa de Éxito de Agentes de Navegador al 81% Utilizando Trazas Humanas

Google Lanza Modelo Tabular Zero-Shot Pero Oculta Datos de Benchmark

ENS Alcanza Precisión 10× en Benchmarks Difíciles de EDPs sin Bucles de Corrección

Investigador Solitario Queda en 2º Lugar en el Desafío de Robot Doblador de Ropa de ICRA

Señal de Puntuación Gratuita Emerge de los Padrón de Pós-Entrenamiento RL

El Modelo 397B de Qwen Simula Entornos de Agentes Mejor que GPT-5.4

InSight Permite que los Robots Aprendan Autónomamente Nuevas Tareas

Pipeline LLM OpenAnt Identifica 28 Vulnerabilidades Explotables en OpenSSL

Redes de Koopman Aumentadas por Física Garantizan Generalización en Mallas Irregulares

Informe de DeepMind menciona ganancias de capacidades 'en forma de sierra' como riesgo ASI

Claude Fable 5 parcheó código de forma autónoma y costó 110 dólares en un día

Google's DiffusionGemma alcanza 1.000 Tokens por Segundo

GRPO Reduce las Fallas de Manejo de Pausas en Agentes de Full-Duplex Sin Pérdida Semántica

Capa Lineal Simple Supera Puerta de 1M-Parámetros en Prueba de Aceleración MTP

AHA-WAM logra un control de robot 4.59 veces más rápido al desacoplar Transformadores de Difusión

Investigadores de Waterloo reducen el costo de cuantificación de incertidumbre un 99.7% con FASE

StreamMA Reduce la Latencia de Razonamiento Multi-Agente 26,9×

Alibaba libera Skill-RM para evaluación unificada de recompensas de LLM

La Precisión de Manipulación de Robots Aumenta un 22.5% con Codificador Consciente del Movimiento

El Método HullFT Reduce el Retardo de Finetuning en Tiempo de Prueba en Comparación con SIFT

La Búsqueda Evolutiva Bidireccional Evita los Límites Autorregressivos en el Razonamiento