Todo lo que la redacción publicó, en orden cronológico. Cada ítem trae origen, fuentes y tiempo de lectura.
RESEARCH Sistema Tahoe de Text-to-SQL Reduce el Retroalimentación del Compilador en un 96%
RESEARCH Google's DiffusionGemma alcanza 1.000 Tokens por Segundo
RESEARCH GRPO Reduce las Fallas de Manejo de Pausas en Agentes de Full-Duplex Sin Pérdida Semántica
RESEARCH Diagrama de Fases de Kamai Predice Fallas Multimodales Antes del Compromiso de GPU
RESEARCH ABC-Bench Demuestra que los Agentes de LLM Ya Superan a los Biólogos Expertos en Tarefas de Laboratorio
RESEARCH FPCG dirige modelos de razonamiento en tiempo de prueba sin reentrenamiento
RESEARCH Sondeos Lineales Logran Precisión del 64-91% en Modelos de Razonamiento RESEARCH Las clasificaciones de LLM no predicen fiabilidad en producción
RESEARCH Grok 3 Supera a Biólogos Credenciados en Tareas de Laboratorio ADN Autónomo
RESEARCH EEVEE supera agentes de auto-mejora con margen del 48% en inferencia multi-dominio
RESEARCH Compilador Piper Elimina la Codificación Manual para Entrenamiento Distribuido
RESEARCH Capa Lineal Simple Supera Puerta de 1M-Parámetros en Prueba de Aceleración MTP
RESEARCH EHC Real Benchmark Revela Límites de LLM en Acción Clínica
RESEARCH AHA-WAM logra un control de robot 4.59 veces más rápido al desacoplar Transformadores de Difusión
RESEARCH FASE Reduce la Detección de Alucinaciones a una Velocidad de 333x
RESEARCH Nuevo Método DRPO Corrige Colapso de Vocabulario de Larga-Talla en RL de LLM
RESEARCH FASE Reduce el Costo de Detección de Alucinaciones al 0.3% de los Rivales
RESEARCH SIGA Acelera Agentes de Codificación en Simuladores Científicos por 36×
RESEARCH Echo-Memory Demuestra que los Modelos del Mundo Fallan en la Prueba de Revisita
RESEARCH Investigadores de Waterloo reducen el costo de cuantificación de incertidumbre un 99.7% con FASE
RESEARCH El Esquema EvalCards Revela Brechas Metadatos de Comparación de IA Sistematizadas
RESEARCH Agente de IA de Perplexity Reduce el Tiempo de Tareas un 87 Por Ciento en Estudio de Producción
RESEARCH El 64 Por Ciento de Conflictos Audio-Texto en Modelos de IA Son Solucionables
RESEARCH Router Matching 50 Reintentos con 10 Muestras Reduce el Cálculo de Tiempo de Prueba de LLM
RESEARCH StreamMA Reduce la Latencia de Razonamiento Multi-Agente 26,9×
RESEARCH Paneles de jueces diversos de proveedores eliminan sesgo en evaluaciones de modelos de lenguaje
RESEARCH Los LLM pueden inducir reglas ocultas, pero la ejecución procedural sigue sin resolver
RESEARCH AdaCodec reduce la carga de tokens de video en 7× con codificación predictiva
RESEARCH SafeSteer reduce el impuesto de alineación al enfocarse en tokens de seguridad dispersos
RESEARCH El Formato de Salida Provoca una Pérdida de Precisión Más Rápida que el Cambio de Dominio en Modelos Multimodales de Gran Tamaño
RESEARCH SubFit Mantiene un 84.6% de Precisión Mientras Poda Capas de LLM a una Esparcimiento del 25%
RESEARCH Claude Code pasó el 58% de sesiones optimizando una arquitectura rota
RESEARCH La Precisión de Manipulación de Robots Aumenta un 22.5% con Codificador Consciente del Movimiento
RESEARCH Los problemas inversos lineales no protegen contra la alucinación por difusión
RESEARCH El Método HullFT Reduce el Retardo de Finetuning en Tiempo de Prueba en Comparación con SIFT
RESEARCH Conjunto de Datos Abierto GPIC Reemplaza a ImageNet-1K como Corpus Estándar de Entrenamiento