Todo lo que la redacción publicó, en orden cronológico. Cada ítem trae origen, fuentes y tiempo de lectura.
RESEARCH RiVER Permite Aprendizaje por Refuerzo Sin Etiquetas de Verdad Absoluta
RESEARCH La Alucinación de Modelos Mundiales es un Problema de Datos, No de Arquitectura
RESEARCH Investigador Solitario Queda en 2º Lugar en el Desafío de Robot Doblador de Ropa de ICRA
RESEARCH Modelos Olvidan Reglas Aprendidas Durante el Entrenamiento
RESEARCH Señal de Puntuación Gratuita Emerge de los Padrón de Pós-Entrenamiento RL
RESEARCH Protocolo de Análisis Forense de DeepMind Diagnostica IA Confundida vs. Desalineada
RESEARCH Los Modelos Multimodales Cambian de Respuesta Cuando Cambia el Orden de las Evidencias
RESEARCH Las IAs de Voz en Producción Ignoran la Emoción, Aprobando Fraudes y Terminando Llamadas de Cuidado
RESEARCH El Modelo 397B de Qwen Simula Entornos de Agentes Mejor que GPT-5.4
RESEARCH Benchmark FFASR Expone la Brecha en el Reconocimiento de Voz de Campo Lejano RESEARCH Corrección de Regex Estricta Aumenta Recuperación de Calificación de Agentes en 60 Puntos Porcentuales
RESEARCH InSight Permite que los Robots Aprendan Autónomamente Nuevas Tareas
RESEARCH Dataset OpenThoughts-Agent Alcanza 44.8% en Benchmarks de Agentes
RESEARCH Aprendizaje en Contexto Amortizado Reduce el Costo de Servicio Few-Shot
RESEARCH DiffusionGemma de Google DeepMind es 28,6X más difícil de interpretar que modelos autorregressivos
RESEARCH Princeton Lanza LOCUS, Corpus de Ordenanzas Locales de EE.UU. Legible por Máquina
RESEARCH Tres Agentes Vencen Todos los Benchmarks SQL Sin Fine-Tuning
RESEARCH Pipeline LLM OpenAnt Identifica 28 Vulnerabilidades Explotables en OpenSSL RESEARCH MIT Extrae Lógica de Atención en Código Python Intercambiable RESEARCH Redes de Koopman Aumentadas por Física Garantizan Generalización en Mallas Irregulares
RESEARCH Un solo modelo puede albergar cientos de personalidades de agentes como máscaras ligeras
RESEARCH Jefes de Atención Dispersa Redirigen Modelos de Visión-Lenguaje con Precisión del 83%
RESEARCH ClinHallu Desglosan por qué las IA Médicas Malinterpretan Imágenes 65% del Tiempo
RESEARCH La Interacción de Componentes, No la Calidad, Determina el Rendimiento del Agente
RESEARCH DiffusionGemma Desmiente Afirmaciones de Google sobre Decodificación Bloqueada
RESEARCH Informe de DeepMind menciona ganancias de capacidades 'en forma de sierra' como riesgo ASI
RESEARCH Prueba sin etiquetas detecta mejor los fallos de razonamiento de LLM que la consistencia propia
RESEARCH Agents-K1 Reemplaza Fragmentos de Texto RAG con Grafos de Conocimiento Científico Tipados
RESEARCH EvoArena Benchmark Revela Colapso de Agentes en Entornos en Evolución
RESEARCH Sub-$11 Agente Supera Marcos de Investigación Especializados
RESEARCH Agente recursivo alcanza un 89% de precisión en tareas de código de larga duración
RESEARCH La mitad de las correcciones de código generadas por IA fallan en la revisión humana
RESEARCH DIRECT reduce la latencia de IA encarnada en un 65% con enrutamiento dinámico de planificador
RESEARCH Claude Fable 5 parcheó código de forma autónoma y costó 110 dólares en un día
RESEARCH Nueva Herramienta Detecta 1,060 Dependencias de Entrenamiento Ocultas en Principales LLM