Todo lo que la redacción publicó, en orden cronológico. Cada ítem trae origen, fuentes y tiempo de lectura.
RESEARCH
RESEARCH
RESEARCH Clasificación de opciones Jev en 25 líneas de Python con inferencia local
RESEARCH Claude Opus 5 lidera benchmark de diseño de circuitos con 61.6%, pero falla en 4 de 10 RESEARCH SWE-2 de Cognition iguala rendimiento de código frontier a 64% menor costo
RESEARCH Knowledge Pull Requests logran 69% en QA sobre artículos revisados versus 48% en reescrituras brutas
RESEARCH GravityOCR logra aceleración de 3.94× en OCR de documentos mediante decodificación especulativa
RESEARCH Los rastros de razonamiento comprimido de GPT-6 Astra no se transfieren a modelos más débiles
RESEARCH Agensh de Microsoft alcanza 55% de tasa de aprobación con 1,024 agentes
RESEARCH SWE-Serve benchmark expone 23-point gap entre pruebas locales y serving en producción
RESEARCH Ataque A2M secuestra agentes MCP con metadatos de herramientas envenenadas al 93.6%
RESEARCH La elección de harness genera una brecha de costo de 5x mientras las tasas de éxito de agentes de código se mantienen planas
RESEARCH Flash-dLLM cuts diffusion LLM inference latency 11× with fused kernels
RESEARCH Seis Modelos de ASR Memorizan Benchmarks en Lugar de Transcribir
RESEARCH Un artículo de Google DeepMind muestra cuándo las señales de enrutamiento desperdician procesamiento
RESEARCH El 20B-Token Corpus de MidTool Eleva el Rendimiento de Tool-Use en los Benchmarks
RESEARCH VLA Detecta Coordinación Oculta de Agentes con Precisión de 0.993
RESEARCH Agentes SPADE Aprenden Enseñándose a Sí Mismos Nuevas Tareas
RESEARCH DSpark de Liquid AI logra aceleración de 3.18x en H100 con decodificación especulativa
RESEARCH Nuevo Método Prueba la Ruta de Razonamiento del Modelo en 128 Casos de Prueba, Falla en Modelos Estándar
RESEARCH Estudio IBM: Memoria Curada Impulsa Agentes de Nivel Medio en 16 Puntos RESEARCH METR Encuentra que la IA Acelera Vulnerabilidades Pero No Optimización
RESEARCH BATON reduce el costo de exploración de tareas de robot de exponencial a lineal
RESEARCH OpenAI y NVIDIA Aseguran Fábrica de IA de 8 Gigawatts en Campus de Ohio
RESEARCH Corrección de Asignación de Memoria Permite que Modelos Recurrentes Igualen Atención a Escala
RESEARCH Investigadores Exponen Hipnosis de Modelo: Señales de Prompt Invisibles Secuestran IA con un 99% de Éxito
RESEARCH Detectores de Cumplimiento Fallan en la Prueba de Ceguera de Reglas, Auditoría Lexsi Encuentra
RESEARCH KV-Rescue Recupera el 87% de la Precisión Perdida del Modelo
RESEARCH QuoteBench Expone una Brecha de 55 Puntos Oculta en Benchmarks de Agentes de Código
RESEARCH Google DeepMind lanza IA de lenguaje de signos en Pixel 11 RESEARCH Agentes Resuelven Solo 27 de 43 Tareas de Código Verificado
RESEARCH Agentes LLM Sucumben a Supply-Chain Attacks Ocultos en Lenguaje Plano
RESEARCH Andamios en Tiempo de Inferencia Elevan la Precisión de Modelos Débiles a 0.91
RESEARCH El Benchmark VAKRA de IBM Demuestra que los Modelos Fallan en el 97% de las Tarefas Restringidas por Políticas RESEARCH El Framework RCI Reduce Violaciones de Restricciones en Entrenamientos de RL Seguro Offline
RESEARCH Liquid AI lanza modelo de visión edge de 3.1B parámetros con throughput de 228 tokens/segundo