💻 computer science

Contradiction-Aware Strategy Synthesis in Agent Skills via Loop Engineering: A Controlled Empirical Comparison with Conventional Search

Este artículo demuestra que una habilidad de agente de IA con ingeniería de bucle y consciente de las contradicciones supera estrictamente a la búsqueda web convencional en la generación de estrategias de estudio en el extranjero de alto nivel para la toma de decisiones, logrando un 100 % de validez y una cobertura de salida exhaustiva en comparación con la validez del 0 % y los resultados fragmentados de la línea base.

Piyush Omanwar2026-07-15
💻 computer science

Detection First, Grading Second: A Secondary Analysis of Stage-Specific Errors in Two-Stage Colon CAD

Este análisis secundario de estilo de posición argumenta que los sistemas de CAD para colon deberían adoptar un flujo de trabajo de detección primero y gradación después, y ser evaluados mediante métricas específicas por estadio, demostrando a través del reanálisis de datos existentes que tal enfoque se alinea mejor con los flujos de trabajo de la patología clínica y revela que la mayoría de los errores de gradación son intercambios de grados adyacentes clínicamente menos graves, al tiempo que destaca el impacto crítico de la prevalencia de la enfermedad en el valor predictivo positivo.

Sulav Dahal, Bipul Bhattarai2026-07-15
💻 computer science

Are You Measuring the Failure Subspace, or Its Ceiling?

Este artículo demuestra que la ampliamente citada naturaleza de baja dimensión de los subespacios de falla en la adaptación en tiempo de prueba es un artefacto algebraico de definiciones de gradiente específicas restringidas por el espacio de filas del clasificador, en lugar de una propiedad intrínseca, ya que demandas alternativas no restringidas revelan estructuras de alta dimensión y sensibles al ancho donde la mayor parte de la energía permanece confinada al espacio de filas del clasificador.

Sungmin Ryu2026-07-15
💻 computer science

85.30 GFLOPS Single-Core FP32 Matrix Multiplication on AMD Zen 3: A Systematic Study of Cache Blocking, Register Blocking, FMA Chaining, and On-the-Fly Packing

Este artículo presenta un estudio de optimización sistemática sobre la microarquitectura AMD Zen 3 que logra 85.30 GFLOPS en la multiplicación de matrices FP32 de un solo núcleo mediante la evaluación de 28 configuraciones distintas de bloqueo de caché/registro, encadenamiento FMA y empaquetado sobre la marcha, identificando finalmente un diseño campeón que alcanza el 63.5% del rendimiento pico teórico al tiempo que introduce un modelo predictivo para optimizaciones futuras.

Lucas Lima Freitag2026-07-15
💻 computer science

Poor Man's Agentic Modeling: Simulating Large LLM-Agent Societies on a Laptop

Este artículo propone un método rentable para simular grandes sociedades de agentes de LLM en una computadora portátil mediante la sustitución de agentes individuales por sustitutos de bajos parámetros ajustados a partir de consultas económicas, introduciendo una taxonomía de percepción-memoria para predecir la precisión de la simulación y validando el enfoque a través de múltiples escenarios macroscópicos.

Igor Itkin2026-07-15
💻 computer science

High-Performance FP16 General Matrix Multiplication on NVIDIA Ada Lovelace via CUTLASS and WMMA: A Benchmark and Pipeline-Depth Analysis

Este artículo evalúa el rendimiento de GEMM en FP16 en la NVIDIA RTX 4060 de arquitectura Ada Lovelace a través de cuBLAS, CUTLASS e implementaciones personalizadas de WMMA, revelando que una profundidad de segmentación de tres con una geometría de tesela específica alcanza el 52,7% del rendimiento máximo, al tiempo que demuestra que la presión sobre la memoria compartida, en lugar de la profundidad de la segmentación, es el principal cuello de botella que limita una mayor optimización.

Lucas Lima Freitag2026-07-15
💻 computer science

Agentic AI for Code Quality: A Four-Agent Machine Learning System for Repository Refactoring, Public RAG, Groq Reasoning, and Reinforcement Learning

Este artículo presenta un marco de IA multiagente que integra el análisis basado en reglas, RAG público, razonamiento mediante LLM potenciado por Groq y aprendizaje por refuerzo mediante Q-learning para detectar, refactorizar y validar autónomamente mejoras en la calidad del código en repositorios de software, logrando reducciones significativas en la deuda técnica mientras se preserva la corrección funcional.

Abhishek Prithvi Tejs2026-07-15
💻 computer science

Exploring Simulated Morphic Fields for Sustainable Multi-Agent Learning and Education

Este artículo propone un "campo mórfico simulado" —una metáfora computacional para una capa de memoria compartida persistente— para mejorar la eficiencia y la sostenibilidad del aprendizaje robótico multiagente, sirviendo simultáneamente como una herramienta pedagógica para la enseñanza de la inteligencia colectiva y el pensamiento sistémico en la educación de la ingeniería.

José Augusto de Lima Prestes, Paulo Victor de Oliveira Miguel, Gilmar Barreto2026-07-15