cs.AI artículos | Gist.Science

Evolution Strategy-Based Calibration for Low-Bit Quantization of Speech Models

El artículo presenta ESC, un método de calibración basado en estrategias evolutivas que optimiza la escala de las activaciones para lograr una cuantización casi sin pérdida en modelos de voz de 4 y 8 bits, superando las limitaciones de las técnicas estándar diseñadas para visión y procesamiento de lenguaje natural.

Lucas Rakotoarivony2026-03-10💻 cs

Is continuous CoT better suited for multi-lingual reasoning?

El estudio demuestra que el razonamiento en cadena en un espacio latente continuo (CODI) supera al razonamiento explícito en idiomas de bajos recursos y escenarios zero-shot, ofreciendo una solución escalable con una compresión de trazas de 29 a 50 veces.

Ali Hamza Bashir, Behzad Shomali, Markus Frey, Mehdi Ali, Rafet Sifa, David Berghaus2026-03-10🤖 cs.LG

Privacy-Preserving End-to-End Full-Duplex Speech Dialogue Models

Este trabajo demuestra que los modelos de diálogo de voz full-duplex de extremo a extremo filtran la identidad del hablante en sus representaciones ocultas y propone dos métodos de anonimización en tiempo real que protegen significativamente la privacidad sin comprometer la latencia ni la calidad del diálogo.

Nikita Kuzmin, Tao Zhong, Jiajun Deng, Yingke Zhu, Tristan Tsoi, Tianxiang Cao, Simon Lui, Kong Aik Lee, Eng Siong Chng2026-03-10💻 cs

TildeOpen LLM: Leveraging Curriculum Learning to Achieve Equitable Language Representation

El artículo presenta TildeOpen LLM, un modelo de lenguaje abierto de 30 mil millones de parámetros entrenado con estrategias de aprendizaje curricular y muestreo de datos para lograr una representación equitativa y un rendimiento superior en 34 idiomas europeos, especialmente en lenguas de recursos limitados como las bálticas, fino-úgricas y eslavas.

Toms Bergmanis, Martins Kronis, Ingus J\=anis Pretkalninš, D\=avis Nicmanis, Jelizaveta Jelinska, Roberts Rozis, Rinalds V\=iksna, M\=arcis Pinnis2026-03-10💬 cs.CL

MM-TS: Multi-Modal Temperature and Margin Schedules for Contrastive Learning with Long-Tail Data

El artículo presenta MM-TS, un método que mejora el aprendizaje contrastivo multimodal con datos de cola larga mediante la programación dinámica de temperaturas y márgenes, logrando resultados de vanguardia en cuatro conjuntos de datos de imagen y video.

Siarhei Sheludzko, Dhimitrios Duka, Bernt Schiele, Hilde Kuehne, Anna Kukleva2026-03-10💻 cs

Distributional Regression with Tabular Foundation Models: Evaluating Probabilistic Predictions via Proper Scoring Rules

El artículo critica la dependencia actual de métricas de estimación puntual en los benchmarks de regresión para modelos fundacionales tabulares y propone evaluar y optimizar las predicciones probabilísticas mediante reglas de puntuación adecuadas, como el CRPS, junto con estrategias de ajuste fino o prompts para adaptar el sesgo inductivo de estos modelos.

Jonas Landsgesell, Pascal Knoll2026-03-10🤖 cs.LG

Alignment-Aware and Reliability-Gated Multimodal Fusion for Unmanned Aerial Vehicle Detection Across Heterogeneous Thermal-Visual Sensors

Este estudio presenta dos estrategias de fusión multimodal, RGIF y RGMAF, que combinan el registro de imágenes con mecanismos de atención adaptativa para mejorar significativamente la detección de vehículos aéreos no tripulados (UAV) al integrar datos heterogéneos de sensores térmicos y visuales.

Ishrat Jahan, Molla E Majid, M Murugappan, Muhammad E. H. Chowdhury, N. B. Prakash, Saad Bin Abul Kashem, Balamurugan Balusamy, Amith Khandakar2026-03-10💻 cs

Revisiting Gradient Staleness: Evaluating Distance Metrics for Asynchronous Federated Learning Aggregation

Este artículo extiende el método de agregación adaptativa AsyncFedED para el aprendizaje federado asíncrono, demostrando que la integración de métricas de distancia alternativas al de Euclídeo mejora la robustez, la velocidad de convergencia y el rendimiento del modelo en entornos heterogéneos con datos no IID.

Patrick Wilhelm, Odej Kao2026-03-10🤖 cs.LG

SplitAgent: A Privacy-Preserving Distributed Architecture for Enterprise-Cloud Agent Collaboration

SplitAgent es una arquitectura distribuida innovadora que permite la colaboración entre agentes empresariales y en la nube preservando la privacidad mediante una sanitización dinámica sensible al contexto, logrando un equilibrio superior entre la precisión de las tareas y la protección de datos confidenciales.

Jianshu She2026-03-10💻 cs

Disentangling Reasoning in Large Audio-Language Models for Ambiguous Emotion Prediction

Este trabajo presenta un marco innovador para el reconocimiento de emociones ambiguas en modelos grandes de audio-idioma, reformulando la tarea como un problema de razonamiento distribucional mediante un objetivo consciente de la ambigüedad y una supervisión estructurada de pensamiento en cadena que alinea las predicciones con las distribuciones perceptuales humanas.

Xiaofeng Yu, Jiaheng Dong, Jean Honorio, Abhirup Ghosh, Hong Jia, Ting Dang2026-03-10💻 cs

The Struggle Between Continuation and Refusal: A Mechanistic Analysis of the Continuation-Triggered Jailbreak in LLMs

Este artículo realiza un análisis mecanicista que demuestra cómo la competencia inherente entre la tendencia del modelo a continuar el texto y sus defensas de seguridad, activada por instrucciones de continuación, explica la vulnerabilidad a ataques de jailbreak y revela diferencias funcionales en las cabezas de atención críticas para la seguridad entre distintas arquitecturas de modelos.

Yonghong Deng, Zhen Yang, Ping Jian, Xinyue Zhang, Zhongbin Guo, Chengzhi Li2026-03-10🤖 cs.LG

Exploring Deep Learning and Ultra-Widefield Imaging for Diabetic Retinopathy and Macular Edema

Este estudio evalúa métodos de aprendizaje profundo, incluyendo redes neuronales convolucionales, transformadores de visión y modelos fundacionales, aplicados a imágenes ultra granulares para la detección de retinopatía diabética y edema macular diabético, demostrando un rendimiento sólido y la eficacia de la fusión de características y las representaciones en el dominio de la frecuencia.

Pablo Jimenez-Lizcano, Sergio Romero-Tapiador, Ruben Tolosana, Aythami Morales, Guillermo González de Rivera, Ruben Vera-Rodriguez, Julian Fierrez2026-03-10💻 cs

Fibration Policy Optimization

El artículo presenta Fibration Policy Optimization (FiberPO), un marco unificado que integra la teoría de regiones de confianza y una estructura algebraica de fibración para optimizar políticas de modelos de lenguaje mediante un control de estabilidad jerárquico y multi-escala que abarca desde el nivel de tokens hasta dominios completos.

Chang Li, Tshihao Tsu, Yaren Zhang, Chao Xue, Xiaodong He2026-03-10🤖 cs.LG

FinToolBench: Evaluating LLM Agents for Real-World Financial Tool Use

El artículo presenta FinToolBench, el primer benchmark ejecutable del mundo real diseñado para evaluar agentes de IA en el uso de herramientas financieras, introduciendo un ecosistema con 760 herramientas y un marco de evaluación que prioriza la precisión, la oportunidad y el cumplimiento normativo.

Jiaxuan Lu, Kong Wang, Yemin Wang, Qingmei Tang, Hongwei Zeng, Xiang Chen, Jiahao Pi, Shujian Deng, Lingzhi Chen, Yi Fu, Kehua Yang, Xiao Sun2026-03-10💻 cs

Towards a more efficient bias detection in financial language models

Este estudio propone un método de detección de sesgos en modelos de lenguaje financieros que reduce significativamente los costos computacionales al identificar patrones consistentes entre modelos, permitiendo descubrir hasta un 73% de los comportamientos sesgados utilizando solo el 20% de los pares de entrada necesarios en enfoques tradicionales.

Firas Hadj Kacem, Ahmed Khanfir, Mike Papadakis2026-03-10🤖 cs.LG

SAIL: Test-Time Scaling for In-Context Imitation Learning with VLM

El paper presenta SAIL, un marco que mejora el aprendizaje por imitación en contexto para robots mediante la redefinición de la generación de trayectorias como un problema de refinamiento iterativo escalable en tiempo de prueba utilizando búsqueda en árbol Monte Carlo, lo que permite alcanzar tasas de éxito de hasta el 95% en tareas complejas.

Makoto Sato, Yusuke Iwasawa, Yujin Tang, So Kuroki2026-03-10💻 cs

SCL-GNN: Towards Generalizable Graph Neural Networks via Spurious Correlation Learning

El artículo presenta SCL-GNN, un nuevo marco de redes neuronales de grafos que mejora la generalización tanto en distribuciones IID como OOD al identificar y mitigar correlaciones espurias mediante el criterio de independencia Hilbert-Schmidt (HSIC) y una estrategia de optimización bi-nivel.

Yuxiang Zhang, Enyan Dai2026-03-10🤖 cs.LG

How Much Do LLMs Hallucinate in Document Q&A Scenarios? A 172-Billion-Token Study Across Temperatures, Context Lengths, and Hardware Platforms

Este estudio de 172 mil millones de tokens, que evalúa 35 modelos de lenguaje en diversos contextos, temperaturas y plataformas de hardware, revela que la alucinación en respuestas basadas en documentos es un problema generalizado que aumenta drásticamente con la longitud del contexto, depende principalmente de la selección del modelo más que de su tamaño o del hardware utilizado, y que la capacidad de encontrar hechos no garantiza la resistencia a inventar información.

JV Roig2026-03-10💬 cs.CL

AdaCultureSafe: Adaptive Cultural Safety Grounded by Cultural Knowledge in Large Language Models

El artículo presenta AdaCultureSafe, un marco que integra conocimientos culturales autorizados en modelos de lenguaje grandes para mejorar su seguridad cultural, demostrando mediante un nuevo dataset de 48K consultas que la seguridad y el conocimiento cultural no están correlacionados actualmente y proponiendo un método basado en el conocimiento para resolver esta desconexión.

Hankun Kang, Di Lin, Zhirong Liao, Pengfei Bai, Xinyi Zeng, Jiawei Jiang, Yuanyuan Zhu, Tieyun Qian2026-03-10💬 cs.CL

TA-RNN-Medical-Hybrid: A Time-Aware and Interpretable Framework for Mortality Risk Prediction

El artículo presenta TA-RNN-Medical-Hybrid, un marco de aprendizaje profundo que combina codificación temporal continua, representaciones de conceptos médicos estandarizados y un mecanismo de atención jerárquica para mejorar la precisión y la interpretabilidad clínica en la predicción de riesgo de mortalidad en unidades de cuidados intensivos.

Zahra Jafari, Azadeh Zamanifar, Amirfarhad Farhadi2026-03-10🤖 cs.LG

← Anterior Siguiente →