cs.AI artigos | Gist.Science

SwiftEmbed: Ultra-Fast Text Embeddings via Static Token Lookup for Real-Time Applications

O SwiftEmbed é um sistema de inferência em Rust que utiliza a busca estática de tokens para oferecer embeddings de texto ultra-rápidos com latência de 1,12 ms e 50.000 requisições por segundo, sendo ideal para aplicações em tempo real que priorizam a velocidade em detrimento da precisão em tarefas complexas de classificação.

Edouard Lansiaux, Antoine Simonet, Eric Wiel2026-03-10💬 cs.CL

Vectorized Online POMDP Planning

Este artigo apresenta o VOPP, um novo planejador online de POMDP totalmente vetorizado que elimina gargalos de sincronização ao representar os dados como tensores e realizar cálculos massivamente paralelos, alcançando uma eficiência 20 vezes superior a solvers paralelos existentes e superando solvers sequenciais com um orçamento de planejamento 1000 vezes menor.

Marcus Hoerger, Muhammad Sudrajat, Hanna Kurniawati2026-03-10💻 cs

Detecting AI-Generated Images via Diffusion Snap-Back Reconstruction: A Forensic Approach

Este artigo propõe uma abordagem forense para detectar imagens geradas por IA analisando o comportamento de "recuperação" (snap-back) das imagens quando submetidas a reconstrução por modelos de difusão, alcançando uma alta precisão na distinção entre fotografias autênticas e sintéticas mesmo sob distorções comuns.

Mohd Ruhul Ameen, Akif Islam2026-03-10💻 cs

Balancing Interpretability and Performance in Motor Imagery EEG Classification: A Comparative Study of ANFIS-FBCSP-PSO and EEGNet

Este estudo compara a abordagem interpretável ANFIS-FBCSP-PSO com o modelo de aprendizado profundo EEGNet para classificação de EEG de imagética motora, demonstrando que o primeiro oferece melhor desempenho intra-sujeito enquanto o segundo apresenta maior generalização entre sujeitos, fornecendo diretrizes para a seleção de sistemas BCI conforme o objetivo de interpretabilidade ou robustez.

Farjana Aktar, Mohd Ruhul Ameen, Akif Islam, Md Ekramul Hamid2026-03-10🤖 cs.LG

Towards Efficient Federated Learning of Networked Mixture-of-Experts for Mobile Edge Computing

Este artigo propõe o sistema NMoE (Mistura de Especialistas em Rede), que utiliza aprendizado federado combinando aprendizado supervisionado e auto-supervisionado para permitir a inferência colaborativa e eficiente entre dispositivos de borda, superando as limitações de recursos no treinamento e implantação de grandes modelos de inteligência artificial.

Song Gao, Songyang Zhang, Shusen Jing, Shuai Zhang, Xiangwei Zhou, Yue Wang, Zhipeng Cai2026-03-10🤖 cs.LG

FATE: A Formal Benchmark Series for Frontier Algebra of Multiple Difficulty Levels

O artigo apresenta o FATE, uma nova série de benchmarks em álgebra formal com níveis de dificuldade que vão de exercícios universitários a problemas além de exames de doutorado, revelando que os modelos de linguagem atuais têm desempenho significativamente inferior nessa tarefa de raciocínio matemático avançado em comparação com competições tradicionais.

Jiedong Jiang, Wanyi He, Yuefeng Wang, Guoxiong Gao, Yongle Hu, Jingting Wang, Nailin Guan, Peihao Wu, Chunbo Dai, Liang Xiao, Bin Dong2026-03-10🤖 cs.LG

Jr. AI Scientist and Its Risk Report: Autonomous Scientific Exploration from a Baseline Paper

Este artigo apresenta o "Jr. AI Scientist", um sistema autônomo de ponta que simula o fluxo de trabalho de um pesquisador iniciante para gerar contribuições científicas válidas a partir de artigos de base, demonstrando desempenho superior em avaliações automatizadas enquanto identifica riscos e limitações críticos para a aplicação futura desses sistemas.

Atsuyuki Miyai, Mashiro Toyooka, Takashi Otonari, Zaiying Zhao, Kiyoharu Aizawa2026-03-10🤖 cs.LG

HatePrototypes: Interpretable and Transferable Representations for Implicit and Explicit Hate Speech Detection

O artigo "HatePrototypes" propõe representações vetoriais interpretáveis e transferíveis, derivadas de poucos exemplos por classe, que permitem a detecção eficiente de discurso de ódio explícito e implícito sem a necessidade de repetidos ajustes finos, utilizando uma abordagem de saída antecipada sem parâmetros.

Irina Proskurina, Marc-Antoine Carpentier, Julien Velcin2026-03-10💬 cs.CL

Think, Speak, Decide: Language-Augmented Multi-Agent Reinforcement Learning for Economic Decision-Making

O artigo apresenta o LAMP, um quadro de aprendizagem por reforço multiagente que integra raciocínio linguístico num pipeline "Pensar-Falar-Decidir" para otimizar a tomada de decisões económicas, superando significativamente as abordagens tradicionais em retorno, robustez e interpretabilidade.

Heyang Ma, Qirui Mi, Qipeng Yang, Zijun Fan, Bo Li, Haifeng Zhang2026-03-10💻 cs

UnfoldLDM: Deep Unfolding-based Blind Image Restoration with Latent Diffusion Priors

O artigo apresenta o UnfoldLDM, uma nova arquitetura de redes de desdobramento profundo que integra um modelo de difusão latente para superar as limitações de dependência de degradação e viés de suavização excessiva, permitindo a restauração cega de imagens com recuperação eficaz de detalhes de alta frequência.

Chunming He, Rihan Zhang, Zheng Chen, Bowen Yang, Chengyu Fang, Yunlong Lin, Yulun Zhang, Fengyang Xiao, Sina Farsiu2026-03-10💻 cs

Stable Multi-Drone GNSS Tracking System for Marine Robots

Este trabalho apresenta um sistema estável de rastreamento GNSS para robôs marinhos, utilizando múltiplos drones com detecção visual, triangulação baseada em GNSS e um filtro de Kalman estendido ponderado por confiança para fornecer estimativas precisas e em tempo real na superfície e perto dela.

Shuo Wen, Edwin Meriaux, Mariana Sosa Guzmán, Zhizun Wang, Junming Shi, Gregory Dudek2026-03-10💻 cs

Towards Realistic Guarantees: A Probabilistic Certificate for SmoothLLM

Este trabalho apresenta um novo quadro probabilístico "(k, $\varepsilon$ )-instável" que supera as limitações da defesa SmoothLLM ao fornecer garantias de segurança mais realistas e fundamentadas em dados contra uma ampla gama de ataques de jailbreaking em LLMs.

Adarsh Kumarappan, Ayushi Mehrotra2026-03-10🤖 cs.LG

Yo'City: Personalized and Boundless 3D Realistic City Scene Generation via Self-Critic Expansion

O artigo apresenta o Yo'City, um novo framework agêntico que utiliza modelos de linguagem grandes para gerar cenas de cidades 3D realistas, personalizadas e infinitamente expansíveis através de um planejamento hierárquico, síntese de imagens isométricas e um mecanismo de expansão guiado por relações espaciais e semânticas.

Keyang Lu, Sifan Zhou, Hongbin Xu, Gang Xu, Zhifei Yang, Yikai Wang, Zhen Xiao, Jieyi Long, Ming Li2026-03-10💻 cs

Enhancing low energy reconstruction and classification in KM3NeT/ORCA with transformers

Este estudo demonstra que a incorporação de máscaras de atenção inspiradas na física e no design do detector em modelos transformers melhora significativamente a reconstrução e classificação de baixas energias no telescópio de neutrinos KM3NeT/ORCA, permitindo também uma transferência eficiente de conhecimento entre diferentes configurações.

Iván Mozún Mateo (on behalf of the KM3NeT collaboration)2026-03-10🔭 astro-ph

Automating Deception: Scalable Multi-Turn LLM Jailbreaks

Este artigo apresenta um pipeline automatizado para gerar um conjunto de dados em larga escala de ataques de jailbreak multi-turno baseados no princípio psicológico "Pé na Porta", revelando que, embora modelos como o Gemini 2.5 Flash demonstrem alta resiliência, modelos da família GPT são significativamente vulneráveis a manipulações narrativas que exploram o histórico de conversação.

Adarsh Kumarappan, Ananya Mujoo2026-03-10🤖 cs.LG

Computing Evolutionarily Stable Strategies in Multiplayer Games

O artigo apresenta um algoritmo para calcular todas as estratégias evolutivamente estáveis em jogos normais não degenerados com três ou mais jogadores.

Sam Ganzfried2026-03-10📈 econ

RadDiff: Retrieval-Augmented Denoising Diffusion for Protein Inverse Folding

O artigo apresenta o RadDiff, um novo método de difusão denoising aumentada por recuperação que supera os métodos existentes no dobramento inverso de proteínas ao integrar conhecimento atualizado de bancos de dados externos, alcançando taxas de recuperação de sequência superiores e maior eficiência.

Jin Han, Tianfan Fu, Wu-Jun Li2026-03-10💻 cs

ForamDeepSlice: A High-Accuracy Deep Learning Framework for Foraminifera Species Classification from 2D Micro-CT Slices

Este estudo apresenta o ForamDeepSlice, um framework de aprendizado profundo baseado em um ensemble de redes neurais que alcança alta precisão na classificação automática de espécies de foraminíferos a partir de fatias 2D de micro-TC, estabelecendo novos benchmarks para identificação micropaleontológica assistida por IA.

Abdelghafour Halimi, Ali Alibrahim, Didier Barradas-Bautista, Ronell Sicat, Abdulkader M. Afifi2026-03-10🤖 cs.LG

Integrating a Causal Foundation Model into a Prescriptive Maintenance Framework for Optimising Production-Line OEE

Este artigo propõe a integração de um modelo fundamental causal em um framework de manutenção prescritiva para simular cenários "e se", identificar causas raízes de falhas e recomendar ações otimizadas que maximizem a Eficácia Global dos Equipamentos (OEE) em linhas de produção.

Felix Saretzky, Lucas Andersen, Thomas Engel, Fazel Ansari2026-03-10💻 cs

AltNet: Addressing the Plasticity-Stability Dilemma in Reinforcement Learning

O artigo apresenta o AltNet, uma abordagem baseada em redes gêmeas que resolve o dilema plasticidade-estabilidade no aprendizado por reforço, permitindo a restauração da plasticidade por meio de resets periódicos sem causar quedas de desempenho, garantindo assim maior eficiência e segurança em tarefas de controle de alta dimensão.

Mansi Maheshwari, John C. Raisbeck, Bruno Castro da Silva2026-03-10🤖 cs.LG

← Anterior Próximo →