💻 computer science

Comparative Performance of General-Purpose Large Language Models and a Specialized Clinical AI Tool on OKAP-Style Ophthalmology Questions

Este estudo avalia cinco modelos de linguagem de grande escala em questões de oftalmologia no estilo OKAP, revelando que modelos de propósito geral, particularmente o Gemini-Pro-3, superaram a ferramenta de IA clínica especializada OpenEvidence em precisão e calibração, ao mesmo tempo em que destacou uma heterogeneidade de desempenho significativa e falhas de raciocínio compartilhadas entre todos os sistemas.

Alon Moore Galindo, Amit Ginsberg, Razan Saadi, Tomer Kerman, David Schwartzman, Anat Loewenstein, Igal Leibovitch2026-07-08
💻 computer science

Proximal Policy Optimization-Based Intrusion Detection with Deep Latent Feature Learning

Este artigo propõe um novo framework de detecção de intrusão que combina um autoencoder empilhado de dois estágios para extração de características profundas com um agente de aprendizado por reforço profundo baseado em Otimização de Política Próxima, demonstrando desempenho e eficiência competitivos através de múltiplos conjuntos de dados de referência.

Brahim El malki, Nidal Nasser, Ahmed El Ouadrhiri, Khalid EL FAZAZY, Hamid Tairi, Jamal Riffi2026-07-08
💻 computer science

A confidence-convergence decision layer for reliability-aware sequential recognition under limited observations

Este artigo propõe um método de reconhecimento sequencial baseado em confiança-convergência para alvos móveis subaquáticos que atualiza dinamicamente a confiança do tipo de comportamento e aceita decisões apenas quando a dominância, a estabilidade temporal e a separação entre classes são conjuntamente satisfeitas, melhorando significativamente a precisão e reduzindo erros sob observações limitadas e incertas em comparação com as linhas de base existentes.

Guangyu Luo2026-07-08
💻 computer science

HiRoC: Selective History Routing and Disagreement-Aware Calibration for Multimodal Conversational Emotion Recognition

O artigo propõe o HiRoC, um framework de reconhecimento de emoções multimodal que aumenta a precisão da predição ao rotear seletivamente o histórico conversacional relevante através de grafos tipados por falante e calibrar decisões usando o desacordo intermodal para abordar limitações em métodos baseados em grafos existentes.

Gong Li, Huiqiang Guo, Mengdi Liu, Ziyin Wei, Bowen Gu, Tiquan Gu, Dan Ma2026-07-08
💻 computer science

Automated Loop Detection and Iteration Count Analysis in Binary Code

Este artigo apresenta um método automatizado e escalável que combina análise estática interprocedural com rastreamento de fluxo de controle e dependência de dados para detectar com precisão loops naturais e determinar suas contagens de iteração em código binário otimizado, alcançando alta precisão e escalabilidade em softwares reais e suítes de benchmarks.

Hayk Aslanyan, Garnik Khroyan, Shake Hakobyan, Hripsime Hovhannisyan2026-07-08
💻 computer science

From Head Yaw to HMD Pose: A Reproducible Benchmark of Subjective VR Outcome Recoverability

Este artigo estabelece um benchmark reprodutível demonstrando que, embora os dados completos de pose do HMD possam modelar eficazmente certos resultados subjetivos de RV, como a presença espacial, eles servem melhor como um sinal comportamental complementar aos questionários tradicionais em vez de um substituto completo, com a recuperabilidade variando significativamente entre diferentes construtos, tais como usabilidade, carga de trabalho e enjoo de movimento (cybersickness).

Fabiana Peres, Leonardo Brito, João Marcelo Teixeira, Fatima Nunes2026-07-08
💻 computer science

A Cost-Sensitive and Explainable Evaluation Framework for Chronic Kidney Disease Prediction Models

Este artigo propõe uma estrutura de avaliação sensível ao custo e explicável para a predição de Doença Renal Crônica que demonstra como a otimização dos limiares de decisão e a priorização da prevenção de falsos negativos, juntamente com a análise de interpretabilidade que confirma a plausibilidade clínica, aumenta a adequação de modelos de aprendizado de máquina para o suporte à decisão clínica.

Kayla DaCosta2026-07-08
💻 computer science

A Queryable Knowledge Graph of MITRE ATLAS: Cross-Linking Adversarial AI Taxonomies for Grounded Threat Reasoning

Este artigo apresenta um grafo de conhecimento baseado em Neo4j que transforma a documentação estática do MITRE ATLAS em um sistema consultável e fundamentado em LLM, interconectado com o OWASP Top 10 para Aplicações de LLM, permitindo que profissionais realizem o raciocínio de ameaças, identifiquem 40 técnicas de IA generativa não mitigadas e demonstrem a natureza ortogonal das táticas do ATLAS e das categorias de risco do OWASP.

Salwa MAKNI2026-07-08
💻 computer science

Security-Aware Semantic Validation Framework (SSVF): An Execution-Aware Semantic Computing Approach for Intelligent Relational Database Security

Este artigo propõe o Security-Aware Semantic Validation Framework (SSVF), uma nova abordagem consciente da execução que transforma planos de execução de banco de dados em conhecimento semântico estruturado para detectar ataques sofisticados de injeção de SQL e aumentar a segurança de bancos de dados relacionais por meio de validação inteligente e explicável.

Kwame Addo-Buahing2026-07-08
💻 computer science

PromptSentinel: When Safe Isn't Safe, Distribution Mismatch in Prompt Safety Classification

Este artigo demonstra que classificadores de segurança de prompts treinados em benchmarks sintéticos sofrem de um descompasso de distribuição significativo quando aplicados a entradas escritas por humanos, levando a uma queda substancial no recall e a um aumento acentuado de falsos positivos que não pode ser resolvido simplesmente aumentando a complexidade do modelo.

Leesha Mogha2026-07-08