💻 computer science

Navigating the Prompt Space: Improving LLM Classification of Social Science Texts Through Prompt Engineering

Dit artikel toont aan dat hoewel het systematisch variëren van elementen in prompt engineering, zoals labelbeschrijvingen, instructieve nudges en few-shot voorbeelden, de nauwkeurigheid van LLM-classificatie voor sociaalwetenschappelijke teksten aanzienlijk kan verbeteren, de prestatiewinst vaak marginaal is bij minimale toenames in context, soms kan afnemen bij overmatige context, en aanzienlijk varieert tussen modellen en taken, wat individuele validatie noodzakelijk maakt in plaats van het vertrouwen op algemene regels.

Erkan Gunes, Christoffer Florczak, Tevfik Murat Yildirim2026-07-10
💻 computer science

An Intelligent YOLO26-Based Early Warning Framework for Drone Detection in Critical Infrastructure Surveillance

Dit artikel stelt een intelligent, realtime framework voor voor de detectie en vroege waarschuwing van drones voor de bewaking van kritieke infrastructuur met behulp van het YOLO26 deep learning-model, dat is getraind op een aangepaste database met meerdere scenario's en is geëvalueerd tegen baseline-modellen om een superieure nauwkeurigheid en snelheid aan te tonen bij het identificeren van kleine, verre en uitdagende drone-doelwitten.

Younis Arrabi2026-07-10✓ Author reviewed
💻 computer science

Tamarin (HSQ): Reversible Hierarchical KV-Cache Compression for LLM Inference

Tamarin (HSQ) introduceert een reversibel, drielaags hiërarchisch KV-cache compressieschema dat tokens routeert naar een focale laag, geleerde samenvattingsvectoren en een CPU-gebaseerd archief om een 12–28× reductie van het GPU-geheugen te bereiken voor long-context LLM-inferentie, terwijl de perplexiteit en de nauwkeurigheid van de retrieval nagenoeg gelijk blijven aan de baseline.

Alikhan Bazakov, Kirill Kiselev2026-07-10
💻 computer science

A Graded Autonomy Framework for Governing Agentic AI in Health Care

Dit artikel stelt een raamwerk voor met gegradeerde autonomie, aangepast van de automotive J3016-standaard, om agentische AI in de gezondheidszorg te reguleren door systemen over drie domeinen en zes niveaus te classificeren om capaciteit van autorisatie te scheiden, waardoor veiligheidstekorten in huidige evaluatiemetrieken worden geadresseerd via een uitgewerkt voorbeeld van autonoom sepsisbeheer.

Sing Chee Tan, Vlada Rozova, Rebecca Jessup, Daniel Capurro2026-07-10
💻 computer science

Adaptive-Hazard Bayesian Online Change-Point Detection for Text Streams: A Dirichlet-Multinomial Formulation

Dit artikel stelt een adaptieve-hazard Bayesiaanse online veranderpuntdetectiemethode voor voor tekststromen die reset-waarschijnlijkheden dynamisch aanpast op basis van drift in de lexicale distributie via een Dirichlet-multinomiale formulering, waarbij verbeterde detectieprestaties en verminderde vertraging worden aangetoond, met name in scenario's die gepaard gaan met geleidelijke of zwakke lexicale veranderingen.

Muhammad Ali Gunawan, Amalia Fitri2026-07-10
💻 computer science

Large scale IoT Intrusion Detection using Isolation Forest and Mutual Information based Feature Selection

Dit artikel toont aan dat een Isolation Forest-algoritme gecombineerd met op Mutual Information gebaseerde feature selectie beter presteert dan Autoencoder- en Ensemble-methoden bij grootschalige IoT-intrusiedetectie door een superieure nauwkeurigheid, F1-score en AUC te bereiken, terwijl een lagere computationele complexiteit wordt behouden op de NF-ToN-IoT-v3 dataset.

siddharth Ghansela2026-07-10
💻 computer science

Temporal Multi-Signal Fusion for Token-Level Hallucination Detection

Dit artikel stelt een temporele multi-signaal fusie-aanpak voor die hallucinatie behandelt als een sequentie-labeleringsprobleem met behulp van een BiGRU om tekststatistieken, NLI-implicatie en taalmodel-surprisal te combineren, waarbij een significante AUC-verbetering van 0,840 op RAGTruth wordt bereikt door gebruik te maken van temporele context in plaats van modelcapaciteit, terwijl de effectiviteit op closed-source en ongeziene modellen behouden blijft.

Igor Itkin2026-07-10