💻 computer science

From Prompt to Production: A Case Study of Human-AI Collaborative Software Development Using Claude Code Multi-Agent Orchestration

本論文は、Claude Codeのマルチエージェント・オーケストレーションを用いたプロダクショングレードの医療プラットフォーム開発に関する包括的なケーススタディを提示し、人間とAIのコンピテンシー・フレームワークを確立し、異なるAI構成におけるパフォーマンス向上を定量化し、生産性を高めつつコストを削減するためのトークン最適化戦略を提案するものである。

Pham Thi Thuong, Nguyen Dang Quang, Ngo Thi Lan Phuong2026-07-07
💻 computer science

Prevalence Shift and ICU Mortality Miscalibration Across Institutions

本論文は、病院レベルの有病率の不一致が、施設間をまたぐICU死亡率モデルにおける較正失敗の支配的かつ定量化可能な原因であることを示し、現地の死亡率のみを用いた単純なベイズ補正によって、ラベル付きのターゲットデータ(正解データ)を必要とせずに、効果的に較正を回復できることを示している。

Aman Chandra H, Stuti Shivhare, Suyash Sahu2026-07-07
💻 computer science

Where Reasoning Breaks Under Compression: A Layer-Localized Quantization Autopsy with Three Foundation-Model Case Studies

本論文は、基盤モデルにおける推論能力がアーキテクチャによって異なる層固有の脆弱性パターンを示すことを実証しており、高ビット幅では一様な量子化で十分である一方で、層ごとに局在化した脆弱性マップに導かれた混合精度戦略を用いることで、性能を損なうことなく4ビット未満への大幅な圧縮が可能になることを明らかにしている。

Prof. Ayman Elnashar2026-07-07
💻 computer science

A Safety Envelope for Foundation-Model Dental Diagnosis: Bounded-Deviation Guarantees and Cross-Center Refusal

本論文は、凍結された基盤モデルを包み込み、証明可能な予測偏差の境界、較正された信頼度、および堅牢な分布外データの拒絶を提供することで、多様な施設やアーキテクチャにわたる臨床的な歯科診断に必要な信頼性を保証する、軽量でバックボーンに依存しないセーフティ・エンベロープ(安全領域)を導入するものである。

Prof. Ayman Elnashar, Norsin Elnashar, Prof. Ahmed Elemam2026-07-07
💻 computer science

VozConsultAI: A Provider-Agnostic Architecture and a Clinically Grounded Evaluation of Open-Weight Large Language Models for SOAP Note Extraction in Brazilian Portuguese Telehealth

本論文は、ブラジル・ポルトガル語による遠隔診療におけるSOAPノート自動生成のためのプロバイダーに依存しないマイクロサービスアーキテクチャであるVozConsultAIを紹介し、安全性を優先しハルシネーション(幻覚)にペナルティを課す、臨床的根拠に基づいた新しい評価指標を用いて、オープンウェイトの大規模言語モデルの初の比較ベンチマークを提示するものである。

Nilton Gomes Furtado, Julia Vasconcelos Furtado2026-07-07
💻 computer science

Learning Human-Aligned Explanations: AMeta-Model Approach to Combining XAIMethods for Arabic Sentiment Analysis

本論文は、複数のXAI手法を組み合わせて、アラビア語の感情分析に対してより妥当で人間と整合した説明を生成する、人間による監視を伴うメタモデルフレームワークを提案しており、従来のアンサンブル手法と比較して忠実度を一部犠牲にしているものの、CatBoostにおいて0.84という大幅なF1スコアの向上を実現している。

Youssef Chafiqui, Houda Anoun2026-07-07
💻 computer science

AM-RAF: An Agentic, Retrieval-Augmented, Uncertainty-Gated Framework for Trustworthy Clinical Decision Support in Resource-Constrained Health Systems 

本論文は、リソースの制約がある保健システムにおける接続性と公平性の課題に特化して設計された、信頼性が高くプライバシーを保護する臨床意思決定支援システムを構築するために、エージェンティックな推論、検索拡張生成、および不確実性に基づいたゲート付き保留機能を統合した概念的な6層アーキテクチャであるAM-RAFを提案する。

Md. Maruf Sharker Munna2026-07-07
💻 computer science

Three Axes of Quantum Risk: A Unified Observability Model for PQC, QKD, and Crypto-Agility

本論文は、現在の単一軸のディスカバリーツールの限界に対処するため、アルゴリズム耐性、チャネル保護、およびクリプト・アジリティに基づいて資産を評価する、量子リスクのための統一された三軸オブザーバビリティモデルを導入し、オープンソースの実装(Sezar)と、TLS、QKD、およびアジリティのシナリオにわたる実証的な検証によってこれを裏付けている。

Aleaddin Ozer, Murat Aydos2026-07-07
💻 computer science

Dynamic Task Offloading in Vehicular Edge Networks: A Mobility-Driven A3C-Based Framework

本論文は、動的な車両環境において信頼性を確保しつつ、遅延とエネルギーオーバーヘッドを効果的に最小化するために、非同期アドバンテージ・アクター・クリティック(A3C)深層強化学習アルゴリズムを利用してスケジューリング決定を最適化する、車両エッジコンピューティングのためのモビリティ駆動型タスクオフローディングフレームワークを提案する。

Manoj Kumar Somesula2026-07-07
💻 computer science

Selecting Performance-Representative Validation Sets for Developing Medical Image Segmentation Neural Networks

本論文は、限られた医療画像データから、性能を代表する小規模な検証セットを選択するための新しい手法を提案しており、前立腺癌MRIセグメンテーションタスクを通じて、このアプローチが従来のランダムな分割よりも真の独立した結果に著しく近い性能推定値をもたらすことを示している。

Xiangcen Wu, Wen Yan, Weixi Yi, Ester Bonmati, Yipeng Hu2026-07-07