cs 件の論文 | Gist.Science

ABD: Default Exception Abduction in Finite First Order Worlds

この論文は、有限一階世界におけるデフォルトと例外の帰納推論（ABD）を評価する新しいベンチマークを提案し、SMT 検証を用いた厳密な評価を通じて、最先端の LLM が妥当性は高いものの例外のスパース性（簡潔性）において課題を抱え、観察 regimes によって異なる一般化の失敗モードを示すことを明らかにしています。

Serafim Batzoglou2026-03-10✓ Author reviewed ⓘ💻 cs

Open-Vocabulary Domain Generalization in Urban-Scene Segmentation

この論文は、都市環境セグメンテーションにおける既知のドメインとカテゴリの両方を扱えない既存の課題を解決するため、新しい設定「OVDG-SS」とそのためのベンチマークを提案し、ドメインシフトによるテキスト - 画像相関の歪みを状態空間ベースの手法「S2-Corr」で補正することで、未知の環境とカテゴリに対するロバストなセグメンテーションを実現する手法を提示しています。

Dong Zhao, Qi Zang, Nan Pu, Wenjing Li, Nicu Sebe, Zhun Zhong2026-03-10💻 cs

INDUCTION: Finite-Structure Concept Synthesis in First-Order Logic

この論文は、拡張的にラベル付けされたターゲット述語を説明する単一の第一階述語論理式を生成するタスクとして、有限構造概念合成のためのベンチマーク「INDUCTION」を提案し、モデルの推論能力と汎化特性を評価する結果を報告しています。

Serafim Batzoglou2026-03-10💻 cs

SKYLIGHT: A Scalable Hundred-Channel 3D Photonic In-Memory Tensor Core Architecture for Real-time AI Inference

本論文は、3D 集積化された波長多重・信号蓄積・不揮発性メモリ技術により、従来の電子回路や既存のフォトニックアーキテクチャの限界を克服し、リアルタイム AI 推論および局所学習を可能にする高スループット・高効率な大規模フォトニックメモリ内演算コア「SKYLIGHT」を提案し、その実用性と堅牢性を示したものである。

Meng Zhang, Ziang Yin, Nicholas Gangi, Alexander Chen, Brett Bamfo, Tianle Xu, Jiaqi Gu, Zhaoran Rena Huang2026-03-10💻 cs

Universal 3D Shape Matching via Coarse-to-Fine Language Guidance

この論文は、事前の形状仮定やカテゴリ制限なしに、大規模言語モデルによるセマンティックな粗い対応付けとランクベースの対照学習を組み合わせた「UniMatch」というフレームワークを提案し、非等長な異種オブジェクト間の密な対応付けを可能にする手法を提示しています。

Qinfeng Xiao, Guofeng Mei, Bo Yang, Liying Zhang, Jian Zhang, Kit-lun Yick2026-03-10💻 cs

Why iCloud Fails: The Category Mistake of Cloud Synchronization

本論文は、iCloud が分散因果グラフを線形時系列に投影するというカテゴリーの誤りに起因し、Time Machine や Git などの開発ワークフローと根本的に互換性がなく、Open Atomic Ethernet のトランザクション意味論による物理的現実との整合性が解決策であると論じています。

Paul Borrill2026-03-10💻 cs

InfScene-SR: Arbitrary-Size Image Super-Resolution via Iterative Joint-Denoising

本論文は、拡散モデルの計算コストとメモリ制約を克服し、可変サイズの画像に対して境界アーティファクトを排除した高品質な超解像を実現するために、重なり合うパッチ間での結合デノイジングを効率的に実行する「InfScene-SR」という手法を提案するものである。

Shoukun Sun, Zhe Wang, Xiang Que, Jiyin Zhang, Xiaogang Ma2026-03-10💻 cs

Object-Scene-Camera Decomposition and Recomposition for Data-Efficient Monocular 3D Object Detection

本論文は、単眼 3D 物体検出のデータ効率を向上させるため、画像から物体・背景・カメラ姿勢を分解し、これらを動的に再構成して多様な合成訓練データを生成するオンライン手法を提案し、KITTI および Waymo データセットにおいて複数のモデルで有効性を検証したものである。

Zhaonian Kuang, Rui Ding, Meng Yang + 2 more2026-03-10💻 cs

Cycle-Consistent Tuning for Layered Image Decomposition

本論文は、拡散モデルの軽量微調整とサイクル整合性に基づく双方向学習、および自己改善プロセスを導入することで、ロゴと背景の複雑な相互作用を高精度に分解・再構成する汎用的な画像層分解フレームワークを提案するものです。

Zheng Gu, Min Lu, Zhida Sun, Dani Lischinski, Daniel Cohen-Or, Hui Huang2026-03-10💻 cs

See It, Say It, Sorted: An Iterative Training-Free Framework for Visually-Grounded Multimodal Reasoning in LVLMs

この論文は、強化学習を必要とせず、推論の各段階で視覚的証拠を動的に抽出・統合して多モーダル推論を反復的に補正する、軽量かつトレーニングフリーのプラグアンドプレイ型フレームワーク「See It, Say It, Sorted」を提案し、大規模視覚言語モデルの視覚的ハルシネーションを大幅に低減しながら推論精度を向上させることを実証しています。

Yongchang Zhang, Oliver Ma, Tianyi Liu, Guangquan Zhou, Yang Chen2026-03-10💻 cs

ARLArena: A Unified Framework for Stable Agentic Reinforcement Learning

本論文では、不安定な学習が課題である自律型強化学習（ARL）の安定性を制御された環境で分析するフレームワーク「ARLArena」を提案し、その知見に基づいて安定した学習を実現する手法「SAMPO」を開発し、多様なタスクで安定した学習と高い性能を達成することを示しています。

Xiaoxuan Wang, Han Zhang, Haixin Wang, Yidan Shi, Ruoyan Li, Kaiqiao Han, Chenyi Tong, Haoran Deng, Renliang Sun, Alexander Taylor, Yanqiao Zhu, Jason Cong, Yizhou Sun, Wei Wang2026-03-10💻 cs

Tokenizing Semantic Segmentation with RLE

この論文は、セグメンテーションマスクをランレングス符号化（RLE）で離散化し、言語モデルによる自己回帰生成を通じて画像および動画のセマンティックセグメンテーションとパン옵ティックセグメンテーションを統一的に実現する新しい手法を提案し、限られた計算資源下でも最先端の性能を達成できることを示しています。

Abhineet Singh, Justin Rozeboom, Nilanjan Ray2026-03-10💻 cs

EmoOmni: Bridging Emotional Understanding and Expression in Omni-Modal LLMs

本論文は、オムニモーダル大規模言語モデルにおける感情理解と表現の課題を解決するため、微細なマルチモーダル知覚からテキスト応答への推論を強制する「感情的チェーン・オブ・スーグト（E-CoT）」を導入し、実世界データと評価ベンチマークを構築した統合フレームワーク「EmoOmni」を提案するものである。

Wenjie Tian, Zhixian Zhao, Jingbin Hu, Huakang Chen, Haohe Liu, Binshen Mu, Lei Xie2026-03-10💻 cs

CryoNet.Refine: A One-step Diffusion Model for Rapid Refinement of Structural Models with Cryo-EM Density Map Restraints

本論文は、従来の手法に比べて計算コストが低く手動調整が不要な、Cryo-EM 密度マップ制約を組み込んだワンステップ拡散モデル「CryoNet.Refine」を開発し、タンパク質複合体や DNA/RNA-タンパク質複合体の構造精密化を大幅に高速化・自動化する手法を提案しています。

Fuyao Huang, Xiaozhu Yu, Kui Xu, Qiangfeng Cliff Zhang2026-03-10💻 cs

Vibe Researching as Wolf Coming: Can AI Agents with Skills Replace or Augment Social Scientists?

この論文は、AI エージェントが研究の速度や網羅性を向上させる一方で理論的独創性には限界があるとし、認知タスクの特性に基づいて「Vibe Researching」の概念を提唱し、社会科学における人間の役割と教育のあり方について考察しています。

Yongjun Zhang2026-03-10💻 cs

Decomposing Physician Disagreement in HealthBench

HealthBench における医師間の評価不一致の大部分は構造的な要因に起因するものの、文脈欠如や曖昧な表現といった「解消可能な不確実性」が不一致を有意に増大させる一方、本質的な医学的曖昧さは影響を与えないという見解から、評価シナリオにおける情報ギャップの解消が合意率向上への具体的な改善策となり得ると結論付けています。

Satya Borgohain, Roy Mariathas2026-03-10💻 cs

WISER: Wider Search, Deeper Thinking, and Adaptive Fusion for Training-Free Zero-Shot Composed Image Retrieval

この論文は、ゼロショット合成画像検索（ZS-CIR）において、テキストから画像（T2I）と画像から画像（I2I）の両方の利点を「検索・検証・洗練」というパイプラインで動的に統合し、トレーニング不要で既存の手法を大幅に上回る性能を実現するフレームワーク「WISER」を提案するものです。

Tianyue Wang, Leigang Qu, Tianyu Yang, Xiangzhao Hao, Yifan Xu, Haiyun Guo, Jinqiao Wang2026-03-10💻 cs

PackUV: Packed Gaussian UV Maps for 4D Volumetric Video

本論文は、従来のガウススプラッティング手法が抱える長期シーケンスや大規模運動への対応困難、および既存の動画コーデックとの非互換性を解決するため、ガウス属性を構造化された UV アトラスに変換し標準動画コーデックと互換性のある効率的な 4 次元 volumetric video 表現「PackUV」とその最適化手法「PackUV-GS」を提案し、大規模データセット「PackUV-2B」を用いた実験で高品質かつ長期にわたるレンダリングの成功を実証したものである。

Aashish Rai, Angela Xing, Anushka Agarwal, Xiaoyan Cong, Zekun Li, Tao Lu, Aayush Prakash, Srinath Sridhar2026-03-10💻 cs

On Sample-Efficient Generalized Planning via Learned Transition Models

本論文は、Transformer ベースの直接行動予測アプローチの限界を克服し、学習された遷移モデルを用いて中間状態を予測する手法を提案することで、より少ないデータと小規模なモデルで分布外汎化性能を向上させることを実証したものである。

Nitin Gupta, Vishal Pallagani, John A. Aydin, Biplav Srivastava2026-03-10💻 cs

Annotation-Free Visual Reasoning for High-Resolution Large Multimodal Models via Reinforcement Learning

この論文は、高価なアノテーションを必要とせず、強化学習に基づく AP-GRPO 手法を用いて大規模マルチモーダルモデルが高解像度画像の重要な領域を自律的に特定・検証し、推論性能を向上させる「HART」というフレームワークを提案するものです。

Jiacheng Yang, Anqi Chen, Yunkai Dang, Qi Fan, Cong Wang, Wenbin Li, Feng Miao, Yang Gao2026-03-10💻 cs

← 前へ次へ →