AXIOM: A Trust-First Neuro-Symbolic Execution Architecture for Verifiable Mathematical Reasoning
本論文は、自然言語による問題を決定論的な計算代数システム(Computer-Algebra-System)のパイプラインへと正規化するために言語モデルをのみ活用する、信頼性重視のニューロ・シンボリック・アーキテクチャであるAXIOMを紹介しており、これは数学的ベンチマークにおいて94.36%の正確性と100%の信頼性(確信を持った誤りがゼロ)を達成しつつ、システムの改善によって以前に検証された結果が退行しないことを保証している。