Reasoning Is Not Free: Robust Adaptive Cost-Efficient Routing for LLM-as-a-Judge
यह शोध पत्र RACER को प्रस्तुत करता है, जो एक वितरण रूप से सुदृढ़ अनुकूलन (distributionally robust optimization) समस्या को हल करके एक निश्चित बजट के तहत रीजनिंग और नॉन-रीजनिंग LLM जजों के बीच गतिशील रूप से चयन करने वाला एक सुदृढ़ अनुकूली रूटिंग ढांचा है, जिससे वितरण बदलावों (distribution shifts) को ध्यान में रखते हुए बेहतर सटीकता-लागत संतुलन प्राप्त होता है।