See the Text: From Tokenization to Visual Reading
تقدم الورقة البحثية SeeTok، وهو نهج متمحور حول الرؤية يقوم بتصوير النصوص كصور لتقوم النماذج اللغوية الكبيرة متعددة الوسائط بتفسيرها، مما يستبدل بفعالية عملية تقسيم الكلمات إلى وحدات فرعية (subword tokenization) لتحقيق كفاءة حوسبية كبيرة، وتحسين المتانة تجاه الضجيج الطباعي، وتحقيق تعميم أفضل عبر اللغات من خلال محاكاة القراءة البصرية البشرية.