Large Language Model as Token Compressor and Decompressor
تقدم هذه الورقة إطار عمل ترميز تلقائي ذاتي التعبير يقوم بضبط نموذج لغوي كبير مُدرب مسبقاً لضغط النصوص الطويلة إلى رموز كامنة منفصلة مدمجة ومتكيفة مع المحتوى (Z-tokens) وإعادة بنائها بدقة، مما يحقق تقليلاً في عدد الرموز يصل إلى 18 ضعفاً مع الحفاظ على الدقة وتمكين الاستنتاج الفعال للسياقات الطويلة.