Daedalus-150M: A Convolution-Attention Hybrid Designed for CPU Inference
يُعد Daedalus-150M نموذجاً لغوياً صغيراً صُممت بنيته خصيصاً للاستنتاج الفعال على المعالجات المركزية (CPU) عبر استبدال ثلثي طبقات الانتباه بلفافات ثابتة العرض، مما يحقق سرعة وضغطاً فائقين في السياقات الطويلة مع التفوق على نماذج أكبر وأكثر كثافة في البيانات تم تدريبها على عدد أكبر بكثير من الرموز (tokens).