📡 أحدث عدد

شو في AI؟ | 22 يونيو

يومي 📅 2026-06-22
مرحبا 👋
جبتلكم اليوم أبرز الأبحاث، وكمان عملت صفحة جديدة «الـ AI للكل» فيها أدوات واستخدامات عملية للجميع 🧰
جرّبوها وابعتولي اقتراحاتكم 💛
📘 مصطلحات هذا العدد 14
💡 مفاهيم 8
knowledge distillation
عملية بتاخد معلومات نموذج ذكي كبير وتحطها في نموذج أصغر بدون ما تفقد الكتير من الجودة، أشبه بتلخيص كتاب سميك في نسخة مختصرة. بدنا هالشي عشان النماذج الصغيرة بتركض أسرع وتستهلك طاقة أقل.
KV cache
تقنية بتخزّن المفاتيح والقيم اللي حسبناها قبل هيك عشان نستخدمها مرة ثانية. بنستخدمها عشان نسرّع الذكاء الاصطناعي ونقلل الحسابات المكررة.
softmax attention
هاد إشي رياضي بيحسب قد إيش كل كلمة في الجملة مهمة بالنسبة للكلمات الثانية، وبنسمع عنه لأنه القلب اللي شغّال جوا كل نماذج الـ Transformer من GPT لـ BERT وغيرهم.
visually grounded thinking
يعني لما النموذج بيفكر بمسألة وبيستند على إشي بشوفه بالصورة مش بس على الكلام، وبنسمع عنه لأنه بيخلي الـ VLMs أذكى وأدق لما بتحل مسائل تحتاج فهم بصري حقيقي.
reinforcement learning
تعليم الذكاء الاصطناعي من خلال نظام الحوافز والعقوبات، زي لما تعلمي طفل بالمكافأة والعقاب عشان يتعلم السلوك الصحيح. بنستخدمه عشان الآلة تتعلم تاخذ قرارات ذكية بنفسها من غير ما نحطّ كل إجابة جاهزة.
ROPD
مش قادرة أتأكد من هاد المصطلح بشكل دقيق، يمكن يكون اختصار لطريقة خاصة في معالجة البيانات أو اكتشاف الأنماط. لو عندك سياق أكتر نقدر نشرحه صح.
streaming inference
يعني النموذج بيطلع النتيجة شوي شوي وأنت لسا بتحكيله، مش بينتظر تخلص ويطلع الجواب دفعة وحدة، وبنسمع عنه لأنه بيخلي التجربة أسرع وأحسن للمستخدم زي ما بنشوف في ChatGPT لما الكلام بيجي حرف حرف.
token compression
يعني بنضغط ونقلل عدد القطع اللي النموذج لازم يشتغل عليها عشان يوفر وقت وذاكرة، وبنسمع عنه لأن الصور والفيديو بتولّد tokens كتير جداً وبدنا نخفف الحمل على النموذج بدون ما نخسر الدقة.
🤖 موديلز 5
Gated DeltaNet (GDN)
هاد نوع من نماذج الذكاء الاصطناعي بيستخدم آلية 'بوابات' عشان يتحكم بشو المعلومات يحتفظ فيها وشو ينسى، وبنسمع عنه لأنه بيحاول يكون أسرع وأكفأ من نماذج الـ Transformer التقليدية خصوصاً مع النصوص الطويلة.
VLMs
هاي نماذج بتفهم الصور والنصوص مع بعض يعني بتقدر تحكيلها 'شو في بالصورة هاي؟' وتجاوبك، وبنسمع عنها لأنها صارت أساس كتير تطبيقات ذكاء اصطناعي بتجمع بين الرؤية واللغة.
SAM3
هاد نموذج متخصص في تقطيع الأشياء داخل الفيديو يعني بيحدد حدود كل إشي بكل فريم، وبنسمع عنه لأنه تطور على الـ SAM الأصلي من Meta عشان يشتغل مع الفيديو مش بس الصور.
autoregressive model
هو نموذج بيتعلم يولّد الإشي خطوة خطوة، كل خطوة بتعتمد على اللي قبلها، زي ما بنحكي كلمة كلمة. بنسمع عنه كتير لأنه الأساس اللي بنيت عليه نماذج اللغة الكبيرة زي GPT.
Diffusion Transformer (DiT)
هاد نموذج لتوليد الصور والفيديو بيجمع تقنية الـ Diffusion مع بنية الـ Transformer، وبنسمع عنه لأنه الأساس اللي بنيت عليه أقوى نماذج توليد الصور زي FLUX وSora.
📏 مقاييس 1
FPS
هو مقياس بيقيسلنا كم فريم أو صورة بيعالجها النموذج في الثانية الوحدة. بنحتاجه عشان نعرف هل النموذج سريع كفاية للشغل الفوري زي الفيديو والسيارات ذاتية القيادة.
كل المصطلحات ←
العدد السابقشو في AI؟ | 21 يونيو — تقييم برمجة متعدد لغات وتوليد صوت
📚 كل الأعداد