صياغة متسلسلة و متجددة لأبحاث الذكاء الاصطناعي.

تتبّع أهم الأوراق، افهم الأفكار التي غيّرت المجال، ثم جرّبها بنفسك — بأسلوب عربي معاصر.

408 ورقة · 1763–2025 · كل فكرة تلمسها بيدك

اختر نجمة1990200020102020الأسس29 ورقةتعلم الآلة الكلاسيكي48 ورقةالشبكات العصبية45 ورقةاللغة72 ورقةالإدراك والتوليد97 ورقةالوكلاء والتحكم52 ورقةالأنظمة والتوسّع16 ورقةالعقول والحياة4 ورقةالسلامة والفلسفة8 ورقة✦ مهندس ذكاء اصطناعي

408 ورقة، 1763–2025، سماء واحدة متصلة.

قادتك النجوم إلى هذا البحث

DeepSeek-R1: تحفيز قدرات الاستدلال في النماذج اللغوية الكبيرة عبر التعلم المعزز · 2025

تخيّل طالبًا لا يحصل على حلول جاهزة من معلّمه، بل يسمع فقط «صح» أو «خطأ» بعد كل محاولة. بعد آلاف المحاولات يبتكر حيلَه الخاصة: يتوقف ليراجع إجابته، يُغيّر طريقته حين يصل لطريق مسدود، بل يبدأ يُحدّث نفسه أثناء الخطوات الصعبة. هذا بالضبط ما يفعله DeepSeek-R1 — يتعلّم الاستدلال لا بتقليد البشر، بل بالتجربة والخطأ عبر التعلم المعزز.

اقرأ الورقة كاملة ←
افتح في المختبر
قارن بين المسار التقليدي (ضبط دقيق ثم RLHF) ونهج DeepSeek بالتعلم المعزز الخالص. انقر على كل مرحلة لترى الفرق.
تستيقظ التجربة عند وصولك…

لكل بحث: الفكرة ببساطة, تطبيقها العملي و علاقتها بالأبحاث السابقة و اللاحقة.