اقرأ الأوراق التي بَنَت الذكاء الاصطناعي. بالترتيب. بالعربية والإنجليزية.

404 ورقة · 17632025 · كل فكرة تلمسها بيدك

اختر نجمة1990200020102020الأسس26 ورقةتعلم الآلة الكلاسيكي48 ورقةالشبكات العصبية35 ورقةاللغة64 ورقةالإدراك والتوليد87 ورقةالوكلاء والتحكم41 ورقةالأنظمة والتوسّع7 ورقةالعقول والحياة2 ورقةالسلامة والفلسفة9 ورقةمهندس ذكاء اصطناعي

404 ورقة، 17632025، سماء واحدة متصلة.

DeepSeek-R1: تحفيز قدرات الاستدلال في النماذج اللغوية الكبيرة عبر التعلم المعزز · 2025

تخيّل طالبًا لا يحصل على حلول جاهزة من معلّمه، بل يسمع فقط «صح» أو «خطأ» بعد كل محاولة. بعد آلاف المحاولات يبتكر حيلَه الخاصة: يتوقف ليراجع إجابته، يُغيّر طريقته حين يصل لطريق مسدود، بل يبدأ يُحدّث نفسه أثناء الخطوات الصعبة. هذا بالضبط ما يفعله DeepSeek-R1 — يتعلّم الاستدلال لا بتقليد البشر، بل بالتجربة والخطأ عبر التعلم المعزز.

اقرأ الورقة كاملة ←
افتح في المختبر
قارن بين المسار التقليدي (ضبط دقيق ثم RLHF) ونهج DeepSeek بالتعلم المعزز الخالص. انقر على كل مرحلة لترى الفرق.
تستيقظ التجربة عند وصولك…

كل ورقة: الفكرة بكلمات بسيطة، وحدسٌ تلمسه بيدك، وكودٌ مجرّد إلى جوهره.