Diffusion Policy
سياسة الانتشار
أسلوب في التعلم بالتقليد الروبوتي يمثّل سياسة العميل بنموذج انتشار مشروط، فيتعلم توليد مسارات الأفعال بإزالة التشويش المتدرّج، مما يتعامل جيداً مع الأفعال متعدّدة الأنماط والأفق الزمني الطويل.
A robotic imitation learning approach that represents the agent's policy as a conditional diffusion model, generating action trajectories via iterative denoising and handling multi-modal, long-horizon action distributions well.
Also translated asDiffusion Policy، سياسات الانتشار، سياسة القيادة الانتشارية