DeepMind نے 7,500 مصنوعی کلپس کو 14 بلین پیرامیٹر والے ملٹی ٹاسک ویژن ماڈل میں تبدیل کر دیا ہے
علی بابا کے Wan2.1 آرکیٹیکچر پر مبنی یہ ماڈل، بلینڈر (Blender) کے ایک چھوٹے سے رینڈر شدہ ڈیٹا سیٹ سے گہرائی (depth)، نارملز، سیگمنٹیشن اور 3D پوز سیکھتا ہے، جو ماہرانہ سسٹمز کے برابر یا ان سے بہتر کارکردگی دکھاتا ہے، جبکہ اسے ٹریننگ کے لیے بہت ہی کم ڈیٹا کی ضرورت ہوتی ہے۔