شنگھائی / عالمی ٹیک ڈیسک — پیر 22 ستمبر 2026 کی تازہ ترین اے آئی رپورٹس کے مطابق چینی روبوٹکس اسٹارٹ اپ Light Origins نے 21 ستمبر کو اپنا ماڈل Light-O1 پیش کیا۔ دعویٰ یہ ہے کہ انٹرنیٹ پر دستیاب انسانی ویڈیو سے ‘‘پورے جسم کی ذہانت’’ کی بنیاد رکھی جا سکتی ہے، پھر اسے الگ الگ روبوٹ جسموں پر ڈھالا جا سکتا ہے۔ Runtime Wire نے کمپنی کے ایکس تھریڈ اور تکنیکی رپورٹ کے حوالے سے تفصیل شائع کی۔
مسئلہ کیا ہے؟
روبوٹ سیکھنے کی سب سے مہنگی رکاوٹ حقیقی ہارڈویئر پر ڈیٹا جمع کرنا ہے۔ Light-O1 اسی رکاوٹ کو چیلنج کرتا ہے: پہلے انسانی حرکات کو ویڈیو سے نکال کر مشترکہ پیش تربیت دی جائے، پھر روبوٹ مخصوص ڈیٹا صرف ‘‘آخری فاصلے’’ کے لیے استعمال ہو۔ بانی راجر جیانگ، جو اس سے قبل OpenAI میں InstructGPT، ChatGPT اور GPT-4 سے متعلق کام کر چکے ہیں، کہتے ہیں کہ زبان کے ماڈلز والا اسکیلنگ طریقہ جسمانی رویے پر بھی لاگو ہو سکتا ہے—بشرطیکہ تربیتی مواد انسانی ویڈیو کا وسیع ذخیرہ ہو۔
Light-O1 کیسے کام کرتا ہے؟
تکنیکی رپورٹ کے مطابق پائپ لائن ویڈیو کو حصوں میں کاٹتی ہے، لوگوں کو ٹریک کرتی ہے، تین جہتی حرکت دوبارہ بناتی ہے، اور اسے بصری مشاہدات و زبان کے نوٹس سے جوڑتی ہے۔ حرکت کو الگ الگ ایکشن ٹوکنز میں لکھا جاتا ہے، پھر ایک آٹو ریگریسو ٹرانسفارمر زبان اور ایکشن ایک ہی سلسلے میں پیش گوئی کرتا ہے۔ حرکت کی نمائندگی جڑ کی رفتار، جسم کی پوز، اور ہاتھ کی حالت سے ہوتی ہے۔
ڈیمو میں ایک ہی بنیادی ماڈل Light Origins کے LightBot اور Unitree G1 پر گھٹنے ٹیکنے، توازن، تختہ صاف کرنے اور چیز اٹھانے جیسی حرکات دکھاتا ہے۔ کمپنی نے پیش تربیت کے چھ بجٹ آزمائے—تقریباً 3.75 بلین سے 120 بلین ملٹی موڈل ٹوکنز تک؛ سب سے بڑا تجربہ تقریباً ایک لاکھ گھنٹے کی بازیافت شدہ انسانی حرکت کے برابر بتایا گیا۔
کھلا پیش منظر اور حدود
Light-O1-Preview Hugging Face پر تقریباً 6 بلین پیرامیٹرز کے ساتھ Apache 2.0 لائسنس کے تحت دستیاب ہے؛ ماڈل درخت Qwen3.5-4B-Base سے جوڑا گیا ہے۔ عوامی چیک پوائنٹ متنی ہدایت لے کر مختصر استدلال لکھتا ہے اور پورے جسم کی حرکات کی ترتیب نکالتا ہے—تقریباً فی فریم 138 اقدار، 20 فریم فی سیکنڈ۔ تاہم Runtime Wire نے واضح کیا کہ یہ پیش منظر مکمل گھریلو ڈیمو سسٹم سے تنگ ہے: روبوٹ پر چلانے کے لیے الگ کنٹرولر یا بیہیویئر ماڈل درکار رہتا ہے۔
Light Origins نے بتایا کہ 24 سیمولیٹڈ RoboCasa GR-1 کچن ٹاسکس پر ان کے چلانے والے موازنے میں میکرو کامیابی تقریباً 79.3 فیصد رہی۔ یہ اندرونی موازنہ ہے، آزاد لیڈر بورڈ نہیں۔ اگست 2026 میں کمپنی نے کئی سو ملین یوآن کا Pre-A راؤنڈ بھی رپورٹ کیا تھا، جس کی قیادت CAS Investment نے کی۔
پاکستانی و عالمی قارئین کے لیے نکتہ
خبر کا عملی مطلب یہ ہے کہ اے آئی کی بحث صرف چیٹ بوٹس تک محدود نہیں رہی؛ جسمانی ایجنٹس اور ہیومنائیڈ ہارڈویئر اب ویڈیو اسکیلنگ کا دعویٰ کر رہے ہیں۔ ساتھ ہی احتیاط ضروری ہے: کھلا ماڈل حرکت کی پیش گوئی دکھاتا ہے، حقیقی دنیا کی حفاظت، کنٹرولرز اور مقامی ضوابط ابھی الگ چیلنج ہیں۔
خلاصہ: 21 ستمبر 2026 کو Light Origins نے Light-O1 متعارف کرایا جو انسانی ویڈیو سے پورے جسم کی حرکات سیکھ کر مختلف روبوٹس پر منتقل کرنے کا دعویٰ کرتا ہے، اور ایک تنگ پیش منظر ماڈل کھلے لائسنس پر جاری کیا۔ مکمل آزادانہ تصدیق اور حقیقی تعیناتی کے نتائج ابھی ابتدائی مرحلے میں ہیں۔
ذرائع: Runtime Wire (21 ستمبر 2026)؛ Light Origins کا ایکس تھریڈ و تکنیکی رپورٹ؛ Hugging Face پر Light-O1-Preview۔ فیچر تصویر ویکیمیڈیا کامنز کی ڈیٹا سینٹر توضیحی تصویر ہے۔



















