সাম্প্রতিক এমবডিড ইন্টেলিজেন্স ডেভেলপমেন্ট সিম্পোজিয়ামে, ফুদান ইউনিভার্সিটির অধ্যাপক চেন টাও-এর দল একটি বড় গবেষণায় অগ্রগতি ঘোষণা করেছে: পরবর্তী-প্রজন্মের জেনারেটিভ হিউম্যানয়েড রোবট মোশন বড় মডেলটি প্রথাগত ভিজ্যুয়াল-ভাষা মডেলের (ভিএলএ) সীমাবদ্ধতা ভেদ করে, একটি ক্রসমেন থেকে "{2}} বোঝার ক্ষমতা অর্জন করে "গতিশীল নিয়ন্ত্রণ।" মডেলটি উদ্ভাবনীভাবে মানব মোশন জেনারেশনকে "অ্যাকশন ল্যাঙ্গুয়েজ ট্রান্সলেশন" হিসাবে সাদৃশ্যপূর্ণ করে, একটি "অ্যাকশন ভোকাবুলারি-সিকোয়েন্স সিনট্যাক্স" সিস্টেম তৈরি করে যা রোবটগুলিকে শুধুমাত্র প্রাকৃতিক ভাষা নির্দেশের মাধ্যমে জটিল অঙ্গ-প্রত্যঙ্গের নড়াচড়া তৈরি করতে সক্ষম করে, যা প্রথাগত মডেলের তুলনায় 40% দ্বারা উন্নত হয়।

দলের প্রধান প্রযুক্তিগত হাইলাইটগুলির মধ্যে রয়েছে: একটি 3D পয়েন্ট ক্লাউড মাল্টিমোডাল মডেল তৈরি করা, রোবটগুলিকে প্রথমবারের মতো স্থানিক কাঠামো "বোঝার" ক্ষমতা অর্জন করতে সক্ষম করা, মূর্ত প্রশ্নের উত্তর দিতে সক্ষম-এবং গতিশীল পথ পরিকল্পনা; এবং একটি উদ্ভাবনী মডেল কম্প্রেশন ফ্রেমওয়ার্ক তৈরি করা, প্রান্ত কম্পিউটিং শক্তির প্রয়োজনীয়তা 70% হ্রাস করে, বুদ্ধিমান রোবটগুলির ব্যাপকভাবে গ্রহণের জন্য হার্ডওয়্যার বাধাগুলি ভেঙে দেয়। মডেলটি সফলভাবে শারীরিক রোবট প্ল্যাটফর্মে স্থাপন করা হয়েছে, শিল্প সমাবেশ এবং পরিষেবা পরিস্থিতিতে মসৃণ গতি নিয়ন্ত্রণ ক্ষমতা প্রদর্শন করে।

Moushen Intelligent Technology, গবেষণা কৃতিত্বের উপর ভিত্তি করে উদ্ভূত, বিশ্বব্যাপী অগ্রগামী জেনারেটিভ মোশন সিরিজ প্রযুক্তির মাধ্যমে একাধিক শিল্প জায়ান্টের সাথে কৌশলগত অংশীদারিত্ব অর্জন করেছে। প্রফেসর চেন টাও বলেছেন, "আমাদের গবেষণা 'ভার্চুয়াল মডেল এবং শারীরিক নিয়ন্ত্রণের মধ্যে সংযোগ বিচ্ছিন্ন', গবেষণাগার থেকে বাস্তব-বিশ্ব পরিস্থিতির মধ্যে মূর্ত বুদ্ধিমত্তাকে চালিত করার শিল্পের ব্যথার বিন্দুকে সম্বোধন করেছে।" এই অগ্রগতি শুধুমাত্র চীনের রোবোটিক্স শিল্পে মূল প্রযুক্তিগত প্রতিযোগিতার ইঞ্জেকশন দেয় না বরং বিশ্বব্যাপী এআই প্রতিযোগিতায় মূর্ত বুদ্ধিমত্তার ক্ষেত্রে একটি নতুন মানদণ্ডও স্থাপন করে।
