ফুদান ইউনিভার্সিটির চেন তাও দল উন্মোচন করেছে পরবর্তী-প্রজন্ম মানব-রোবট মোশন মডেলের মতো

Jul 03, 2025 একটি বার্তা রেখে যান

সাম্প্রতিক এমবডিড ইন্টেলিজেন্স ডেভেলপমেন্ট সিম্পোজিয়ামে, ফুদান ইউনিভার্সিটির অধ্যাপক চেন টাও-এর দল একটি বড় গবেষণায় অগ্রগতি ঘোষণা করেছে: পরবর্তী-প্রজন্মের জেনারেটিভ হিউম্যানয়েড রোবট মোশন বড় মডেলটি প্রথাগত ভিজ্যুয়াল-ভাষা মডেলের (ভিএলএ) সীমাবদ্ধতা ভেদ করে, একটি ক্রসমেন থেকে "{2}} বোঝার ক্ষমতা অর্জন করে "গতিশীল নিয়ন্ত্রণ।" মডেলটি উদ্ভাবনীভাবে মানব মোশন জেনারেশনকে "অ্যাকশন ল্যাঙ্গুয়েজ ট্রান্সলেশন" হিসাবে সাদৃশ্যপূর্ণ করে, একটি "অ্যাকশন ভোকাবুলারি-সিকোয়েন্স সিনট্যাক্স" সিস্টেম তৈরি করে যা রোবটগুলিকে শুধুমাত্র প্রাকৃতিক ভাষা নির্দেশের মাধ্যমে জটিল অঙ্গ-প্রত্যঙ্গের নড়াচড়া তৈরি করতে সক্ষম করে, যা প্রথাগত মডেলের তুলনায় 40% দ্বারা উন্নত হয়।

 

chentao

 

দলের প্রধান প্রযুক্তিগত হাইলাইটগুলির মধ্যে রয়েছে: একটি 3D পয়েন্ট ক্লাউড মাল্টিমোডাল মডেল তৈরি করা, রোবটগুলিকে প্রথমবারের মতো স্থানিক কাঠামো "বোঝার" ক্ষমতা অর্জন করতে সক্ষম করা, মূর্ত প্রশ্নের উত্তর দিতে সক্ষম-এবং গতিশীল পথ পরিকল্পনা; এবং একটি উদ্ভাবনী মডেল কম্প্রেশন ফ্রেমওয়ার্ক তৈরি করা, প্রান্ত কম্পিউটিং শক্তির প্রয়োজনীয়তা 70% হ্রাস করে, বুদ্ধিমান রোবটগুলির ব্যাপকভাবে গ্রহণের জন্য হার্ডওয়্যার বাধাগুলি ভেঙে দেয়। মডেলটি সফলভাবে শারীরিক রোবট প্ল্যাটফর্মে স্থাপন করা হয়েছে, শিল্প সমাবেশ এবং পরিষেবা পরিস্থিতিতে মসৃণ গতি নিয়ন্ত্রণ ক্ষমতা প্রদর্শন করে।

 

Speech

 

Moushen Intelligent Technology, গবেষণা কৃতিত্বের উপর ভিত্তি করে উদ্ভূত, বিশ্বব্যাপী অগ্রগামী জেনারেটিভ মোশন সিরিজ প্রযুক্তির মাধ্যমে একাধিক শিল্প জায়ান্টের সাথে কৌশলগত অংশীদারিত্ব অর্জন করেছে। প্রফেসর চেন টাও বলেছেন, "আমাদের গবেষণা 'ভার্চুয়াল মডেল এবং শারীরিক নিয়ন্ত্রণের মধ্যে সংযোগ বিচ্ছিন্ন', গবেষণাগার থেকে বাস্তব-বিশ্ব পরিস্থিতির মধ্যে মূর্ত বুদ্ধিমত্তাকে চালিত করার শিল্পের ব্যথার বিন্দুকে সম্বোধন করেছে।" এই অগ্রগতি শুধুমাত্র চীনের রোবোটিক্স শিল্পে মূল প্রযুক্তিগত প্রতিযোগিতার ইঞ্জেকশন দেয় না বরং বিশ্বব্যাপী এআই প্রতিযোগিতায় মূর্ত বুদ্ধিমত্তার ক্ষেত্রে একটি নতুন মানদণ্ডও স্থাপন করে।