LeRobot v0.5.0: การพัฒนาครั้งใหญ่เพื่อยกระดับวงการหุ่นยนต์ 🤖

LeRobot ได้เปิดตัวเวอร์ชันใหม่ล่าสุด v0.5.0 ซึ่งมาพร้อมกับการปรับปรุงและฟีเจอร์ใหม่ ๆ ที่จะช่วยยกระดับขีดความสามารถของหุ่นยนต์ในทุกมิติ ไม่ว่าจะเป็นการรองรับฮาร์ดแวร์ที่หลากหลายยิ่งขึ้น, นโยบาย (Policies) ที่ชาญฉลาดและตอบสนองได้ดีขึ้น, รวมถึงการปรับปรุงระบบจัดการข้อมูลและการเขียนโค้ดให้ทันสมัยและมีประสิทธิภาพยิ่งกว่าเดิม

รองรับหุ่นยนต์หลากหลายยิ่งขึ้น: จากแขนกลสู่หุ่นยนต์ฮิวแมนนอยด์ 🦾

LeRobot v0.5.0 ได้ขยายขีดความสามารถในการรองรับฮาร์ดแวร์อย่างก้าวกระโดด สิ่งที่โดดเด่นที่สุดคือ:

  • การรองรับ Unitree G1 Humanoid อย่างเต็มรูปแบบ: นี่คือการผสานรวมหุ่นยนต์ฮิวแมนนอยด์ตัวแรกของ LeRobot ที่ครอบคลุมทุกการทำงาน ตั้งแต่การเคลื่อนที่ (Locomotion), การหยิบจับวัตถุ (Manipulation), การควบคุมจากระยะไกล (Teleoperation) ไปจนถึงการควบคุมทั้งร่างกาย (Whole-Body Control) เพื่อให้หุ่นยนต์สามารถทำงานที่ซับซ้อนในโลกจริงได้อย่างมีประสิทธิภาพ
  • OpenArm และ OpenArm Mini: เพิ่มการรองรับแขนกล OpenArm และอุปกรณ์ควบคุมระยะไกล OpenArm Mini ซึ่งสามารถทำงานร่วมกันแบบสองแขน (Bi-manual configurations) เพื่อเพิ่มความซับซ้อนในการหยิบจับ
  • หุ่นยนต์ใหม่ ๆ: LeRobot ยังคงขยายระบบนิเวศด้วยการรองรับ Earth Rover หุ่นยนต์เคลื่อนที่สำหรับงานภายนอกอาคาร, OMX Robot แขนกลที่ปรับแต่งได้, และการรวมโค้ดของ SO-100/SO-101 ให้ง่ายขึ้น
  • มอเตอร์ CAN Bus: รองรับมอเตอร์คอนโทรลเลอร์ผ่าน CAN Bus เช่น RobStride และ Damiao ทำให้สามารถใช้งานกับแอคทูเอเตอร์ระดับมืออาชีพได้หลากหลายยิ่งขึ้น นอกเหนือจาก Dynamixel และ Feetech ที่มีอยู่เดิม

นโยบาย (Policies) ที่ชาญฉลาดและตอบสนองไว 🧠

LeRobot v0.5.0 ได้เพิ่มนโยบายและเทคนิคใหม่ ๆ เข้ามาถึง 6 รายการ เพื่อผลักดันขีดจำกัดของการเรียนรู้ของหุ่นยนต์แบบ Open Source:

  • Pi0-FAST: นำเสนอโมเดล Vision-Language-Action (VLA) แบบ Autoregressive ที่ใช้เทคนิค FAST (Frequency-space Action Sequence Tokenization) เพื่อการสร้างลำดับแอคชั่นที่แม่นยำและยืดหยุ่น
  • Real-Time Chunking (RTC): เทคนิคการอนุมาน (Inference) ที่ช่วยให้การทำงานของนโยบายแบบ Flow-matching ตอบสนองได้รวดเร็วยิ่งขึ้น โดยการผสมผสานการคาดการณ์ใหม่เข้ากับการกระทำที่กำลังดำเนินอยู่ ทำให้พฤติกรรมของหุ่นยนต์มีความต่อเนื่องและตอบสนองได้ดีในสถานการณ์จริง
  • Wall-X: นโยบาย VLA ใหม่ที่พัฒนาต่อยอดจาก Qwen2.5-VL โดยใช้ Flow-matching สำหรับการทำนายแอคชั่น
  • X-VLA: นำ Florence2-based VLA มาใช้เป็นอีกทางเลือกสำหรับนโยบาย VLA ทำให้มีความหลากหลายของโมเดลพื้นฐาน (Foundation Models) สำหรับการเรียนรู้ของหุ่นยนต์
  • SARM (Stage-Aware Reward Modeling): แก้ปัญหาความท้าทายในการเรียนรู้หุ่นยนต์สำหรับงานที่มีระยะเวลายาวนาน โดยการแบ่งการเรียนรู้เป็นขั้น ๆ (Stage-aware) ทำให้การฝึกนโยบายสำหรับงานที่ซับซ้อนหลายขั้นตอนง่ายขึ้น
  • PEFT Support: รองรับการ Fine-tune VLA ขนาดใหญ่ด้วย LoRA และเทคนิค PEFT อื่น ๆ โดยไม่ต้องแก้ไข Core Training Pipeline ทำให้การปรับโมเดลขนาดใหญ่ให้เข้ากับหุ่นยนต์และงานเฉพาะทำได้ง่ายขึ้นด้วยทรัพยากรที่น้อยลง

การจัดการข้อมูลที่เร็วขึ้น: บันทึกและฝึกฝนได้ไวขึ้น ⚡

LeRobot v0.5.0 ปรับปรุงประสิทธิภาพของ Pipeline การจัดการข้อมูลอย่างมาก ทำให้ทั้งการเก็บข้อมูลและการฝึกฝนเร็วขึ้นกว่าเดิม:

  • Streaming Video Encoding: บันทึกวิดีโอแบบเรียลไทม์ ทำให้ไม่มีการรอคอยระหว่างตอน (Episode) ทำให้เก็บข้อมูลได้ต่อเนื่องและรวดเร็ว
  • การฝึกภาพเร็วขึ้น 10 เท่า: ปรับปรุงการรองรับ Image Transform และแก้ไขคอขวดในการเข้าถึงข้อมูล ทำให้การฝึกฝนเร็วขึ้นอย่างมาก
  • การเข้ารหัสเร็วขึ้น 3 เท่า: การเข้ารหัสแบบขนาน (Parallel Encoding) เป็นค่าเริ่มต้น ทำให้การเข้ารหัสข้อมูลเร็วขึ้น
  • เครื่องมือแก้ไขข้อมูลที่พัฒนาขึ้น: รองรับการทำ Subtask, การแปลง Image เป็น Video, และเครื่องมือแก้ไขอื่น ๆ ที่หลากหลาย

EnvHub: โหลดสภาพแวดล้อมจำลองจาก Hub ☁️

EnvHub เป็นวิธีใหม่ในการใช้สภาพแวดล้อมจำลองใน LeRobot โดยสามารถโหลดได้โดยตรงจาก Hugging Face Hub ทำให้การแชร์และใช้งานสภาพแวดล้อมจำลองทำได้ง่ายขึ้นมาก

การผสานรวม NVIDIA IsaacLab-Arena 🎮

LeRobot v0.5.0 ผสานรวมกับ NVIDIA IsaacLab-Arena เพื่อนำเสนอการจำลองที่เร่งความเร็วด้วย GPU ทำให้สามารถสร้าง Instance ของสภาพแวดล้อมจำนวนมากสำหรับการเรียนรู้แบบ Reinforcement Learning ได้อย่างรวดเร็ว

โครงสร้างโค้ดที่ทันสมัย: พื้นฐานที่แข็งแกร่งยิ่งขึ้น 🛠️

LeRobot v0.5.0 มีการปรับปรุงโครงสร้างโค้ดครั้งใหญ่:

  • Python 3.12+: รองรับ Python เวอร์ชันล่าสุด
  • Transformers v5: อัปเกรดเป็น Hugging Face Transformers เวอร์ชันล่าสุด
  • 3rd-party Policy Plugins: สามารถลงทะเบียนนโยบายที่กำหนดเองเป็นแพ็กเกจที่ติดตั้งได้ ทำให้การปรับแต่งทำได้ง่ายขึ้น
  • Remote Rerun Visualization: รองรับการแสดงผล Telemetry ของหุ่นยนต์แบบเรียลไทม์ผ่าน Rerun
  • ปรับปรุงการติดตั้งและเอกสาร: ทำให้การติดตั้งและทำความเข้าใจง่ายขึ้น
  • อัปเดต PyTorch: รองรับ GPU NVIDIA Blackwell

ชุมชนและระบบนิเวศที่เติบโต 🚀

LeRobot v0.5.0 มาพร้อมกับการพัฒนาในส่วนชุมชนและระบบนิเวศ เช่น การปรับปรุง Discord, การปรับปรุง GitHub README, การยอมรับเอกสารงานวิจัยใน ICLR 2026, การปรับปรุง LeRobot Visualizer และ LeRobot Annotation Studio

LeRobot v0.5.0 เป็นก้าวสำคัญที่แสดงให้เห็นถึงการพัฒนาอย่างไม่หยุดยั้งของ LeRobot ในการทำให้ AI และวิทยาการหุ่นยนต์เข้าถึงได้ง่ายขึ้นสำหรับทุกคน

#LeRobot #Robotics #AI #OpenSource #HumanoidRobots

ขอบคุณ แหล่งข้อมูล
https://huggingface.co/blog/lerobot-release-v050

LeRobot v0.5.0: การพัฒนาครั้งใหญ่เพื่อยกระดับวงการหุ่นยนต์ 🤖LeRobot ได้เปิดตัวเวอร์ชันใหม่ล่าสุด v0.5.0 ซึ่งมาพร้อมกับการปรับปรุงและฟีเจอร์ใหม่ ๆ ที่จะช่วยยกระดับขีดความสามารถของหุ่นยนต์ในทุกมิติ ไม่ว่าจะเป็นการรองรับฮาร์ดแวร์ที่หลากหลายยิ่งขึ้น, นโยบาย (Policies) ที่ชาญฉลาดและตอบสนองได้ดีขึ้น, รวมถึงการปรับปรุงระบบจัดการข้อมูลและการเขียนโค้ดให้ทันสมัยและมีประสิทธิภาพยิ่งกว่าเดิมรองรับหุ่นยนต์หลากหลายยิ่งขึ้น: จากแขนกลสู่หุ่นยนต์ฮิวแมนนอยด์ 🦾LeRobot v0.5.0 ได้ขยายขีดความสามารถในการรองรับฮาร์ดแวร์อย่างก้าวกระโดด สิ่งที่โดดเด่นที่สุดคือ:การรองรับ Unitree G1 Humanoid อย่างเต็มรูปแบบ: นี่คือการผสานรวมหุ่นยนต์ฮิวแมนนอยด์ตัวแรกของ LeRobot ที่ครอบคลุมทุกการทำงาน ตั้งแต่การเคลื่อนที่ (Locomotion), การหยิบจับวัตถุ (Manipulation), การควบคุมจากระยะไกล (Teleoperation) ไปจนถึงการควบคุมทั้งร่างกาย (Whole-Body Control) เพื่อให้หุ่นยนต์สามารถทำงานที่ซับซ้อนในโลกจริงได้อย่างมีประสิทธิภาพOpenArm และ OpenArm Mini: เพิ่มการรองรับแขนกล OpenArm และอุปกรณ์ควบคุมระยะไกล OpenArm Mini ซึ่งสามารถทำงานร่วมกันแบบสองแขน (Bi-manual configurations) เพื่อเพิ่มความซับซ้อนในการหยิบจับหุ่นยนต์ใหม่ ๆ: LeRobot ยังคงขยายระบบนิเวศด้วยการรองรับ Earth Rover หุ่นยนต์เคลื่อนที่สำหรับงานภายนอกอาคาร, OMX Robot แขนกลที่ปรับแต่งได้, และการรวมโค้ดของ SO-100/SO-101 ให้ง่ายขึ้นมอเตอร์ CAN Bus: รองรับมอเตอร์คอนโทรลเลอร์ผ่าน CAN Bus เช่น RobStride และ Damiao ทำให้สามารถใช้งานกับแอคทูเอเตอร์ระดับมืออาชีพได้หลากหลายยิ่งขึ้น นอกเหนือจาก Dynamixel และ Feetech ที่มีอยู่เดิมนโยบาย (Policies) ที่ชาญฉลาดและตอบสนองไว 🧠LeRobot v0.5.0 ได้เพิ่มนโยบายและเทคนิคใหม่ ๆ เข้ามาถึง 6 รายการ เพื่อผลักดันขีดจำกัดของการเรียนรู้ของหุ่นยนต์แบบ Open Source:Pi0-FAST: นำเสนอโมเดล Vision-Language-Action (VLA) แบบ Autoregressive ที่ใช้เทคนิค FAST (Frequency-space Action Sequence Tokenization) เพื่อการสร้างลำดับแอคชั่นที่แม่นยำและยืดหยุ่นReal-Time Chunking (RTC): เทคนิคการอนุมาน (Inference) ที่ช่วยให้การทำงานของนโยบายแบบ Flow-matching ตอบสนองได้รวดเร็วยิ่งขึ้น โดยการผสมผสานการคาดการณ์ใหม่เข้ากับการกระทำที่กำลังดำเนินอยู่ ทำให้พฤติกรรมของหุ่นยนต์มีความต่อเนื่องและตอบสนองได้ดีในสถานการณ์จริงWall-X: นโยบาย VLA ใหม่ที่พัฒนาต่อยอดจาก Qwen2.5-VL โดยใช้ Flow-matching สำหรับการทำนายแอคชั่นX-VLA: นำ Florence2-based VLA มาใช้เป็นอีกทางเลือกสำหรับนโยบาย VLA ทำให้มีความหลากหลายของโมเดลพื้นฐาน (Foundation Models) สำหรับการเรียนรู้ของหุ่นยนต์SARM (Stage-Aware Reward Modeling): แก้ปัญหาความท้าทายในการเรียนรู้หุ่นยนต์สำหรับงานที่มีระยะเวลายาวนาน โดยการแบ่งการเรียนรู้เป็นขั้น ๆ (Stage-aware) ทำให้การฝึกนโยบายสำหรับงานที่ซับซ้อนหลายขั้นตอนง่ายขึ้นPEFT Support: รองรับการ Fine-tune VLA ขนาดใหญ่ด้วย LoRA และเทคนิค PEFT อื่น ๆ โดยไม่ต้องแก้ไข Core Training Pipeline ทำให้การปรับโมเดลขนาดใหญ่ให้เข้ากับหุ่นยนต์และงานเฉพาะทำได้ง่ายขึ้นด้วยทรัพยากรที่น้อยลงการจัดการข้อมูลที่เร็วขึ้น: บันทึกและฝึกฝนได้ไวขึ้น ⚡LeRobot v0.5.0 ปรับปรุงประสิทธิภาพของ Pipeline การจัดการข้อมูลอย่างมาก ทำให้ทั้งการเก็บข้อมูลและการฝึกฝนเร็วขึ้นกว่าเดิม:Streaming Video Encoding: บันทึกวิดีโอแบบเรียลไทม์ ทำให้ไม่มีการรอคอยระหว่างตอน (Episode) ทำให้เก็บข้อมูลได้ต่อเนื่องและรวดเร็วการฝึกภาพเร็วขึ้น 10 เท่า: ปรับปรุงการรองรับ Image Transform และแก้ไขคอขวดในการเข้าถึงข้อมูล ทำให้การฝึกฝนเร็วขึ้นอย่างมากการเข้ารหัสเร็วขึ้น 3 เท่า: การเข้ารหัสแบบขนาน (Parallel Encoding) เป็นค่าเริ่มต้น ทำให้การเข้ารหัสข้อมูลเร็วขึ้นเครื่องมือแก้ไขข้อมูลที่พัฒนาขึ้น: รองรับการทำ Subtask, การแปลง Image เป็น Video, และเครื่องมือแก้ไขอื่น ๆ ที่หลากหลายEnvHub: โหลดสภาพแวดล้อมจำลองจาก Hub ☁️EnvHub เป็นวิธีใหม่ในการใช้สภาพแวดล้อมจำลองใน LeRobot โดยสามารถโหลดได้โดยตรงจาก Hugging Face Hub ทำให้การแชร์และใช้งานสภาพแวดล้อมจำลองทำได้ง่ายขึ้นมากการผสานรวม NVIDIA IsaacLab-Arena 🎮LeRobot v0.5.0 ผสานรวมกับ NVIDIA IsaacLab-Arena เพื่อนำเสนอการจำลองที่เร่งความเร็วด้วย GPU ทำให้สามารถสร้าง Instance ของสภาพแวดล้อมจำนวนมากสำหรับการเรียนรู้แบบ Reinforcement Learning ได้อย่างรวดเร็วโครงสร้างโค้ดที่ทันสมัย: พื้นฐานที่แข็งแกร่งยิ่งขึ้น 🛠️LeRobot v0.5.0 มีการปรับปรุงโครงสร้างโค้ดครั้งใหญ่:Python 3.12+: รองรับ Python เวอร์ชันล่าสุดTransformers v5: อัปเกรดเป็น Hugging Face Transformers เวอร์ชันล่าสุด3rd-party Policy Plugins: สามารถลงทะเบียนนโยบายที่กำหนดเองเป็นแพ็กเกจที่ติดตั้งได้ ทำให้การปรับแต่งทำได้ง่ายขึ้นRemote Rerun Visualization: รองรับการแสดงผล Telemetry ของหุ่นยนต์แบบเรียลไทม์ผ่าน Rerunปรับปรุงการติดตั้งและเอกสาร: ทำให้การติดตั้งและทำความเข้าใจง่ายขึ้นอัปเดต PyTorch: รองรับ GPU NVIDIA Blackwellชุมชนและระบบนิเวศที่เติบโต 🚀LeRobot v0.5.0 มาพร้อมกับการพัฒนาในส่วนชุมชนและระบบนิเวศ เช่น การปรับปรุง Discord, การปรับปรุง GitHub README, การยอมรับเอกสารงานวิจัยใน ICLR 2026, การปรับปรุง LeRobot Visualizer และ LeRobot Annotation StudioLeRobot v0.5.0 เป็นก้าวสำคัญที่แสดงให้เห็นถึงการพัฒนาอย่างไม่หยุดยั้งของ LeRobot ในการทำให้ AI และวิทยาการหุ่นยนต์เข้าถึงได้ง่ายขึ้นสำหรับทุกคน#LeRobot #Robotics #AI #OpenSource #HumanoidRobotshttps://huggingface.co/blog/lerobot-release-v050
Shared content
HUGGINGFACE.CO
LeRobot v0.5.0: Scaling Every Dimension
We’re on a journey to advance and democratize artificial intelligence through open source and open science.
7 Kommentare 0 Geteilt 197 Ansichten 0 Bewertungen