Sakhanda Wire
NVDA MSFT GOOGL META AMZN
← Към новините

Hugging Face представя Microduck: 25-сантиметров двукрак робот с отворен код за $399, който обучавате чрез обучение с подсилване

Повечето представяния на роботика ви карат да се доверите на демонстрационно видео. Pollen Robotics, екипът по роботика от Бордо към Hugging Face, вместо това предоставя целия цикъл на обучение. Тази седмица компанията отвори предварителни поръчки за Microduck, двукрак робот с височина 25 см, при който всяко движение — ходене, сядане, ритане, каране на ролери, изправяне след падане — е невронна политика, обучена във физически симулатор и прехвърлена към хардуера. Цената му е 399 долара. Средите за обучение, функциите за награда, настройките за рандомизация на домейна и рецептата за прехвърляне от симулация към реалния свят са публично достъпни в GitHub. Microduck следва Reachy Mini, от който са доставени над 10 000 бройки, но обръща основната му концепция: докато Reachy Mini е създаден да стои на бюро и да взаимодейства, Microduck е създаден да напуска бюрото, да пада и да се изправя отново.

Хардуерът

Microduck е висок 25 см, широк 14 см и тежи под 800 г. Той разполага с 15 двигателя в краката, врата и главата, както и с подвижен клюн, който вдига предмети от пода. Изчислителната платформа е Rockchip RK3566 с AI ускорител, 1 GB RAM и 32 GB памет.

Сензорният комплект е необичайно пълен за тази цена. Предна камера е разположена зад специален индикатор за използване на камерата. Има два IMU сензора — един в тялото и един в главата. Системата за измерване на разстояние е компактен LiDAR — матрица 8×8 за измерване на времето на полета. Има микрофони и високоговорител, две NFC антени, както и Wi-Fi и Bluetooth. Захранването е чрез сменяема батерия NP-F550 с капацитет 2600 mAh, достатъчна за около час работа.

С робота се доставят седем обучени движения, които могат да се управляват с включения игрови контролер, преди да напишете код: ходене, сядане и изправяне, ритане, хващане, каране на ролери и самостоятелно възстановяване. Роботът не говори. При първото включване всеки робот генерира собствена аудио идентичност и запазва този глас завинаги.

Как всъщност се обучават поведенията

Политиките се обучават в microduck_rl, изграден върху mjlab (MuJoCo Warp) с PPO. Pollen съобщава, че за постигането на използваща се походка са необходими приблизително един до два часа на CUDA GPU при 4096 паралелни среди. Без локален GPU добавянето на --hf-jobs изпълнява същата команда в Hugging Face Jobs.

Работата по прехвърлянето от симулация към реалния свят е съсредоточена в модела на изпълнителните механизми. Всеки серво механизъм използва BAM M6 модела на Dynamixel XL330 — закон за управление на напрежението, обратна електродвижеща сила и триене на Кулон, Стрибек и зависещо от натоварването триене — вместо идеален PD контролер. Рандомизацията за всяка среда обхваща напрежението на батерията, спада на напрежението при натоварване, закъснението на командите и величината на триенето. Вариантите с луфт обучават системата спрямо ±1° луфт на предавките, общо 2°, последователно за всяка от 14-те серво оси в RL конфигурацията. Тъй като реалният енкодер се намира от изходната страна на този луфт, наблюденията се отчитат през него.

Обучените политики се експортират в ONNX, като нормализаторът на наблюденията е вграден в графа. Pollen предупреждава да не се внедряват ръчно конвертирани контролни точки именно по тази причина.

В робота среда за изпълнение на Rust управлява контролния цикъл с честота 50 Hz и шината на двигателите. Всяка политика използва общо 61-измерно наблюдение на актьора: 48 проприоцептивни измерения плюс команди за усукване (3), поза на главата (4) и поза на тялото (6). Именно този общ договор позволява политиките за ходене, възстановяване и изпълнение на трикове да се сменят в движение. Средите, които игнорират даден слот за команда, го запълват с нули, вместо да го премахват.

Публикуваният регистър обхваща 13 задачи: проследяване на скоростта, изправяне, сядане и изправяне, вземане на предмет от земята, ритане на топка (топка с диаметър 70 мм и тегло 15 г, като актьорът не вижда топката), претъркаляне и пет среди за каране на ролери.

Основни изводи

  • Двукрак робот с отворен код и цена 399 долара; предварителните поръчки започват на 27 август 2026 г., а доставките са планирани преди Коледа.
  • 15 двигателя, камера, LiDAR, два IMU сензора, NFC, Wi-Fi/Bluetooth, RK3566 и около 1 час работа.
  • Политиките се обучават в mjlab/MuJoCo Warp с PPO; за походка са необходими около 1–2 часа при 4096 среди.
  • Преходът от симулация към реалния свят разчита на модел на изпълнителния механизъм BAM, както и на рандомизация на напрежението, закъснението, триенето и луфта от ±1°.
  • Софтуерът е под лиценз Apache-2.0; файловете за механичния и електронния дизайн не са отворени.

Разгледайте продуктовата страница на Microduck, публикацията в блога за представянето, прескита и спецификациите, хранилището с кода за изпълнение на microduck, хранилището за обучение на microduck_rl и съобщението от Thomas Wolf. Също така можете да ни последвате в Twitter и не забравяйте да се присъедините към нашия ML SubReddit с над 150 хил. членове и да се абонирате за нашия бюлетин. Чакайте! В Telegram ли сте? вече можете да се присъедините към нас и в Telegram.

Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.

Първоначално публикувано от MarkTechPost на

Прочетете оригинала в MarkTechPost ↗

Текстът и изображенията са собственост на MarkTechPost и са възпроизведени тук с посочване на авторството и връзка към оригиналната публикация.

← Към новините

Още новини

Всички последни новини