@q.xxaa: В этом видео показан мой старый эксперимент с Reinforcement Learning - обучение физического четырёхногого агента с помощью алгоритма Proximal Policy Optimization Здесь движение не является заранее записанной анимацией. Агент получает информацию о состоянии своего тела и суставов, управляет ногами через нейронную сеть, взаимодействует с физикой среды и постепенно учится передвигаться благодаря системе наград. Интересно посмотреть на этот эксперимент сегодня, после выхода ARC Raiders. В ARC Raiders можно увидеть очень похожую общую идею в движении некоторых машин ARC особенно у Leaper ("Прыгуна") и других паукообразных/многоногих роботов. Их движения выглядят не как обычная заранее проигрываемая анимация: машина физически взаимодействует с поверхностью, переставляет ноги, теряет равновесие, приземляется, сталкивается с объектами и пытается восстановить положение тела. Embark Studios действительно использовала Machine Learning / Reinforcement Learning для обучения физически управляемых агентов движению. Конечно, реализация в современной коммерческой игре намного сложнее моего небольшого эксперимента, но базовая идея очень похожа: состояние физического тела → нейронная сеть → управление суставами → физическая симуляция → результат → обучение. Особенно забавно, что это было создано задолго до релиза ARC Raiders. Поэтому сейчас оно выглядит почти как ранняя маленькая демонстрация того же направления, которое спустя годы стало применяться в больших игровых проектах для создания физически правдоподобных роботов и существ. !Это не утверждение о какой-либо прямой связи между моими проектами и разработчиками ARC Raiders - технологии reinforcement learning для управления роботами развивались независимо во многих проектах. Просто очень интересная техническая параллель: идея, которую тогда можно было экспериментально запускать на Roboschool Ant и PPO, сегодня хорошо видна в поведении многоногих машин в современной AAA-игре. p.s. Это пример того, как нейросеть может самостоятельно научиться управлять сложной системой без заранее прописанной последовательности движений #ReinforcementLearning #PPO #MachineLearning #Robotics #arcraiders

Нян-Mel ♡
Нян-Mel ♡
Open In TikTok:
Region: PL
Monday 31 August 2026 14:21:54 GMT
8049
17
19
1

Music

Download

Comments

akazagoogle
zagoogle :
нифига себе описание конечно)
2026-08-31 14:26:23
0
q.akima
neverlose :
кстати вроде бы ты этого робота хотела воссоздать? будет еще или передумала?
2026-08-31 14:28:53
0
flover.696
flovr :
а рандом агент почему так валяеться?
2026-08-31 14:25:33
0
cyberzireael
Daniil :
А вот и "паучок")
2026-08-31 15:58:45
0
akazagoogle
zagoogle :
эволюция твоего ТТ)
2026-08-31 14:29:24
0
akazagoogle
zagoogle :
кто-то была рада вспомнить Арк)
2026-08-31 14:27:16
0
q.akima
neverlose :
фига себе
2026-08-31 14:28:30
0
To see more videos from user @q.xxaa, please go to the Tikwm homepage.

Other Videos


About