RLWRLD가 낸 로봇 파운데이션 모델 RLDX-1의 「SOTA 오픈웨이트」라는 말이 실제로 무엇을 가리키는지 구분한다. 가중치·코드·데이터 비율까지 연 범위와, 어블레이션·벤치마크 설계처럼 열지 않은 채로 남은 부분을 나눠서 본다.
sudoremove JB · JC2026-05-1835분YouTube
▾
한국 RLWRLD가 로봇 파운데이션 모델(RFM, Robot Foundation Model) RLDX-1을 공개했다. 모델 가중치 세 종과 인퍼런스·학습·LoRA(Low-Rank Adaptation, 전체 가중치 대신 일부만 값싸게 다시 학습하는 파인튜닝 기법) 코드까지 열었다는 점에서 「SOTA 오픈웨이트」를 내세우지만, 어블레이션 실험과 벤치마크 설계의 공정성은 그 공개 범위 밖에 있다.
핵심 포인트
가중치 세 종을 다 열었다. 사전학습판 RLDX-1-PT와, ALLEX(WIRobotics가 만든 로봇)·DROID(공개 로봇 데이터셋 임바디먼트) 각각에 맞춘 RLDX-1-MT-ALLEX·RLDX-1-MT-DROID가 허깅페이스에 있다.
인퍼런스·학습·LoRA 코드까지 셋 다 공개했다. 로보틱스 파운데이션 모델 중에서는 흔치 않게 넓은 범위라고 진행자들은 짚는다.
열린 것과 안 열린 것
모션·피직스·메모리 세 모듈로 VLA(Vision-Language-Action, 시각·언어·행동 통합 모델)가 못 보던 신호를 더한다. 물체의 속도·방향(모션), 손목 토크(피직스), 과거 프레임 요약(메모리)을 각각 서브모듈로 넣는다.
MSAT(Multi-Stream Action Transformer)가 모달리티를 하나로 안 섞는다. 텍타일·토크, 코그니션+메모리, 액션을 별도 스트림으로 나눠 서로 거리가 먼 토큰이 같은 어텐션에 뒤섞이는 것을 피한다.
어블레이션 실험은 거의 없다. 진행자들은 8B(80억) 파라미터라 구성 요소별 비교 실험을 다 돌리기 어렵다는 현실적 이유와, 전략적으로 뺐을 수도 있다는 의심을 함께 든다.
벤치마크가 자사 강점에 맞춰 설계됐다. 모션·촉각·과거 메모리처럼 기존 VLA가 구조적으로 못 푸는 과제를 표적으로 삼았기 때문에, 점수가 높은 것이 개선의 증거이자 동시에 설계의 결과라고 진행자들은 짚는다.
토크·텍타일 합성 데이터는 아직 못 만든다. 현재 물리 시뮬레이터 기술로는 접촉 신호를 만들어 내지 못해, 이 채널만은 실제 촬영 데이터에 의존한다.
물 대신 구슬을 썼다. 무게 변화로 힘 조절을 보여주는 양팔 데모가 액체처럼 보이지만 실제로는 구슬을 채운 것이라고 진행자가 직접 확인한다.
주요 숫자
8B
전체 어블레이션을 다 못 돌리는 이유로 든 파라미터 수
64개
비전-언어 정보를 압축해 액션 모델로 넘기는 코그니션 토큰 개수
1배→3배
학습한 속도 사이 — 안 배운 중간 속도에서도 성공한 컨베이어벨트 데모
4~5개
물 따르기 데모를 진행자들이 쪼갠 하위 동작 수
가장 큰 의미는 이런 파운데이션 모델이 우리나라에서 나왔고 일단 오픈소스를 깠다.
반론 · 충돌
같은 대시보드 「VLA · LBM · RFM은 같은 말이 아니다」RLDX-1은 스스로 RFM(Robot Foundation Model)을 자칭하지만, 그 카드의 정의는 RFM을 여러 환경과 여러 과제를 한 모델이 감당한다는 뜻으로 세운다. 이 편에서 확인되는 것은 RLDX-1-PT를 다른 로봇 몸체로 옮기는 크로스 임바디먼트 파인튜닝이지, 하나의 가중치가 여러 환경·과제를 그대로 감당하는 모습은 아니다.
이 편 안의 자기 지적진행자들은 벤치마크가 기존 VLA가 구조적으로 못 푸는 과제를 표적으로 설계돼 RLDX-1에 유리한 세팅이라고 스스로 짚는다. 아키텍처와 데이터 중 무엇이 점수를 올렸는지는 이 편에서도 갈라내지 못한다.
이 편 자체의 약점동료 심사를 거친 논문이 아니라 회사 테크니컬 리포트다. 어블레이션이 거의 없고, RL 단계의 밸류 모델을 어떻게 만들었는지도 구체적으로 다루지 않는다.
유튜브 자동 자막 전문을 요약한 카드입니다. 자동 인식이라 회사·모델 이름이 흔들리는 대목이 있어 영상 설명란과 논문으로 맞춰 적었습니다. 숫자는 진행자가 말한 것을 그대로 옮겼고 따로 검증하지 않았습니다. 투자 추천이 아닙니다. 자막은 모델명을 「로다」 「리얼덱스」 같은 소리로 인식했는데, 영상 설명란을 따라 RLWRLD·RLDX-1로 표기했습니다.