Robotics · Physical AI · World Action Models — 14개 프로젝트 스캔 (기간: 금~일, 3일)
7/14Active Projects
3Commits
52SLURM Jobs
오늘의 우선순위
MolmoBot — Phase 1 HardBench eval 캠페인(5k/10k/15k/20k × Pick/PnP/NextTo) 사실상 완주(PnP@20k 42.5%). aux 4종(Pick/PnP-p0/NextTo/Color, ~4.6TB) 다운로드 완료 확인 → 인덱스 생성 → Phase 2 mixture 학습(main 0.35/Pick 0.2/PnP-p0 0.1/NextTo 0.2/Color 0.15) 착수.
scene_bench — MolmoBot-Pi0 VLA 통합 후 조작 성공 0건(pick 문장에서 팔 정지) 원인 규명이 최우선. 프롬프트 A/B → 카메라 A/B → 저자 eval.py 재현 순으로 좁힐 것.
ImageWAM — no-aug 실험이 10회 preempt 끝에 완주해 24-task SR 0.533(5개 조건 중 1위)을 확보했으나 vs B24 p=0.590으로 통계적 무승부. 증강 여부 질문은 여전히 미해결 — 다음 후보(E축: video/target이 action을 attend)는 미승인 상태로 사용자 판단 대기.
UMI — World-Action Model 학습으로 방향 확정, center-crop 전처리(640×512, 77% crop) 결정 완료. 남은 결정: WAM 코드베이스(X-WAM/cosmos-policy/fastwam) 및 view 조합 선택.
tau-0-wm — naive baseline 63.0% 확정 후 후속 문서 갱신 없음. TTC 실험(RCS 시뮬레이터 zmq 브릿지 이식) 착수 필요 — τ₀ 핵심 주장 검증이 아직 미착수.
VGGRPO — X-WAM 카메라 캐시·stitch-layer 준비 작업만 진행(20분 내 완료). Cosmos-norm 4-way ablation(dino4/agg2) 학습 상태는 문서 미갱신으로 완주 여부 불명 — 점검 필요.
TL;DR. 14개 대상 중 7개 활성(커밋 3건 — 전부 scene_bench, SLURM 52건: COMPLETED 32 / PREEMPTED 20). 현재 RUNNING 중인 job은 없음. 가장 큰 수확은 MolmoBot의 pi0.5×MolmoSpace Phase 1 완주 — 8-GPU own으로 20k step/12시간 반 학습(loss 0.011) 후 HardBench 4개 체크포인트 × 3태스크를 own QOS로 전수 평가해 PnP@20k 42.5%(논문 pi0.5 ft 평균 36% 상회)를 확보했다. ImageWAM은 같은 3일 동안 noaug 학습이 10번 연속 preempt되다 결국 완주(step 20280)해 24-task SR 0.533을 냈지만 B24 대비 통계적으로는 여전히 구분 불가(p=0.590). scene_bench는 자체 파인튜닝한 신규 VLA(MolmoBot-Pi0)를 온라인 하네스에 연결하는 데는 성공했으나 조작 성공이 0건이라 프롬프트/카메라 분포 불일치를 의심 중이다. cosmos는 guidance 스윕을 마무리해 3.0을 최종 배포값으로 확정했다. 나머지 7개 프로젝트(MetaView-action / X-WAM / lingbot-va / MetaView / SceneMem / cosmos_policy / DreamData)는 이번 3일간 git·문서·SLURM 어느 쪽에서도 활동이 없었다.
프로젝트별 진행 상황
MolmoBotHigh
MolmoSpace(allenai/molmobot-data)로 pi0.5를 finetuning하고 시뮬 rollout 성공률로 평가 (+ MolmoBot-Pi0 서브모듈).
증강(image augmentation) off 실험 완료: 24-task SR 0.533 — 다섯 조건(no-aug/B24/D-min/C-joint/C-pred) 중 최고지만 설계된 대조(vs B24 0.512) p=0.590으로 통계적 무승부. pairwise McNemar를 10번 돌린 것 중 p=0.048 하나(vs C-pred)도 Holm 보정(0.005)에서 탈락 — 다섯 조건 전부 여전히 통계적으로 구분 불가. 안정적인 것은 순서뿐: no-aug ≥ B24 > D-min ≈ C-joint > C-pred(target을 읽는 세 조건이 전부 하위). 논문에는 augmentation 서술이 아예 없다는 점도 재확인.
SLURM: COMPLETED ×3PREEMPTED ×10 — rc24_NA(noaug 학습, extra, gpu:8) 10회 연속 preempt 끝에 job 82185에서 완주(3:06:30, step 20280) → 82236 eval(gpu:4, 0:40:42, N_ROLLOUTS=10)로 SR 0.533 산출
오늘 할 일 / 이슈
다음 후보 E축(video/target이 action을 attend해 미래를 action-conditioned로) — 정보 천장을 뚫는 유일한 개입이나 미승인 상태, 사용자 판단 대기
신규 VLA(MolmoBot-Pi0 part1 20k, 사용자 자체 FT, PnP 벤치 42.5%)를 온라인 하네스에 연결 완료(Task N6). raw-obs ws 어댑터 + 프롬프트 프로파일("Pick up the X and place it in or on the Y") + FrankaOmniPurposeCameraSystem 구현 — 통합 자체는 성립(전 루프 완주)했으나 조작 0승. pick 문장에서 팔 정지(모션 규모가 이전 정책의 1/600), pnp 문장에는 반응 → 프롬프트/카메라 분포 불일치 의심. 다음 단계: 프롬프트 A/B → 카메라 A/B → 저자 eval.py 재현 순으로 원인 격리.
SLURM: 없음 (기간 내 sbatch 없음 — 검증은 로그인 노드 π0.5 정책서버 직접 실행, 작업 후 kill 확인됨)
오늘 할 일 / 이슈
프롬프트 A/B → 카메라 A/B → eval.py 재현 순으로 조작 0승 원인 격리(최우선)
online 하네스 백로그: 결합 런(자연어→plan-first→온라인 실행) 배선, F6(PnP-resume 후 bowl 낙하) 조사, done-verification 구현
데이터 생성팀 대기 — Behavior 규칙 출처, Phase 2 test 30채 출처 등 사용자 결정 필요 항목 다수
cosmosMedium
NVIDIA Cosmos3 world model을 클러스터에서 실행 가능하게 만들고 RoboLab 시뮬 벤치마크로 X-WAM 등과 비교 가능한 수치 확보.
방향 확정: World-Action Model 학습. RoboTwin transfer 경로는 보류 — 그리퍼 하드웨어 부재로 실기 배포 불가, 시뮬에 동일 그리퍼 투입 불가(CAD/URDF 없음), 논문의 fisheye 해법은 하드웨어를 맞춘 것이라 전이 가능한 기법이 없다는 결론. 전처리 결정: fisheye rectification 대신 center crop — 중앙 77% crop → 640×512(1.30x 업스케일), 입체각 59% 보존·4.17 px/deg. 비교군 rectilinear 120°(43%/3.22 px/deg) 대비 커버리지·해상도 양쪽에서 우세.
SLURM: 없음
오늘 할 일 / 이슈
WAM 입력 view 조합, 사용할 코드베이스(X-WAM / cosmos-policy / fastwam) 결정
어느 코드베이스든 VideoReader LRU 캐싱 필수(미적용 시 6-view 39s/sample → 캐싱 시 126ms)
데이터 스케일 121h — 논문 pretraining 4,000h 대비 3%, cross-embodiment 전이 자체가 미검증 가설
VGGRPOLow
Video diffusion model 생성 비디오의 3D consistency를 4D geometry reward로 강화(GRPO). VGGT-Ω 백본 + Cosmos-Predict2 VAE 트랙.
어제 한 일
커밋 0건, 문서 갱신 없음 — SLURM 유틸리티 작업만 진행
SLURM: COMPLETED ×2 — build_xwam_cam_cache.sh(gpu:1, 0:16:29), find_stitch_layer_vggt_dinov2_xwam.sh(gpu:1, 0:03:30) — X-WAM 카메라 캐시·stitch-layer 준비 작업
오늘 할 일 / 이슈
Cosmos-norm 4-way ablation(dino4/agg2) 학습 상태 점검 — context.md 기준 job 37233/37399가 "완주 ~2일 후"였으나 이후 갱신 없어 완주 여부 불명
fp32 재전처리 후 일부 demo attrs["num_samples"] overreport — 근본 해결 미착수(임시 clamp로 방어 중)
tau-0-wmLow
τ₀-World Model(VAM)의 naive 성능(TTC 없이 기본 posttrain + 5-step 추론)을 RoboCasa 24-task에서 측정해 X-WAM과 비교.
어제 한 일
커밋 0건, 문서 갱신 없음 — naive 결과 확정(260813)의 마지막 eval job만 이 기간에 종료