Daily Progress — 2026-08-14 (금)

Robotics · Physical AI · World Action Models — 14개 프로젝트 스캔 (기간: 최근 1일)

8/14Active Projects
23Commits
38SLURM Jobs

오늘의 우선순위

  1. cosmos — guidance 2.0/4.0 스윕 RUNNING (79845, 79846) 결과 집계 → 1.0/2.0/3.0/4.0 4점 속도-성공률 파레토 곡선 완성.
  2. X-WAM — A/C/D 100-rollout 재평가로 통계력 확보(SE 1.95→1.4pp)가 최우선. ab2_pm/ab2_depth 재구축 데이터셋(sealed RGB 버그 수정본) 학습 진행 확인.
  3. tau-0-wm — naive baseline 63.00% 확정 후 TTC 실험 착수(RCS 시뮬레이터 zmq 브릿지 이식). base-Wan init 대조군으로 τ₀ pretrain 기여분 분리.
  4. scene_bench — F6(PnP-resume 후 bowl 낙하) 원인 미규명 — 최우선 조사 대상. done-verification 오라클 체크 구현.
  5. MetaView-action — pre-restoration commit(55c1002) 별도 worktree에서 rc_m3f vs rc_m3 생성품질 비교. M1(no-geometry) 순수 대조군 학습 착수.
  6. MolmoBot — FrankaPnP OmniCam part1 660 shards/1.43TB 다운로드 완료 확인 → validate_trajectories.py → ≤100 step 스모크 → 본 학습 제출.
  7. UMI — 저자 응답으로 아티팩트 비공개 확정 — RoboTwin transfer 실험 진행 여부 vs action-제외 video corpus 전용 사용 vs 중단, 결정 필요.
  8. scenemem — context.md 10일째 stale(8/3 기준 job 68392 "진행 중"으로 오기재) — 오늘 나온 4.07x 검증 결과부터 작업 로그·context 갱신 필요.
TL;DR. 14개 대상 중 8개 활성(커밋 23건, SLURM 38건). 가장 큰 수확은 tau-0-wm naive τ₀-VAM RoboCasa 24-task 최종 확정(63.00%, X-WAM released 대비 −12.3pp)과 X-WAM A/B/C/D 4-arm World Forcing 완주(D≈C, geometry 신호 결합은 상쇄 — 샘플 크기가 병목)다. MetaView-action은 3D geometry conditioning 아키텍처를 완전 복원했지만 SR 개선 없음 — cross-attention 경로로 geometry 신호가 action head까지 전파 안 되는 것을 probe_output_sensitivity.py로 확정(부정적이지만 명확한 결론). scene_bench는 하루 만에 20 커밋으로 온라인 하네스 A/B/B2 밸리데이션을 마치고 plan-first 모드를 기본값으로 채택했다. scenemem은 pi0.5 MolmoSpace 15k-step 체크포인트 검증에서 zero-motion 대비 4.07x 개선을 확인했지만 문서화가 밀렸다. cosmos는 CFG ablation(n=1200)에서 guidance 유무 차이 −11.0%p를 통계적으로 확정했고, 2.0/4.0 스윕이 현재 RUNNING 중이다.

프로젝트별 진행 상황

cosmos High

NVIDIA Cosmos3 world model을 클러스터에서 실행 가능하게 만들고 RoboLab 시뮬 벤치마크로 X-WAM 등과 비교 가능한 수치 확보.

어제 한 일

커밋 0건 (문서만)

SLURM: COMPLETED ×5PREEMPTED ×1RUNNING ×2 — cfgoff-full0~3(gpu:2, 14~21hr), gsweep2p0/4p0(gpu:2, RUNNING)

오늘 할 일 / 이슈

X-WAM High

Wan2.2-TI2V-5B 기반 unified 4D world-action model(X-WAM) RoboCasa/RoboTwin 벤치마크 재현 — 목표 79.2% SR.

어제 한 일

커밋 0건 — vendor code-release clone이라 claude/·tmp/·configs/data/가 git 미추적(untracked). 실작업은 문서로만 추적됨.

SLURM: COMPLETED ×10CANCELLED ×2 — rc_final(gpu:1) + ab2_pm/ab2_depth 재구축 데이터셋 재학습. 앞 9회는 <1분 내 종료(재구축 반영 재시작 추정), 뒤 2회는 30~42분 만에 취소.

오늘 할 일 / 이슈

tau-0-wm High

τ₀-World Model(VAM)의 naive 성능(TTC 없이 기본 posttrain + 5-step 추론)을 RoboCasa 24-task에서 측정해 X-WAM과 비교.

어제 한 일

커밋 0건 (문서만)

SLURM: posttrain 재시작 CANCELLED ×2PREEMPTED ×3 끝에 COMPLETED(own, gpu:8, 8:09:09) 완주. eval 5건(step 3000/9000/18000/24000/27000v2) 대부분 COMPLETED, step27000 1차 시도는 CANCELLED 후 재실행 완료.

오늘 할 일 / 이슈

scene_bench High

가정용 로봇을 위한 장기 기억(scene-level memory) 벤치마크 — 다일간 누적 컨텍스트(물건 위치, 사건, 집안 규칙) 회상·행동 테스트.

어제 한 일

커밋 20건 (주요 내역):

SLURM: COMPLETED ×2CANCELLED ×1 — t4_egl_probe, t4_demo×2(gpu:1, 소규모)

오늘 할 일 / 이슈

MolmoBot High

MolmoSpace(allenai/molmobot-data) 데이터로 pi0.5를 finetuning — action 규약을 pi0.5 pretrained weight에 정확히 맞춤.

어제 한 일

커밋 0건 (문서만)

SLURM: 없음

오늘 할 일 / 이슈

MetaView-action Medium

MetaView의 3D geometry conditioning(PRoPE)이 action prediction/control을 실제로 개선하는지 RoboCasa video+action+proprio joint training(arm M3)으로 검증.

어제 한 일

SLURM: COMPLETED ×3 — rc_m3f(own, gpu:8, 7:59:12), rc_m3f_post(own, gpu:8, 0:15:14), rc_val(own, gpu:8, 1:58:46)

오늘 할 일 / 이슈

UMI Medium

HiFi-UMI-2K(2,000h robot-free bimanual manipulation)를 1~5TB 예산 내에서 확보해 manipulation policy / world-action-model 학습 데이터로 사용.

어제 한 일

git 저장소 아님 (커밋 추적 불가)

SLURM: 없음

오늘 할 일 / 이슈

scenemem Medium

pi0.5를 MolmoSpaces(franka_droid) demo로 finetune, zero-shot 대비 success-rate 상승 측정 (참고: MolmoBot 논문 15K-step finetune 기준 36.0% vs 10.0% zero-shot).

어제 한 일

git 저장소 아님. claude/*.md 문서 업데이트도 없음 — 대신 15:33 KST에 산출물이 새로 생성됨.

SLURM: 없음 (검증은 외부/로컬 환경에서 실행된 것으로 추정)

오늘 할 일 / 이슈

활동 없음 (지난 1일)

lingbot-vaLast: 2026-08-12 (2일 전)
ImageWAMLast: 2026-07-30 (15일 전)
MetaViewLast: 2026-08-11 (3일 전)
cosmos-policy⏸ Paused (2026-08-10)
DreamDataLast: 2026-08-06 (8일 전)
VGGRPOLast: 2026-08-03 (11일 전)

SLURM 작업 (지난 1일, 38건)

Job ID프로젝트실행 명령GPU상태실행 시간노드
78492cosmoscfgoff-full0 (run_robolab_eval.sh)2COMPLETED20:01:031
78493cosmoscfgoff-full12COMPLETED20:44:531
78507cosmoscfgoff-full32COMPLETED19:04:481
78512cosmoscfgoff-full22PREEMPTED05:17:591
78688cosmoscfgoff-full2 (재제출)2COMPLETED14:05:131
79845cosmosgsweep2p0 (guidance=2.0)2RUNNING00:10:11+1
79846cosmosgsweep4p0 (guidance=4.0)2RUNNING00:06:11+1
78514MetaView-actionrc_m3f (run_robocasa_arm.sh)8COMPLETED07:59:121
78665MetaView-actionrc_m3f_post (run_m3f_postrun.sh)8COMPLETED00:15:141
78803MetaView-actionrc_val (run_robocasa_eval.sh m3f/m3)8COMPLETED01:58:461
78541tau-0-wmtau_rc_posttrain8CANCELLED02:15:101
78808tau-0-wmtau_rc_posttrain8PREEMPTED00:26:031
78929tau-0-wmtau_rc_posttrain8PREEMPTED00:11:161
78937tau-0-wmtau_rc_posttrain8PREEMPTED00:42:021
78953tau-0-wmtau_rc_posttrain8CANCELLED00:00:001
78963tau-0-wmtau_rc_posttrain (완주, own)8COMPLETED08:09:091
78986tau-0-wmtau_rc_eval_30004COMPLETED00:54:571
79143tau-0-wmtau_rc_eval_90004COMPLETED00:49:521
79329tau-0-wmtau_rc_eval_180004COMPLETED00:45:001
79427tau-0-wmtau_rc_eval_270004CANCELLED01:30:271
79439tau-0-wmtau_rc_resume27k8COMPLETED01:02:241
79440tau-0-wmtau_rc_eval_240004COMPLETED00:42:061
79513tau-0-wmtau_rc_eval_27000v24COMPLETED00:43:131
78800X-WAMrc_final (finalize_dataset.py, share)1COMPLETED00:00:521
78801X-WAMab2_pm (own)8COMPLETED00:00:421
78802X-WAMab2_depth (extra)8COMPLETED00:00:441
78807X-WAMab2_pm (own, 재시도)8COMPLETED00:00:391
78822X-WAMab2_depth (extra, 재시도)8COMPLETED00:00:331
78927X-WAMab2_pm (own, 재시도)8COMPLETED00:00:101
78928X-WAMab2_depth (extra, 재시도)8COMPLETED00:00:081
78931X-WAMab2_depth (extra, 재시도)8COMPLETED00:00:101
78932X-WAMab2_pm (own, 재시도)8COMPLETED00:00:121
78946X-WAMab2_pm (own)8CANCELLED00:42:281
78947X-WAMab2_depth (extra)8CANCELLED00:29:531
78961X-WAMab2_pm (own)8CANCELLED00:00:001
78987scene_bencht4_egl_probe (EGL/MuJoCo probe)1COMPLETED00:00:111
78988scene_bencht4_demo (run_online_demo.sh, gemini-3.6-flash)1COMPLETED00:02:291
78990scene_bencht4_demo (재시도)1CANCELLED00:00:271