ro ≈ 50–112° 발산 지속 — 진폭 축소 없음, 구조적 수렴 불가Jun 5 스냅샷(260605 카드) 이후 3일간(Jun 5→8) 3-track LGM-RoboCasa 학습 진행 상황을 기록한다. 주요 관찰 포인트: (1) Any4D 최종 완주 임박 여부 확인, (2) DA3-v2 loss < 0.10 목표 달성 여부, (3) DA3-v1 발산 지속 여부 → scancel 의사결정.
3 track 역할 요약:
신규 코드 수정 없음. 실행 중인 3개 job의 slurms/taewoongkang_118{51,53,69}.out tail 50행에서 최신 step 로그를 수집하여 loss 성분별 분석 수행.
| Track | Jun 5 step | Jun 8 step | Δ step | 속도 (step/day) |
|---|---|---|---|---|
| Any4D | 25,495 | 41,865 | +16,370 | 5,457 |
| DA3-v2 | 19,350 | 33,500 | +14,150 | 4,717 |
| DA3-v1 | 21,900 | 36,100 | +14,200 | 4,733 |
Any4D가 DA3 두 track 대비 ~15% 빠름 (배치 크기 동일 4 GPU, 모델 구조 차이 기인).
| Track | Job | Jun 5 step | Jun 8 step | +Δ (3일) | 진행률 | 완주 예상 | 상태 |
|---|---|---|---|---|---|---|---|
| Any4D baseline | 11851 | 25,495 | 41,865 | +16,370 | 83.7% ★ | Jun 9–10 | RUNNING |
| DA3-v2 (paper) | 11869 | 19,350 | 33,500 | +14,150 | 67.0% | Jun 11–12 | RUNNING |
| DA3-v1 (ablation) | 11853 | 21,900 | 36,100 | +14,200 | — | — | 발산 |
| Track | Total loss (avg) | Jun 5 → Jun 8 | 주요 성분 | 판정 |
|---|---|---|---|---|
| Any4D (step 41,865) | ≈ 0.28 | 0.33 → 0.28 (↓15%) | d≈0.16, p≈0.08, sf≈0.03 | 수렴 가속 |
| DA3-v2 (step 33,500) | ≈ 0.10 | 0.15 → 0.10 (↓33%) | D≈0.025, M≈0.037, P≈0.023, C≈0.016, g≈0.004 | 목표치 도달 |
| DA3-v1 (step 36,100) | 30 ~ 71 | 무변화 | ro ≈ 50–112° | 발산 지속 |
ro 항 50–112° 범위. Jun 5 때(20–202°)와 비교하면 최대값이 낮아졌으나 평균 ro≈86° 수준은 동일. depth 성분(d≈0.10–0.28)은 정상이지만 total loss에서 depth 비율 < 1% — rotation이 99%+ 점유. step 35,950에서 최솟값 25.9(ro=50.3°)를 기록했으나 이후 즉시 44–71로 복귀. 14,200 step 더 진행해도 수렴 신호 없음.
| Step | Total loss | ro (rotation°) | d (depth) | 비율 (ro/d) |
|---|---|---|---|---|
| 34,500 | 42.8 | 84.2° | 0.181 | ~465× |
| 34,650 | 70.6 | 139.5° | 0.108 | ~1,292× |
| 35,000 | 63.7 | 125.2° | 0.192 | ~652× |
| 35,200 | 71.9 | 140.6° | 0.165 | ~852× |
| 35,500 | 44.9 | 86.8° | 0.230 | ~377× |
| 35,950 | 25.9 | 50.3° | 0.124 | ~406× |
| 36,100 | 46.3 | 90.3° | 0.197 | ~458× |
잔여 8,135 step ÷ 5,457 step/day = 1.49일 → Jun 9 밤 ~ Jun 10 오전 완주 예상. lr cosine decay는 50K step에서 최솟값(0)에 도달하므로, 완주 후 checkpoint의 loss는 현재보다 소폭 추가 하강 가능성 있음.
Any4D: 41,865 / 50,000 (83.7%) — Jun 9–10 완주
DA3-v2: 33,500 / 50,000 (67.0%) — Jun 11–12 완주
DA3-v1: 36,100 / 50,000 (72.2%) — 발산 지속, scancel 고려
Jun 5 카드에서 설정한 두 마일스톤이 모두 달성/임박했다. DA3-v2 loss < 0.10은 현재(step 33,500)에서 이미 충족되었으며, Any4D는 Jun 9–10 완주 후 final checkpoint를 얻는다. 이 시점에 동일 RoboCasa 홀드아웃 씬에서 depth PSNR과 pose error를 비교하면 두 backbone의 reward quality 차이를 정량화할 수 있다.
DA3-v2가 Any4D 대비 loss scale로 2.8배 낮다(0.10 vs 0.28). 이 차이가 cross-view attention의 실질적 이득인지, 아니면 loss 정규화 차이에 의한 scale 착시인지가 평가에서 확인해야 할 핵심 질문이다.
scancel 11853 실행. step ~36K checkpoint는 experiments/lgm_robocasa_da3_v0_lossv1_0511_0254/에 보존되어 있으므로 이론적 재현 시 사용 가능. 회수된 GPU 4장을 Phase 2 RL Sub-plan #1 Task 1(FF submodule Cosmos 통합)에 투입.
50K checkpoint로 RoboCasa 홀드아웃 씬 평가:
50K 완주 시 loss < 0.08 달성 여부 확인. 현재 속도(4,717 step/day)로 잔여 16,500 step → ~3.5일. 50K checkpoint에서 위 ②의 동일 평가 실행. Phase 2 RL reward backbone 선택에서 Any4D vs DA3-v2 최종 판단.