Daily Progress

2026-06-23  ·  화요일  ·  기간: 어제 (2026-06-22)
6 대상 프로젝트
0 어제 커밋
10 SLURM 작업
1 현재 PENDING

오늘의 우선순위

TL;DR

프로젝트 현황

DreamData (GR00T-Dreams)
IDM pseudo action 역추정 + Cosmos-Predict2 비디오 생성 → GR00T N1 정책 학습
No Activity
🚨 State Schema Fraud (260508) IDM Latent-A multistream: 107.46 mm (best) 코드 복원 완료 (260612)
마지막 커밋: 9a2a2d4 2026-05-08 — Add state schema fix handoff
어제 활동

커밋 없음 / claude 문서 변경 없음 / SLURM 작업 없음.

현재 상태 요약
⚠ CRITICAL — 재학습 블로커 Keh0t0/robocasa_heldout_real state schema fraud 발견 (260508). features.names는 H50 표준이나 실제값은 joint_pos[7]+gripper[1]+zero[8] (hyojinjang 8-dim). Pi0.5 B0/B1/B2 전부 재학습 필요. IDM v2 (action+state) 트랙도 영향권.

IDM 성능 요약 (최신, leakage 없는 기준):

모델데이터BatchEEF Error비고
Pixel B0MG-3064332 mmbaseline
Pixel v2_8gpuMG-301024134.8 mmbatch 효과
Latent-A slicedMG-30 (latent)1024131.8 mmpixel과 동급
Latent-A multistreamMG-30 (latent)1024107.46 mm ⭐best, ckpt-55K 104.99
HF 공식MG-30001024113 mmleakage 불명
오늘 할 일
EgoX2
3D consistency 개선 실험 (원본 EgoX 베이스)
미착수

context.md 없음, 커밋 이력 없음. EgoX_wan2.2 81f 안정화 이후 작업 예정.

EgoX_wan2.2
Wan 2.2 기반 ego+wrist 뷰 동시 생성. 2-Phase LoRA (고노이즈/저노이즈 expert)
No Activity
Phase 2 학습 진행 중 (상태 확인 필요) 81f training collapse 버그 수정 완료 (260408)
마지막 커밋: 0597846 2026-04-08 — Fix 81f training collapse + Phase 2 validation
어제 활동

커밋 없음 / claude 문서 변경 없음 / SLURM 작업 없음.

현재 상태
상태 불명 — 확인 필요 context.md 기준 Job 37398 (PHASE=2, 8 GPU, 2d+ running) + Job 38197 (PENDING) 활성으로 기록되어 있으나, 최근 sacct에 미노출 → 이미 종료되었을 가능성 높음. 81f validation loss curve / Phase 2 expert swap 동작 여부 확인 필요.
오늘 할 일
EgoX_wan2.2_long
임의 길이 비디오 생성 (condition latent frame, autoregressive chunk)
구현 미착수
마지막 커밋: 9fdf39c 2026-03-10 — Update long video

EgoX_wan2.2 81f 학습 안정화 확인 후 착수 예정. plan.md + plan_long_inference.md 구현 계획 작성 완료. Active experiments 없음.

Graph_VLM
시공간 그래프 기반 long-term memory VQA (EPIC-KITCHENS P01_01)
No Activity
Tier 1 Query plan 3-bug fix 완료 (4/20) Tier 2 Graph build 개선 대기
마지막 커밋: d7fc213 2026-04-01
어제 활동

커밋 없음 / claude 문서 변경 없음 / SLURM 작업 없음. (GPU 불필요한 VLM API 기반)

최신 벤치마크 결과 (4/20 기준)
벤치마크Graph V3DescribeFrame-300
hardfilt102/10 (20%)1/105/10
hardfilt10 clean 5개40%20%
hardest102/10 (20%)3/104/10
L34hard104/10 (40%)7/106/10
Tier 2 — 오늘 할 일
VGGRPO
4D geometry reward로 video diffusion 3D consistency 강화 (GRPO fine-tuning)
No Activity
Phase 4 RL 즉시 착수 가능 (Cosmos ckpt 확보) DA3 v1/v2 baseline 학습 중 (jobs 2903/3219)
마지막 커밋: 9da4b07 2026-05-07 — feat: RoboCasa 3-cam pipeline + DA3 backbone
어제 활동

커밋 없음 / claude 문서 변경 없음 / SLURM 작업 없음.

현재 상태

Phase 2 LGM 구축 진행 중. DA3 v1(job 2903, ~1948 step) + DA3 v2 paper-aligned loss(job 3219) 학습 중. Phase 4 RL fine-tuning은 LGM 완성 불필요 — direct DA3 backbone에 decoded RGB 3-cam 입력 경로 채택, 즉시 착수 가능.

READY TO START Base: Cosmos-Predict2-2B robocasa-MG30 iter 73.2K (확보). Algorithm: flow-GRPO + diffusionNFT. Reward: direct DA3 backbone. Ablation: xview reward weight (0/0.5/1.0) × 알고리즘 (grpo/nft) = 6 run 계획.
오늘 할 일

SLURM 작업 요약 (2026-06-22)

어제 제출된 작업 10건. 6개 대상 프로젝트 해당 없음 — 모두 FastWAM / Delta_action / X-WAM.

Job ID 프로젝트 실행 명령 GPU 상태 실행 시간 비고
24265 FastWAM train_zero1.sh robocasa (resume step 290K) 8 PENDING AssocGrpCpuLimit, extra QOS, 64 CPU, 1200 GB
24469 Delta_action convert_depth_fp16.sh 0 COMPLETED 3:17:13 own QOS, 28 CPU, 120 GB
24411 Delta_action eval_action_offline.py
delta_robocasa_v1 vs baseline_nodelta
1 COMPLETED 0:11:14 share QOS, 256 clips
24261 Delta_action eval_delta_compare.sh 1 CANCELLED 0:22:49 extra QOS, by 10010
24264 X-WAM eval_robocasa.sh (EVALS=20) 8 CANCELLED 0:00:00 extra QOS, by 10010
24263 FastWAM train_zero1.sh robocasa (resume step 290K) 8 CANCELLED 0:00:00 extra QOS, by 10010
24262 FastWAM train_zero1.sh robocasa (resume step 290K) 8 CANCELLED 0:00:00 own QOS, by 10010
24274 Delta_action eval_action_offline.py 1 CANCELLED 0:00:00 extra QOS, by 10010
24464 Delta_action convert_depth_fp16.sh 0 CANCELLED 0:00:34 extra QOS, by 10010
24463 Delta_action convert_depth_fp16.sh 0 CANCELLED 0:00:00 extra QOS, by 10010

* Job 24262/24263/24264/24274/24463/24464 등 다수는 by 10010(관리자 선점)으로 CANCELLED. convert_depth_fp16.sh는 own QOS(24469)로 3시간 17분 만에 완료.