rail-berkeley/serl · 여는 칸: 동작 쪽과 학습 쪽

카메라와 시범 → 재생 버퍼 → 성공 판정과 갱신 → 다음 동작 명령 · 고정 버전 1fa2af7496be

rail-berkeley/serl · 여는 칸: 동작 쪽과 학습 쪽 카메라와 시범 → 재생 버퍼 → 성공 판정과 갱신 → 다음 동작 명령 · 고정 버전 1fa2af7496be 01 / 입력 02 / 기억 03 / 처리 04 / 출력 05 / 제어 카메라와 시범 · franka_env.py · 01 / 입력 카메라와 시범 franka_env.py 재생 버퍼 · 02 / 기억 재생 버퍼 성공 판정과 갱신 · sac.py · 03 / 처리 성공 판정과 갱신 sac.py 다음 동작 명령 · 04 / 출력 다음 동작 명령 동작 쪽과 학습 쪽 · launcher.py · 05 / 제어 · 여는 칸 동작 쪽과 학습 쪽 launcher.py 여는 칸 들어온 값 읽어서 결과 언제 돌지

이 수업이 여는 칸

  • • 제어: 코드에는 학습 함수가 잘 보이지만, 이 프로젝트가 실물 로봇에서 성립하는 이유는 동작하는 쪽과 배우는 쪽을 따로 돌리고 그 사이 순서를 정해 두었기 때문입니다. 그 결정은 학습 코드가 아니라 실행부에 있습니다.

이 틀이 깨지는 곳

  • • 칸이 겹침: 학습된 가중치는 기억이면서 동시에 처리입니다. 저장된 값이자 계산 규칙이라 두 칸으로 나눠지지 않습니다.