Caltech-AMBER/ambersim · 여는 칸: 각도와 정책 숫자

모델과 시작 자세 → 각도와 정책 숫자 → 한 걸음과 점수 → 점수 곡선과 정책 · 고정 버전 47a9c1848154

Caltech-AMBER/ambersim · 여는 칸: 각도와 정책 숫자 모델과 시작 자세 → 각도와 정책 숫자 → 한 걸음과 점수 → 점수 곡선과 정책 · 고정 버전 47a9c1848154 01 / 입력 02 / 기억 03 / 처리 04 / 출력 05 / 제어 모델과 시작 자세 · pendulum.xml · 01 / 입력 모델과 시작 자세 pendulum.xml 각도와 정책 숫자 · base.py · 02 / 기억 · 여는 칸 각도와 정책 숫자 base.py 여는 칸 한 걸음과 점수 · swingup.py · 03 / 처리 한 걸음과 점수 swingup.py 점수 곡선과 정책 · 04 / 출력 점수 곡선과 정책 반복과 평가 시점 · helpers.py · 05 / 제어 반복과 평가 시점 helpers.py 들어온 값 읽어서 결과 언제 돌지

이 수업이 여는 칸

  • • 기억: 로봇이 동작을 배운다고 하면 몸이 익힌다고 생각하기 쉽습니다. 연습이 끝난 뒤 남는 것은 숫자 뭉치 하나이고, 무엇을 배웠는지는 전부 그 숫자 안에 들어 있습니다.

이 틀이 깨지는 곳

  • • 칸이 겹침: 연습으로 바뀐 숫자는 기억이면서 동시에 다음 동작을 정하는 계산입니다. 두 칸으로 나뉘지 않습니다.