유튜버 커뮤니티
카테고리

팡요랩 Pang-Yo Lab

구독자 6,210 유튜브 채널
10:43
[1부] AI와 인간의 코딩 대결(사상최초)
2021.08.16
37:25
[2부] AI와 인간의 코딩 대결 최종회
2021.08.16
4:22
[바닥부터 배우는 강화학습] 책이 출간되었습니다!
2020.10.23
59:57
[쉽게읽는 강화학습 논문 7] 알파 스타 논문리뷰
2019.11.17
37:00
[구현 3] PPO 알고리즘(Proximal Policy Optimization)
2019.05.31
38:55
[쉽게구현하는 강화학습 2화] DQN 알고리즘 구현!
2019.05.16
59:58
[쉽게구현하는 강화학습 1화] Policy Gradient - REINFORCE와 Actor-Critic 구현하기!
2019.05.04
40:17
[쉽게읽는 강화학습 논문 6화] PPO 논문 리뷰
2019.04.18
1:21:20
[쉽게읽는 강화학습 논문 5화] TRPO 논문 리뷰
2019.03.14
48:52
[쉽게읽는 강화학습 논문 4화] A3C 논문 리뷰
2019.03.02
1:14:33
AI가 스타크래프트2를 정복한 원리(알파스타)
2019.02.17
51:20
가장 쉬운 KL Divergence 완전정복!
2019.01.28
54:59
[쉽게 읽는 강화학습 논문 3화] DQN 논문 리뷰
2019.01.20
3:47
팡요랩 앞으로의 계획
2019.01.07
1:15:23
[강화학습 10강] Classic Games
2019.01.06
1:13:10
[강화학습 9강] Exploration and Exploitation
2018.12.25
1:16:57
[쉽게 읽는 강화학습 논문 2화] 알파고 제로(Zero) 논문 리뷰
2018.11.26
1:21:49
[강화학습 8강] Integrating Learning and Planning
2018.11.18
1:33:38
[강화학습 7강] Policy Gradient
2018.10.28
1:19:33
[강화학습 6강] Value Function Approximation
2018.09.26
1:06:22
[강화학습 5강] Model Free Control
2018.09.09
1:16:37
[강화학습 4강] Model Free Prediction
2018.09.04
1:19:49
[강화학습 3강] Planning by Dynamic Programming
2018.08.26
1:15:36
[강화학습 2강] Markov Decision Process
2018.08.22
1:20:23
[강화학습 1강] 강화학습 introduction
2018.08.12
21:34
[쉽게 읽는 강화학습 논문] 알파고 논문리뷰 3편
2018.08.12
31:33
[쉽게 읽는 강화학습 논문] 알파고 논문리뷰 2편
2018.08.12
12:59
[쉽게 읽는 강화학습 논문] 알파고 논문리뷰 1편
2018.07.22