제가 딥러닝을 진득히 돌리는 연구를 주로 하지는 않았어서, 마지막 본격적으로 사용했던 경험은 RTX3090에서 멈춰있었습니다.
지금껏 (일반 소비자용) Ampere -> Ada -> (일반 소비자용) Blackwell 으로 바뀌었다지만 일반 소비자용 아키텍처는 같은 이름의 데이터센터용 아키텍처에 비해서 구조적으로 크게 바뀐 부분은 없기에 (CUDA 개발하는 입장에서는 코어수만 왕창 늘었....) 그냥 숫자로만 알고 있었더라죠.
다만 최근에 직접 돌려볼일이 있어서 써보니 체감이 좀 크게 나는군요.
(Ampere) 지금 NVIDIA 아키텍처 대부분의 기틀이 잡힘 -> (Ada) SM수 크게 증가 -> (Blackwell) 부족했던 메모리쪽 개선
을... 하고나니 RTX5090이 RTX3090대비
RPeak 계산…
원문 보기 →