quickmenu
PC 리뷰 홈  

Radeon HD 5800은 듀얼코어? 소문의 진상을 알아보자

2009-09-30 18:00
권경욱 前 기자 viper2님의 미디어로그 가기 press@bodnara.co.kr

2. CPU와 GPU의 다른 아키텍처




CPU와 GPU는 서로 다른 아키텍처로 발전

일반적으로 CPU는 분기 예측과 랜덤 메모리 액세스 등의 범용 컴퓨팅 즉, 시리얼 명령에 최적화되어 다양한 연산을 해줄 수 있는 프로세서이며, GPU는 부동소수점 연산을 이용하여 병렬 명령 처리에 최적화되고 그래픽 처리와 같은 특정 연산에 강점을 보이는 프로세서다.

이러한 결과 CPU와 GPU의 아키텍처는 서로에 강점을 가진 분야에서 연산 성능을 증가시키면서 서로 다른 방향으로 발전해왔다.

하지만, GPU는 특정 연산에 최적화된 프로세서이기 때문에 CPU와 같은 범용 컴퓨팅에 활용도는 크게 떨어질 수밖에 없는 구조를 가진다. 반대로 CPU는 여러 가지 연산에는 유용하게 사용될 수 있지만, 그래픽연산 등에서는 상대적으로 떨어지는 성능을 제공한다. 그러나, 최근 GPGPU 기술을 통해 GPU들은 CPU와 협력하여 서로 부족한 부분을 보완할 수 있게 바뀌고 있다.

 


CPU와 다른 GPU 아키텍처

GPU는 CPU와 비교하여 명령 실행 및 제어가 보다 간단하다. GPU는 엄연히 이야기해서 CPU에 해당하는 코어 이미 수백개씩 가지고 있는데, CPU의 코어단위에 속하는 GPU의 코어는 엄연히 스트림 프로세서 또는 쉐이더 프로세서로 불리고 있다. GPU는 보통 여러 개의 스트림 프로세서를 일정 단위로 묶어 (클러스터, SIMD 엔진) 연산을 처리하도록 구성되고 있다.

HD 5800 시리즈를 예로들면, 20/ 18개의 SIMD 엔진 (16 스레드 프로세서 내부에 5개의 스트림 코어가 내장 (16 x 5 = 80)되며, 20/ 18 SIMD 엔진을 구성하여 1600/ 1440개의 스트림 프로세서를 제공)으로 구성된다. 이 클러스터들에 포함된 스트림 프로세서들은 같은 명령을 처리하도록 설계되고 있다. GPGPU를 이용한 GPU 병렬 컴퓨팅이 확대되고 있지만, GPU는 어디까지나 많은 데이터의 동일한 처리에 최적화된 병렬 프로세서다.

현재의 GPU들은 클러스터 전체가 1개의 명령으로 여러 개의 데이터를 처리하는 SIMD (Single Instruction Multiple Data) 구조로 만들어지며, NVIDIA GT300의 경우 MIMD (Multiple Instruction Multiple Data)의 새로운 아키텍처가 적용될 것으로 알려지고 있다.

 

CPU는 GPU보다 복잡하다

반면, CPU는 명령 실행 및 제어하는 구조가 GPU보다 복잡하다. 현재의 CPU들은 명령 실행 유닛이 GPU보다 많은 편이며, 이에 따라 서로 다른 명령을 병렬로 실행할 수 있는 구조를 갖고 있다. 예를들어 명령 1과 2를 실행함과 동시에 또다른 명령 3을 실행하는 유닛을 동작하도록할 수 있다.

멀티코어 CPU들은 각각의 CPU 코어들이 각각의 실행 유닛에 서로 다른 명령을 실행할 수도 있고 같은 명령에 대해 서로 협력하여 더 높은 성능을 제공할 수 있는 구조를 갖추고 있다. 이는 CPU가 명령을 유연하게 실행할 수 있다는 것을 말해주며, GPU는 일정한 데이터에 대해서 같은 명령을 실행하여 유연성이 떨어지는 모습을 보여준다.

또, CPU는 동시에 다수의 명령을 실행할 수 있는 명령 스케쥴러가 제공되지만, GPU는 복잡한 명령 스케쥴러를 제공하지 않고 소프트웨어를 이용한 스케쥴링이 진행된다. 그만큼 GPU는 소프트웨어의 최적화도 중요하다.

 

CPU는 GPU에 비교해 실행유닛 비율 떨어져

그러나, CPU는 GPU와 비교하여 명령 제어 관련 유닛이 복잡해지고 더욱 커져 실질적인 실행 유닛의 비율이 줄어드는 문제를 갖고 있다. 그와 비교해 GPU는 명령 제어 유닛이 차지하는 비율이 CPU보다 상대적으로 적기 때문에 실질적인 실행 유닛인 스트림 프로세서를 GPU 내부에 더 많이 포함할 수 있다. 이는 GPU가 CPU보다 다이 면적 당 연산 성능이 높을 수밖에 없는 이유다.

일반적으로 GPU에 캐쉬가 탑재되지 않을 경우 코어 간의 메모리 지연시간도 없으며, 내부 버스도 간단해진다. 이로 인해 프로세서를 마음껏 탑재가 가능하여 CPU보다 연산 성능이 크게 증가된다.

하지만, GPU는 프로그램에 조건 분기명령이 포함될 경우 처리 성능이 크게 떨어지는 경우가 있으며, 이는 GPU를 범용 컴퓨팅이 가능해진 현재에도 GPU로 실행할 수 있는 어플리케이션들에 제약이 있다는 것을 말해준다. 결과적으로 현재 GPU 아키텍처로는 CPU가 할 수 있는 일들을 모두 대체하기는 힘들다는 것을 의미한다.

 

이론적으로 효율적인 것은 하나의 프로세서에 하나의 분기처리가 가능해야 하지만, 이는 현실적으로는 어렵고, 명령 제어 관련 유닛이 복잡해지면 오히려 그만큼 실적인 실행유닛이 줄어 성능저하를 가져오게 된다. 이에따라 현재의 GPU들은 분기명령 처리 향상을 위해 GPU를 개선하는 방향으로 나가고 있으며, 기존보다 범용적인 작업들에 GPU를 활용할 수 있도록 GPGPU에 보다 최적화된 모습도 보여준다.

 


멀티코어화 되는 CPU와 GPU

CPU는 현재 멀티코어화가 진행되고 있다. CPU는 과거에는 클럭을 높이고 내부 연산 성능을 높이는 방법이 주로 사용되어 왔다. 그런데 최근에는 미세공정 적용이 더디어지고 클럭 향상 및 내부 연산 성능 개선의 한계에 다다르자 코어 수를 직접적으로 늘려 처리 성능을 높이는 멀티코어화가 대안으로 떠올랐다.

이 결과 현재는 듀얼코어를 넘어 쿼드코어, 그리고 얼마 있으면 6코어 프로세서도 데스크탑 시장에 등장할 것으로 알려지고 있다. 이처럼 CPU의 멀티코어화는 과거부터 사용해온 성능 향상 방법이 한계에 다다르자 이를 해결하기 위해 적용되기 시작한 방법이다. 현재의 멀티코어 CPU는 서로 독립된 코어로 구성되지만, 공동으로 하나의 작업을 빠르고 효율적으로 처리하는 것도 가능하고 서로 다른 작업을 각각 처리할 수도 있다.

 

GPU는 싱글 GPU들도 CPU 관점에서 볼 경우 CPU의 코어에 해당하는 스트림 프로세서를 이미 크게 늘려놓고 있는 상황이기 때문에 이미 멀티코어인 제품이라 할 수 있다. 하지만, CPU와 달리 GPU의 멀티코어화는 GPU가 CPU보다 상대적으로 복잡하지 않은 제어부를 갖고 있어 보다 빠르게 스트림 프로세서를 늘려 성능을 증가시킬 수 있었기 때문이며 오히려 공정 등으로 인해 더 많은 트랜지스터를 집적하지 못하는 것이 성능 확장의 걸림돌이 되기도 했다. 즉, CPU와 달리 일정 수준의 성능 향상을 위해 트랜지스터 집적률을 높여 연산 성능 향상이 가능한 스트림 프로세서를 크게 늘리는 것이 일반적인 GPU의 멀티코어화라고 볼 수 있다.

GPU는 현재 상황에 맞는 일정 성능을 제공하기 위해 제한된 면적에 트랜지스터를 더 많이 집적해야 하는데 이는 어려운 작업이며, 미세공정이 뒷받침되어야 더욱 효과를 볼 수 있다. 이 결과 많은 수의 스트림 프로세서를 병렬로 연결하여 배치함으로써 이전 세대의 GPU보다 높은 처리 성능을 얻을 수 있게 되었고 이는 AMD ATI와 NVIDIA 모두 같은 방법을 사용하고 있다. 이처럼 GPU의 멀티코어화는 CPU처럼 처리 성능을 높이는 관점에서는 목적이 같으나 근본적인 연산 처리 방법은 크게 달라지지 않았다고 볼 수 있다.

 


AMD와 NVIDIA의 서로 다른 GPU 발전방향

AMD는 중간 공략이 먼저, 최고성능은 그다음

AMD ATI의 GPU 개발 전략은 잘 알려져 있듯이 일정 수준의 성능을 가진 GPU를 만들고 고성능을 위한 듀얼 GPU나 성능을 줄인 GPU를 만들어 경쟁사보다 빠른 시장 출시 및 대응이 가능한 스윗스팟 전략이다. 물론, 이전 세대보다 성능이 더 높아지는 것은 당연한 부분이다.

또한, GPU는 본업인 그래픽처리에 집중하면서 연산 성능을 개선하고 성능 저하를 가져오는 복잡한 부분들을 제거해나가는 방식이다. 이는 결과적으로 경쟁사보다 더 빠르게 시장에 GPU들을 내놓을 수 있었고 여기에는 경쟁사보다 빠르게 적용된 미세공정의 덕도 톡톡히 보고 있다. 그리고 그래픽 처리에 특화된 기능의 확장에 많은 수의 트랜지스터를 할당하여 처리 효율 및 성능을 높이는 것도 포함된다. 결과적으로 최근에 등장한 HD 5800 시리즈는 HD 4800 시리즈의 800개의 스트림 프로세서보다 2배 가량 더 늘어난 1600/ 1440개의 스트림 프로세서를 제공할 수 있게 된 것도 AMD ATI의 GPU 전략 덕분이다.

NVIDIA는 단일 GPU 최고 성능이 목표

NVIDIA는 AMD ATI와는 약간 다른 GPU 개발 전략을 갖고 있다. 우선 단일 GPU로 최고 성능을 제공하는 GPU를 개발한 후 고성능 듀얼 GPU나 하위 제품들을 만드는 방식이다. 이 방식의 장점은 높은 성능을 제공하는 것이지만, 그에 따른 여러 가지 단점들도 갖게 된다.

단일 GPU로 최고 성능을 목표로 하다보니 GPU 내부 연산 성능개선과 명령 제어부가 이전보다 복잡해지며, 범용성에도 중점을 두고 개발되다보니 다이 사이즈가 경쟁사보다 커지는 것은 물론 이에 따른 발열이나 소비전력도 크게 늘어난다. DX11 GPU로 알려진 GT300 역시 HD 5800 시리즈에 사용된 RV870보다 더 커질 것으로 알려지고 있으며, 제조 공정은 40nm로 서로 같으나 비교적 최근까지 AMD ATI보다 한 단계씩 느린 공정이 적용되곤 했다.

또, 다이 사이즈가 커지면서 실리콘 웨이퍼 당 생산할 수 있는 GPU의 수가 크게 줄어 칩의 생산과 제조에 드는 비용이 경쟁사보다 크게 늘어난다는 것도 문제가 된다. 최근에는 이런점들에대한 지연 때문에 개발 시간도 느려져 경쟁사보다 느리게 시장에 제품을 내놓는 문제도 발생되고 있다.

 

전략에 따라 효율도 달라

AMD ATI와 NVIDIA의 GPU 개발 전략의 차이에 따라 각 GPU의 효율도 다르다. 일반적으로 NVIDIA GPU 아키텍처는 어떤 프로그램이라도 효율적으로 실행이 가능한 장점을 가지지만, 명령 제어 유닛이 상대적으로 커져 GPU 다이 사이즈가 커지는 문제를 가진다.

AMD ATI의 GPU 아키텍처는 그래픽 연산 처리의 효율이 높은 장점을 갖게 되지만, 그 외의 프로그램에서의 성능 차가 나타날 가능성이 높은 단점을 동시에 갖는다. 그러나, 명령 제어 유닛이 NVIDIA GPU들보다 상대적으로 적기 때문에 실질적인 연산 실행유닛의 수는 크게 증가되며, 이에 따라 AMD ATI GPU들이 트랜지스터 당 성능 효율이 높다.

 

최근 AMD ATI와 NVIDIA 양사는 그래픽 연산처리 능력을 향상시키기 위해 GPU를 개선하고 있는 것과 동시에 GPU의 병렬 컴퓨팅 즉, GPGPU 기술 지원에도 힘을 쏟아 이에 보다 최적화된 GPU 구조를 도입하고 있다.

GPU의 듀얼코어화 역시 AMD ATI가 경쟁사인 NVIDIA보다 빠르게 이루어져 각사의 전략에 따른 차이가 드러나고 있다.

이전 페이지로 돌아갑니다 다음 페이지로 이동합니다
이 기사의 의견 보기
vobavoba (ID) vobavoba님의 미디어로그 가기  / 09-09-30 20:17/ 신고
이제는 GPU도 멀티시대군요..X2이런거랑은 다르네요
ho5945 (ID) ho5945님의 미디어로그 가기  / 09-09-30 20:26/ 신고
그럼 GPU는 단순하면서도 연산처리유닛의 종류가 적지만 그만큼 단순반복 유닛의 수가 많은거고 CPU는 복잡하지만 범용적이면서 연산처리유닛의 종류는 많지만 수가 적은거겠네요?
GPU와 CPU의 차이가 이런것이었을 줄이야...

내용이 굉장히 마음에 듭니다. 이 기사를 개인소장해버리고 싶어지네요~
jeehy (ID) jeehy님의 미디어로그 가기  / 09-09-30 20:52/ 신고
870이 770의 아키텍쳐를 그대로 승계했다고 하더니
그래도 내부적으로는 많은 변화가 있었군요.
특히 전혀 모르던 사항에 대한 심도 깊은 기사가 아주 좋네요.
kado (ID) kado님의 미디어로그 가기  / 09-09-30 21:51/ 신고
제가 바라던대로 되네요.. 크파네 sli네 이런 삽질은 이제 그만두고 이렇게 가야 정상이지요
blasty (ID) blasty님의 미디어로그 가기  / 09-09-30 22:10/ 신고
현재 40 나노 공정도 상당히 애를 먹었는데, 집적의 한계를 이런 식으로 해결할수 있겠군요
king8407 (ID) king8407님의 미디어로그 가기  / 09-09-30 22:41/ 신고
CPU와 GPU가 잘 연결되어 간다면 잘 어울릴거 같네요.
bigfog (ID) bigfog님의 미디어로그 가기  / 09-09-30 22:44/ 신고
생각해 보니, 성능이니 오버니 전력사용량등에 대한 기사는 넘치고 넘치는데, 아키텍처에 대한 기사를 보드국에서 처음 본 것 같군요...~0~; (영어는 까막눈이니 영문사이트는 제외 ~0~;;;)
좋은 기사 잘 보고 갑니다. ^^
lordstar (ID) lordstar님의 미디어로그 가기  / 09-09-30 22:54/ 신고
ATI도 나름대로 타개책을 강구하고 있군요.
꾸준한 노력 덕분인지 좋은 제품이 계속 나와서 다행입니다.
bmw375 (ID) bmw375님의 미디어로그 가기  / 09-09-30 22:58/ 신고
AMD와 ATI의 합병으로 인해 CPU와 GPU에 각각 존재하던 기술이 합쳐지기 시작하는 느낌이 드는군요. 과연 다음 세대에서는 어떤 모습으로 발전할지 기대됩니다.
f15cc (ID) f15cc님의 미디어로그 가기  / 09-10-01 0:18/ 신고
점점 효율적인 구조로 가고있는것 같네요
uncompress (ID) uncompress님의 미디어로그 가기  / 09-10-01 1:07/ 신고
와... 뭘 먹으면 바이퍼투님처럼 박식해 지나요?
zzbaebae (ID) / 09-10-01 5:52/ 신고
좋은 기사 감사한 마음으로 읽고 갑니다.
valkyrie (ID) valkyrie님의 미디어로그 가기  / 09-10-01 9:17/ 신고
듀얼코어 구조로 바뀐다는 의미가 이런 의미였군요. 앞으로 AMD가 어떤 방향으로 GPU를 만들어갈지 눈에 보이는듯한 기분입니다.
redcurse (ID) redcurse님의 미디어로그 가기  / 09-10-01 9:48/ 신고
이제 GPU도 날로 새롭게 발전해나겠네요
kama136 (ID) / 09-10-01 10:39/ 신고
단순히 공정이나 약간의 개선이 아닌 내부적으로 변화가 있었군요.
hyeimi (ID) / 09-10-01 10:58/ 신고
가려운 곳을 긁어주는 내용 잘 읽었습니다.
bluemun (ID) bluemun님의 미디어로그 가기  / 09-10-01 11:27/ 신고
RV870에 이런 기술이 들어 가 있었군요. SIMD가 멀티코어 형태로 발전하는 것이 어쩌면 앞으로 발전 방향 같기도 하는데 GT300은 이런 문제를 어떻게 극볼할지..
noblechae (ID) / 09-10-01 11:55/ 신고
그러니까 작업영역을 나누어놨다고 보면되는건가요? 어째든 기존의 GPU와 다른 아키텍쳐라는건 분명하네요.
actium (ID) actium님의 미디어로그 가기  / 09-10-01 12:12/ 신고
이제는 GPU도 듀얼코어의 시대가 되었군요. 하기사 그럴때도 되었지요. 발열과 소모전력을 줄이기 위해서는 가야할 길이니...
sd1015 (ID) / 09-10-01 19:09/ 신고
AMD 화이팅입니다~!
tototro (ID) tototro님의 미디어로그 가기  / 09-10-01 19:19/ 신고
나와라 나와...기대가 되네요...
lomelindy (ID) / 09-10-01 20:36/ 신고
이제 갈수록 저 숫자가 늘겠죠..-ㅂ- GPU 쿼드도 한 2년안에 볼기세..
그럼 CPU는 얼마나 늘어나게 될까요.
naturelove / 09-10-01 22:19/ 신고
123
neturelove (ID) / 09-10-01 22:22/ 신고
예전에 CPU가 멀티코어로 성능을 향상 시키고 있을 때, GPU는 어떤식으로 성능을 향상시키고 있는지 궁금했던적이 있었고, 또 멀티코어로 언젠가는 갈것이라고 생각은 했었는데... 드디어 시작이군요! 기사 내용도 알차고 좋네요 ^^
leebr21 (ID) leebr21님의 미디어로그 가기  / 09-10-02 11:13/ 신고
기술은 끊임없이 발전하는군요. 듀얼 쿼드 그래픽이 계속 나오면 성능이 엄청나겠습니다! ㅎㅎ
whdnzj / 09-10-02 14:34/ 신고
msinp (ID) / 09-10-02 23:45/ 신고
좋은 정보 잘보고 갑니다~
ohye701 (ID) ohye701님의 미디어로그 가기  / 09-10-06 23:14/ 신고
그것만으로도 우세를 점하는 모습을 보인다는것으로 가치는 인정받을수 있겠죠.
jackyang (ID) jackyang님의 미디어로그 가기  / 09-10-07 3:01/ 신고
Gpu도 듀얼코어가 나오기 시작하는군요. 그러나 결국은 가야할길이긴 한듯 보이네요.
메이알 / 09-10-14 1:02/ 신고
와, 이렇게 가다가 CPU와 GPU가 통합된 하나의 코어가 보드에 박힌채로 나오는건 아닌지 모르겠네요.
닉네임 lock
비회원

보드나라 많이 본 뉴스
보드나라 많이 본 기사

보드나라 최신 기사
[09/30] 삼성 갤럭시 S27 울트라 카메라 배치 바뀐다? 케이스 디자인 유출  
[09/30] 엔비디아, AI 보안 위한 엔지니어링 접근법 제시.. 에이전트 스택 전 계층 보호  
[09/30] 뉴빌리티, 공간지능에 조작 더한 능력 하이브리드 휴머노이드 ‘빌리’ 공개  
[09/30] 가레나, ‘몬스터헌터 아웃랜더스’ 10월 29일 정식 출시!  
[09/30] 히어로즈 오브 더 스톰, 신규 영웅 ‘잘아타스’ 시공의 폭풍 합류  
[09/30] 파워서플라이에 버그 방지 기능이? 그레이트 월(Great Wall) GW-330SF 출시  
[09/30] 구글, 크롬OS 지원 2034년 종료하고 구글북OS로 전환  
[09/30] 중국 YMTC, 독일서 마이크론 상대 NAND 특허 소송 일부 승소  
[09/30] 매스웍스, 매트랩 및 시뮬링크 릴리즈2026b 발표  
[09/30] 젠하이저, 차세대 3웨이 모니터 스피커 노이만 ‘KH 310 II’ 및 ‘KH 350’ 출시  
[09/30] 레노버, ThinkAgile VX850 V4 공개…가상화 인프라 현대화 포트폴리오 확대  
[09/30] 서린씨앤아이, 아틱 워크스테이션 수랭 쿨러 Liquid Freezer WS360 3종 출시  
[09/30] AI 게임 1인 개발자 시대, 원스토어 AI로 만든 게임 누구나 등록  
[09/30] 슈퍼마이크로, 엔비디아 베라 루빈 NVL72 랙 출하 개시  
[09/30] 스틸시리즈, 퀵스위치 도크 시스템 적용 차세대 컨트롤러 '이온 프로' 국내 출시  
[09/30] 게임위, 게임이용자 권익 보호를 위한 업무협약 체결  
[09/30] 넥슨 ‘아크 레이더스’, 10월 8일 대규모 업데이트 ‘얼어붙은 산길’ 예고!  
[09/30] 니콘이미징코리아, 쉽고 직관적인 풀프레임 미러리스 카메라 ‘Z5IIC’ 발표  
[09/30] 호요버스 코리아, 53만 여행자와 함께 만든 ‘원신 숲’ 오픈!  
[09/30] 라이엇 게임즈 TFT, 공군과 함께 ‘에어 포스 컵’ 개최  
로그인 | 이 페이지의 PC버전
Copyright NexGen Research Corp. 2010