인텔은 첨단 반도체 기술을 발표하는 업계 컨퍼런스인 '핫 칩스 2024(Hot Chips 2024)'에서 인텔 제온 6 SoC, 루나 레이크 클라이언트 프로세서, 인텔 가우디 3 AI 가속기(Intel Gaudi 3 AI accelerator), OCI 칩렛과 관련된 기술 논문 4건을 발표했다.
엣지를 위해 설계된 차세대 인텔 제온 6 SoC(코드네임 Granite Rapids-D)는 단일 시스템 아키텍처와 통합된 AI 가속 기능을 사용하여 엣지 디바이스에서 엣지 노드까지 확장할 수 있어, 기업은 데이터 수집부터 추론에 이르기까지 전체 AI 워크플로우를 보다 쉽게, 효율적으로, 그리고 안전하게 관리할 수 있다. 인텔은 이를 통해 의사 결정이 개선되고 자동화가 증가하며 고객에게 더 큰 가치를 제공할 수 있다고 알렸다.
인텔 제온 6 SoC는 인텔 제온 6 프로세서의 컴퓨트 칩렛과 인텔 4 공정 기술을 기반으로 설계된 엣지에 최적화된 I/O 칩렛을 결합했다. 이를 통해 SoC는 이전 모델에 비해 성능, 전력 효율 및 트랜지스터 집적도 면에서 상당한 개선을 이룰 수 있었다. 이번 SoC의 주요 특징은 다음과 같다.
• 최대 32레인의 PCI 익스프레스(PCI Express, PCIe) 5.0
• 최대 16레인의 컴퓨트 익스프레스 링크(Compute Express Link, CXL) 2.0
• 2x100G 이더넷(Ethernet)
• 호환되는 BGA 패키지로 제공되는 4개 및 8개의 메모리 채널
• 작동 온도 범위 확장 및 산업용 수준에 적합한 신뢰성을 포함한 엣지별 개선 사항 적용으로 고성능 러기드(rugged) 장비 최적화
또한 인텔 제온 6 SoC는 새로운 미디어 가속화 기술을 탑재하여 실시간 OTT, VOD 및 방송용 비디오 트랜스코드 및 분석 기능을 제공하는 등 엣지 및 네트워크 워크로드의 성능 및 효율을 개선하기 위한 기능을 제공한다.
추론 성능 향상을 위한 인텔 AVX(Advanced Vector Extensions) 및 인텔 AMX(Advanced Matrix Extensions), 보다 효율적인 네트워크 및 스토리지 성능을 위한 인텔 QAT (QuickAssist Technology), vRAN(virtualized RAN)의 전력소모 감축을 위한 인텔 vRAN 부스트(Intel vRAN Boost) 그리고 사용자가 기본 하드웨어에서도 클라우드처럼 편리하게 AI 솔루션을 구축, 전개, 실행, 관리 및 엣지 스케일링 할 수 있도록 하는 인텔 타이버 엣지 플랫폼(Tiber Edge Platform) 지원을 제공한다.
루나 레이크(Lunar Lake) 클라이언트 프로세서가 x86 전력 효율성에서 새로운 기준을 세우는 동시에 최고의 코어, 그래픽, 클라이언트 AI 성능을 제공하도록 설계된 방법에 대해 발표했다. 새로운 P-코어와 E-코어는 이전 세대에 비해 시스템 온 칩 전력을 최대 40%까지 낮추면서 뛰어난 성능을 제공한다.
새로운 신경처리장치(NPU)는 최대 4배 더 빠른 속도를 자랑하며, 이전 세대 대비 생성형 AI(GenAI) 성능을 크게 향상시킨다. 또한, 새로운 Xe 2 그래픽처리장치(GPU) 코어도 게임 및 그래픽 성능을 이전 세대보다 1.5배 향상시킨다.
루나 레이크에 대한 추가 세부 사항은 9월 3일에 열리는 인텔 코어 Ultra 출시 행사에서 공개될 예정이다.
생성형 AI 학습 및 추론을 위해 설계된 인텔 가우디 3 AI 가속기
인텔 가우디 3 AI 가속기는 효율적인 행렬 곱셈 엔진, 이중 캐시 통합, 광범위한 RoCE(RDMA over Converged Ethernet) 네트워킹 등 다양한 전략을 채택하고 있다. 이를 통해 연산, 메모리 및 네트워킹 아키텍처를 최적화하여 이러한 문제를 해결한다.
이를 통해 가우디 3 AI 가속기는 AI 데이터센터가 더욱 비용 효율적이고 지속 가능하게 운영될 수 있도록 성능과 전력 효율성을 크게 향상시켜, 생성형 AI 워크로드 배포 시 발생하는 확장성 문제를 해결한다.
가우디 3 AI 가속기와 향후 출시될 인텔 제온 6 제품에 대한 자세한 정보는 9월에 열리는 출시 행사에서 공개될 예정이다.
초당 4 테라비트 OCI 칩렛을 이용한 XPU 간 연결 기술
인텔 IPS(Integrated Photonics Solutions) 그룹은 업계 최초로 완전 통합 광학 컴퓨트 인터커넥트(Optical Compute Interconnect, 이하 OCI) 칩렛을 인텔 CPU에 코-패키징(co-packaged)하여 실시간 데이터를 실행하는 최첨단 기술을 시연했다.
OCI 칩렛은 최대 100m의 광섬유에서 각 방향으로 32Gbps 데이터 전송 64채널을 지원하도록 설계되었으며, 인텔은 더 높은 대역폭, 더 낮은 전력 소비, 더 긴 도달 거리에 대한 AI 인프라의 수요를 충족시킬 수 있을 것으로 기대한다고 전했다.
인텔의 OCI 칩렛은 일관된 메모리 확장 및 리소스 분리를 포함한 새로운 컴퓨팅 아키텍처와 CPU/GPU 클러스터 연결의 향후 확장성을 지원하며 데이터 센터 및 고성능 컴퓨팅(HPC) 애플리케이션을 위해 새롭게 등장하는 AI 인프라에서 코-패키징된 광학 I/O을 지원함으로써 고대역폭 인터커넥트의 비약적인 발전을 보여준다. |