OpenAI와 Broadcom, LLM 추론 칩 공개
OpenAI 할라페뇨는 와트당 성능을 개선해 LLM 추론을 향상시킵니다 새 Broadcom 칩이 AI 서비스를 더 빠르게 하고 비용을 줄일 수 있는 방법을 확인해 보세요
OpenAI와 Broadcom은 대규모 언어 모델 추론을 위해 특별히 설계된 새로운 AI 가속기 Jalapeño를 공개했습니다. 두 회사는 이 칩이 와트당 성능을 향상하고, 다세대 컴퓨팅 플랫폼 전반에서 현재와 미래의 LLM 작업 부하를 지원하도록 만들어졌다고 밝혔습니다.
OpenAI에 따르면, Jalapeño는 OpenAI 모델, Broadcom의 실리콘 전문성, 그리고 Celestica를 포함한 파트너들의 도움을 받아 설계부터 테이프아웃까지 9개월 만에 개발되었습니다. 이 칩은 데이터 이동을 줄이고, 효율성을 높이며, 데이터 센터에서 대규모 배포를 지원하는 것을 목표로 합니다.
OpenAI는 초기 테스트 결과 이 가속기가 현재의 최고 수준 시스템보다 에너지 효율성 면에서 상당히 더 뛰어난 성능을 보이는 것으로 나타났다고 밝혔지만, 전체 기술 결과는 아직 공개되지 않았습니다. 첫 배치는 AI 서비스를 더 빠르고, 더 신뢰할 수 있으며, 더 저렴하게 만들기 위한 광범위한 인프라 노력의 일환으로 2026년에 시작될 것으로 예상됩니다.