국내 팹리스 스타트업이 설계한 AI 추론용 반도체가 한 클라우드 기업의 데이터센터에 1만 장 규모로 공급된다. 국산 AI 반도체가 상용 데이터센터에 대량으로 들어가는 것은 이번이 처음이다.

해당 칩은 대규모 언어모델의 추론 작업에 특화돼 있으며, 같은 작업 기준 전력 소모를 기존 그래픽처리장치(GPU) 대비 40%가량 줄였다고 회사 측은 설명했다. 연말까지 순차 설치를 마치고 내년 초부터 서비스에 투입될 예정이다.

업계에서는 전력 비용이 데이터센터 운영의 최대 부담으로 떠오른 상황에서 저전력 추론 칩 수요가 빠르게 늘 것으로 보고 있다. 한 업계 관계자는 “학습은 GPU, 추론은 전용 칩이라는 분업 구도가 굳어지고 있다”고 말했다.

다만 소프트웨어 생태계는 과제로 꼽힌다. 개발자들이 익숙한 도구와의 호환성을 얼마나 빨리 확보하느냐가 추가 수주의 관건이 될 전망이다.