LG유플러스·옵트에이아이, 같은 GPU 토큰 처리량 최대 4배…초기 연구 성과

약 2분 읽기

LG유플러스는 2026년 10월 2일 옵트에이아이와 토큰 최적화 기술 확보를 추진하며, 진행 중인 서버 GPU 연구에서 같은 GPU의 토큰 처리량을 기존 대비 최대 4배로 높였다고 밝혔다. 데일리안

스마트폰 NPU의 '경량화'와 서버 GPU의 '처리량 확대' 비교

온디바이스 NPU 최적화와 서버 GPU 토큰 처리량 연구 비교를 나타낸 개념 일러스트
본문 내용을 정리한 개념도 · AI 생성

양사는 그동안 스마트폰 등 기기 자체에서 AI를 구동하는 온디바이스 AI 분야에서 성능 최적화 기술을 검증해왔다. LG유플러스의 '엑사원' 기반 소형언어모델(sLM)에 경량화 기술을 적용해 NPU에서 구동한 결과, 기존 CPU 방식과 동일한 수준의 성능을 유지하면서 전력 소모는 78%, 모델 크기는 82% 줄였다. 데일리안

이번에 연구를 확대한 서버 GPU 환경에서는 연산 과정을 실제 서비스 환경에 맞춰 개선하는 데 중점을 둔다. 초기 연구 결과, 같은 GPU에서 처리할 수 있는 토큰량이 기존 대비 최대 4배로 늘어났다. 데일리안

별도로 진행 중인 파주 AI 데이터센터 확장

LG유플러스·옵트에이아이 AI 최적화 주요 수치 인포그래픽
LG유플러스·옵트에이아이 AI 최적화 주요 수치

LG유플러스는 이와 별도로 경기 파주시에 AI 데이터센터(AIDC)를 구축하고 있다. 2026년 6월 디지털데일리 보도에 따르면, 파주 AIDC는 2025년 5월 착공해 2027년 1동(50MW 규모) 준공을 목표로 공사가 진행 중이다.

같은 보도 기준으로 파주 AIDC가 확보한 전력은 200MW 수준이다. 별도로 LG유플러스는 2030년까지 총 600MW 규모의 AI 데이터센터 확보 계획을 제시했지만, 구체적인 후속 로드맵은 공개하지 않았다. 디지털데일리

세미나 개최, 상용 적용 일정은 미제시

양사는 2026년 10월 1일 'Efficient AI 테크 세미나'를 공동 개최해 퓨리오사AI, 베슬에이아이 등 산·학·연 전문가들과 AI 모델 최적화 동향과 산업 적용 사례를 공유했다. 데일리안

데일리안 보도에는 현재 연구 중인 GPU 기반 토큰 최적화 기술의 상용 서비스 적용 시점과 도입 로드맵이 제시되지 않았다. 실제 서비스 환경에서 응답 품질과 서비스 품질을 유지했는지 보여주는 검증 결과도 이 보도만으로는 확인할 수 없다.

블로그 네클이 함께 운영하는 무료 서비스

접속 - | 오늘 - | 어제 - | 전체 -
위로 스크롤