HyperAccel
Hyper-Accelerate AI Performance
with Next-Generation LPU Inference Chip
Cloud부터 Edge까지, 생성형 AI 추론을 위한 차세대 LPU(LLM Processing Unit) 칩과 표준화된 소프트웨어 생태계 HyperDex를 제공합니다.
HyperAccel 핵심 기능

Bertha Accelerator
- · 384TFLOPS(FP16) · 768TOPS(INT8), 32코어
- · Llama3.1 70B 추론 처리량 최대 4배, 비용효율 42.2배

Orion Server
- · LPU-Only: 8x LPU, HBM 3.68TB/s, TPOT 11.11ms
- · LPU-GPU Hybrid: 4xLPU+2xGPU, TTFT 0.5초 미만

LPU vs GPU 성능
- · A-GPU 대비 처리량 최대 2.15배 향상
- · A-GPU 대비 에너지 효율 최대 4.49배 향상

LPU IP
- · Latency Optimized(Edge) · High Performance(Cloud) · Balanced
- · 최대 24 TOPS/core(INT8), 다이 면적 5.29~7.91mm²

HyperDex 소프트웨어 생태계
- · Llama·Qwen·Gemma·Phi·Exaone·Solar·DeepSeek 등 지원
- · Runtime, Device Driver, Developer Portal & Model Zoo 제공

멀티모달 & 자동 컴파일
- · 멀티모달 모델 지원
- · 병렬화·매핑·명령어 생성 자동 컴파일 최적화
공식 사이트
하이퍼엑셀

