엑셀레라 ‘Europa’ 공개…629 TOPS·45W로 서버 AI 추론 시장 공략
유럽 AI 반도체 스타트업 엑셀레라 AI가 629 TOPS 성능과 45W TDP를 내세운 2세대 추론 가속기 ‘Europa’를 출시했습니다. Dell·Supermicro 검증 서버와 PCIe 카드로 공급해 엣지에서 기업 서버까지 같은 소프트웨어로 확장한다는 전략입니다. 성능·효율 비교치는 회사 내부 시험이므로 독립 검증이 필요합니다.

엣지 칩 회사가 기업 서버로 올라왔다
네덜란드 AI 반도체 스타트업 엑셀레라 AI가 9월 15일 2세대 AI 처리장치 ‘Europa’를 공개하고 출하를 시작했습니다. 1세대 Metis가 카메라 분석과 로봇 같은 엣지 작업에 초점을 맞췄다면 Europa는 비전언어모델, 생성형 AI와 여러 사용자가 동시에 쓰는 기업 서버까지 범위를 넓힙니다. 로이터는 회사가 Dell·Supermicro 제품과의 검증, 유럽 AI 팩토리 공급 계약을 확보했다고 보도했습니다.
형태도 한 가지가 아닙니다. 보드 설계 고객을 위한 칩, 하프하이트·하프렝스 PCIe 카드 ‘Edge 232p’, 풀하이트·풀렝스 카드 ‘Server 250p’로 제공됩니다. 기존 서버의 PCIe 슬롯에 추론 용량을 더하는 방식이어서 전용 랙 전체를 새로 들이지 않아도 된다는 것이 회사의 제안입니다. Edge 232p는 Dell XE5와 Supermicro 111AD 시스템에서 검증됐습니다.
629 TOPS와 45W 안에 넣은 구성
Europa는 8개의 2세대 AI 코어에서 629 TOPS를 내고 열설계전력은 45W입니다. INT4·INT8·INT16 연산을 지원하며, 전처리와 후처리를 맡는 16개 RISC-V 벡터 코어를 별도로 넣어 호스트 CPU가 업무 로직에 더 집중하도록 설계했습니다. 메모리 계층은 128MB L2 SRAM과 200GB/s DRAM 대역폭이며 비디오 디코더도 칩에 통합했습니다.
엑셀레라는 삼성 파운드리 5나노 공정으로 Europa를 생산한다고 밝혔습니다. 제품 페이지의 데모에서는 Qwen3-VL-8B가 기기 안에서 영상 내용을 자연어로 검색하며, 사전 라벨링이나 클라우드 전송 없이 처리합니다. 이는 특정 구성의 시연 결과이므로 모든 모델이 같은 속도와 정확도로 동작한다는 뜻은 아닙니다. 모델 변환, 메모리 용량과 서버 냉각이 실제 처리량을 좌우합니다.
Dell·E4와 유럽 AI 팩토리 공급
엑셀레라는 Dell Technologies와 시스템 통합사 E4 Computer Engineering을 통해 이탈리아 IT4LIA와 룩셈부르크 MeluXina의 EU AI 팩토리 사업에 가속기를 공급한다고 설명했습니다. 회사는 전 세계 600곳이 넘는 고객 배치를 확보했고, 확정 계약 규모는 수천만달러 수준이라고 로이터에 밝혔습니다. 방산·로봇·드론·유통·보안처럼 데이터를 현장 밖으로 보내기 어려운 영역이 주요 시장입니다.
회사가 말한 15억달러는 이미 인식된 매출이나 주문이 아니라 협상 중인 영업 파이프라인입니다. 고객 검증과 예산 집행을 거쳐야 실제 계약이 됩니다. 유럽산 가속기, 유럽 서버 통합과 데이터 주권을 묶은 제안은 정책적 수요와 맞지만, 대규모 운영에서의 안정성·개발도구 완성도·모델 지원 폭은 배치 사례가 늘어난 뒤 판단해야 합니다.
하나의 Voyager SDK로 엣지와 서버 연결
개발 측면에서는 Metis와 Europa가 같은 Voyager SDK를 사용합니다. YAML 설정으로 모델 컴파일, 최적화와 영상·언어모델 파이프라인 배포를 이어가고, 에이전트형 도구 Voyager Wingman과 모델 컴파일 방식 AxeleraScript도 제공합니다. 1세대 보드에서 만든 응용을 서버급 카드로 옮길 때 코드를 전부 다시 짜지 않게 하려는 전략입니다.
이 호환성은 하드웨어 수치만큼 중요합니다. 추론 시장에서는 지원 모델과 연산자, 디버깅, 업데이트가 부족하면 이론 성능을 활용하기 어렵기 때문입니다. 특히 고객이 NVIDIA 중심 환경에서 옮겨올 때는 CUDA 생태계와 비교한 개발 시간, 프레임워크 호환성, 장기 지원 정책이 도입 비용을 결정합니다.
효율 수치는 ‘제조사 주장’으로 읽어야
엑셀레라는 경쟁 GPU 대비 최대 6배 높은 와트당 토큰 처리량, 3~5배 높은 달러당 성능과 2~3배 높은 와트당 성능을 제시했습니다. 또 일부 비교에서는 같은 비용에서 초당 토큰이 8배이고 비용은 25%라고 주장합니다. 그러나 제품 페이지 각주는 엑셀레라 내부 시험과 경쟁사 공개자료를 조합한 값이라고 명시합니다. 동일 모델·배치·정밀도·전력 측정 조건의 제3자 비교는 아직 아닙니다.
따라서 Europa의 의미는 ‘GPU를 대체했다’보다 저전력 PCIe 추론 카드에 또 하나의 선택지가 생겼다는 데 있습니다. 실제 구매 판단에는 목표 모델별 지연시간과 처리량, 서버 전체 소비전력, 카드 가격, 장애 대응과 SDK 유지보수를 함께 봐야 합니다. 유럽 AI 팩토리와 600개 고객 현장에서 쌓일 운영 데이터가 회사의 효율 주장을 검증하는 다음 단계입니다.
기사가 마음에 드셨다면 하트를 눌러주세요.
기사 읽고, 잠깐 게임 한 판 어떠세요?

플레이 실력에 맞춰 난이도가 달라지는 15×15 오목
미니게임 고르기 ▶