AI가 설계한 오픈소스 AI 가속기 openTPU 공개

원제: OpenTPU – An open-source AI accelerator, developed by AI

왜 중요한가

AI가 자신의 추론 하드웨어를 설계하는 자기참조적 사례로, 오픈소스 AI 가속기 개발 방식에 새로운 가능성을 제시한다.

FeSens가 AI 에이전트로 개발한 오픈소스 AI 가속기 'openTPU'를 GitHub에 공개했다. SystemVerilog RTL, ISA, 시뮬레이터, 컴파일러, 프로파일러를 단일 저장소에 통합했으며, Kintex-7 PCIe 카드에서 Qwen3, LFM2.5, Qwen3.5 모델 실행을 확인했다.

openTPU는 AI 에이전트가 하드웨어를 어디까지 설계할 수 있는지, 그리고 AI가 자신의 추론을 실행하는 칩을 직접 만들 수 있는지를 탐구하는 프로젝트다. 기존 'auto-arch-tournament' 프로젝트의 교훈을 AI 가속기 설계에 적용한 결과물이다.

저장소는 하드웨어 설계(SystemVerilog), 명령어 세트(ISA), 비트 정밀 시뮬레이터, 커널 언어 및 컴파일러, 실제 PCIe 카드를 구동하는 호스트 소프트웨어까지 전 스택을 포함한다. Xilinx Kintex-7 FPGA 기반 PCIe 카드에서 LFM2.5-230M 모델 추론을 실제로 실행했으며, 카드 활용률과 DRAM 대역폭을 모니터링하는 'otpu-smi' 도구도 함께 제공된다.

프로젝트는 학습 목적도 명시하고 있다. Python의 행렬 곱셈 연산부터 실제 회선 수준까지, AI 가속기가 작동하는 원리를 처음부터 끝까지 읽을 수 있도록 소형 단일 저장소 형태로 구성했다. 현재 GitHub에서 star 204개, fork 8개를 기록하고 있으며, 라이선스는 Apache-2.0이다.

출처

github.com — 원문 읽기 →