AI가 직접 설계한 오픈소스 추론 가속기 'openTPU' 공개
SystemVerilog부터 컴파일러·호스트 SW까지 단일 레포로 공개. AI 칩 동작 원리 학습에 최적.
요약
AI가 자체 추론 하드웨어를 설계할 수 있는 가능성을 보여주는 오픈소스 AI 가속기 프로젝트 openTPU가 공개되었다. 이 프로젝트는 시스템 설계부터 명령어 세트, 시뮬레이터, 컴파일러, 호스트 소프트웨어까지 하드웨어 전 과정을 단일 모노레포에서 확인할 수 있는 학습용 자료를 제공한다. 현재 Inspur YPCB-00338 카드(Xilinx Kintex-7)에서 LFM2-2.6B, SmolLM3-3B, Phi-4-mini, Qwen3.5-2B/4B, Gemma 4 등 총 10개의 현대적 모델을 구동하고 있다. 2026년 9월 말부터 10월 초까지 진행된 테스트 결과, 최신 빌드인 B 버전은 이전 버전 대비 8~10% 향상된 추론 속도를 보였으며 DRAM 피크 대역폭의 91~94% 수준까지 활용 효율을 끌어올렸다. 본 프로젝트는 Python 기반의 행렬 연산부터 실제 회로 동작까지 AI 가속기의 전 과정을 이해하려는 실무자에게 유용한 참고 자료가 될 것이다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 AI is now capable of developing its own inference hardware
원문 보기 ↗