AMD, AI 모델을 실리콘에 직접 각인하는 Taalas 인수
모델을 칩에 하드코딩해 메모리 병목 없이 초당 1만 토큰 주장. 로컬 추론 판도 변수로 주시할 만함.
요약
AMD가 AI 모델을 실리콘에 직접 구현하는 기업 Taalas를 인수하며 AI 인프라 시장에 큰 변화를 예고했다. Taalas의 기술은 메모리 병목 현상을 완전히 제거하여 PCIe 카드만으로도 초당 10,000 토큰이라는 극도로 빠른 속도의 AI 추론을 가능하게 한다. 이 기술은 별도의 서버 없이 로컬 기기 내에서 대규모 AI 모델을 구동할 수 있어 탈중앙화 AI 발전을 가속할 것으로 기대된다. 또한 에이전트 루프와 결합할 경우, 개인 데스크톱 수준에서 복잡한 AI 코딩, 글쓰기, 분석 작업이 실시간으로 수행될 수 있다. 이번 인수를 통해 AMD는 클라우드 중심의 Anthropic이나 OpenAI와는 차별화된 온디바이스 AI 경쟁력을 확보할 것으로 보인다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @HealthRanger: Here's why Anthropic and OpenAI are screwed: AMD just bought Taalas, a company that hard-burns AI models into silicon, completely
원문 보기 ↗