- 구글이 Cloud Next 2026에서 학습 전용 TPU 8t와 추론 전용 TPU 8i 등 8세대 TPU를 공개하며 학습·추론 칩을 분리한 수직 최적화 전략을 발표했다.
- TPU 8t는 단일 슈퍼포드 기준 9600개 칩 연결로 초당 100경 연산(121엑사플롭스) 성능을 구현하고, 버고 네트워크와 결합 시 최대 100만 칩 규모 클러스터 운용으로 학습 시간을 획기적으로 단축한다.
- TPU 8i는 칩당 288GB 고대역폭 메모리·384MB 온칩 SRAM과 Boardfly 아키텍처로 지연·전력 효율을 개선(전세대 대비 성능·효율 약 80% 향상)했고, 구글은 Axion CPU 통합 및 제미나이 엔터프라이즈 에이전트 플랫폼을 출시해 외부 모델 지원과 카카오뱅크·CJ올리브영 등의 도입을 발표했다.