SpikingBrain 연구를 소개한 글은 선형 구조와 선택적 활성화를 활용해 긴 문맥 처리 비용을 줄이는 접근을 설명한다. 3월 공개된 논문에서 400만 토큰 입력의 첫 토큰 생성 시간이 비교 대상보다 100배 이상 빨라졌다는 결과를 제시했다. 7B 모델과 일부 매개변수만 활성화하는 76B 모델을 다뤘지만 작업 조건에 따라 이점은 달라질 수 있다. 특히 최대 97.7% 에너지 절감은 연산 모델에 근거한 추정으로, 실제 데이터센터 전력 소비를 측정해 그만큼 줄였다는 의미는 아니다.