Crusoe는 GLM-5.2-NVFP4 모델을 두 개의 8×B200 노드에서 비교 실험했습니다.
using `GLM-5.2-NVFP4` on two 8xB200 nodes.
Crusoe는 B200 기반 추론 설정 최적화에서 출력 토큰당 에너지 26.9% 감소, 별도 MemoryAlloy KV-cache 실험에서 23% 감소를 보고했습니다. 개별 부하·GPU 전력 기준의 실험 결과입니다.
캐시 재사용과 GPU 간 데이터 이동 효율은 토큰당 비용과 HBM 활용도를 바꿉니다. 영업 대응은 추론 고객의 캐시 계층·메모리 용량·실제 설치 구성을 중심으로 검토하고, 에너지 절감률을 메모리 주문 증감률로 환산하지 않습니다.
using `GLM-5.2-NVFP4` on two 8xB200 nodes.
26.9% less energy per output token
MemoryAlloy cut energy per token by 23%
변화 → 고객·시스템 → 제품 지표 → 전략 선택지 경로를 기록하세요.
연결된 과제가 없습니다.