TREE NEWS 소식: DeepSeek는 9월 10일 새로운 아키텍처 시리즈 중 가장 작은 모델인 DeepSeek V4.1 Flash를 출시했다. 네이티브 멀티모달 시각 이해를 지원한다. 회사에 따르면 이 모델은 KV Cache 크기를 크게 줄여 HBM 요구량을 이전 세대 대비 4분의 1, SSD 요구량을 8분의 1로 낮춘다. KV Cache를 압축하면 캐시 히트가 지출에서 높은 비중을 차지하는 에이전트형 작업의 비용이 크게 절감된다.
TREE NEWS 소식: DeepSeek는 9월 10일 새로운 아키텍처 시리즈 중 가장 작은 모델인 DeepSeek V4.1 Flash를 출시했다. 네이티브 멀티모달 시각 이해를 지원한다. 회사에 따르면 이 모델은 KV Cache 크기를 크게 줄여 HBM 요구량을 이전 세대 대비 4분의 1, SSD 요구량을 8분의 1로 낮춘다. KV Cache를 압축하면 캐시 히트가 지출에서 높은 비중을 차지하는 에이전트형 작업의 비용이 크게 절감된다.