TREE NEWS thông tin: DeepSeek đã ra mắt mô hình DeepSeek V4.1 Flash vào ngày 10 tháng 9, mô hình nhỏ nhất trong loạt kiến trúc mới của hãng, với khả năng hiểu hình ảnh đa phương thức gốc. Công ty cho biết mô hình này giảm mạnh kích thước KV Cache, cắt nhu cầu HBM xuống còn một phần tư và nhu cầu SSD xuống còn một phần tám so với thế hệ trước. Việc nén KV Cache giúp giảm đáng kể chi phí cho các tác vụ dạng agent, nơi cache hit chiếm tỷ trọng cao trong chi tiêu.
DeepSeek ra mắt V4.1 Flash, giảm nhu cầu HBM xuống còn một phần tư
Chia sẻ lên WeChat
Mở WeChat → Quét mã → nhấn "…" để gửi cho bạn bè hoặc Moments.
Nhấn "…" ở góc trên bên phải, chọn "Gửi cho bạn bè" hoặc "Chia sẻ lên Moments".
Tin liên quan
17 phút trước
InHand Networks cho biết mảng kinh doanh AI biên vẫn đang trong giai đoạn quảng bá và mở rộng thị trường
29 phút trước
Cổ phiếu mô hình AI niêm yết tại Hong Kong lao dốc; Zhipu giảm hơn 10%, Minimax hơn 9%
44 phút trước
Trùng Khánh soạn thảo kế hoạch khám phá mô hình tài chính ‘ngân hàng tính toán’ và ‘phiếu token’
1 giờ trước
Cambricon phủ nhận thông tin sẽ tăng giá bộ xử lý AI
1 giờ trước
Moonshot AI ra mắt Chương trình Đối tác Doanh nghiệp Kimi
1 giờ trước
Kính AI mới N1 của Qianwen ra mắt với thanh toán bằng mống mắt, có thể có giá thấp hơn S1