Tất cả bài viết Danh sách
AI & Enterprise
Dinoticia công bố STAR-KV, công nghệ nén KV cache cho LLM
Dinoticia công bố bài báo khoa học và mã nguồn mở STAR-KV, công nghệ nén KV cache giúp giảm đáng kể bộ nhớ GPU và tối ưu suy luận cho các mô hình ngôn ngữ lớn.
Industry
Gói Claude Code bị lộ cho thấy nhu cầu chip nhớ AI có thể bị đánh giá thấp
Thông tin nội bộ bị lộ liên quan đến Claude Code cho thấy AI agent có thể ngốn bộ nhớ lớn hơn nhiều so với giả định trước đây, qua đó làm tăng kỳ vọng về nhu cầu chip nhớ và hạ tầng AI.
AI & Enterprise
Giáo sư Han Insu tham gia phát triển TurboQuant, tăng hiệu quả sử dụng bộ nhớ AI gấp 6 lần
KAIST cho biết giáo sư Han Insu tham gia nhóm nghiên cứu cùng Google Research, DeepMind và New York University phát triển TurboQuant, thuật toán giúp cải thiện hiệu quả sử dụng bộ nhớ của mô hình AI lên tới 6 lần.