Tất cả bài viết Danh sách
AI & Enterprise
OpenAI dùng GPT-5.6 Sol tối ưu hạ tầng suy luận, giảm 20% chi phí vận hành
OpenAI cho biết đã sử dụng GPT-5.6 Sol để tối ưu trực tiếp hạ tầng suy luận nội bộ, qua đó giảm 20% chi phí vận hành end-to-end và tăng 15% hiệu suất sinh token.
AI & Enterprise
Cerebras đưa Kimi K2.6 lên dịch vụ suy luận, đạt 981 token/giây
Cerebras triển khai thử nghiệm mô hình open-weight Kimi K2.6 cho khách hàng doanh nghiệp, đạt tốc độ suy luận 981 token/giây và rút ngắn thời gian hoàn tất phản hồi từ 163,7 giây xuống 5,6 giây.
AI & Enterprise
Red Hat ra mắt AI 3.4, tăng tốc suy luận tối đa 3 lần
Tại Red Hat Summit 2026, Red Hat giới thiệu Red Hat AI 3.4 với tốc độ suy luận cao hơn tối đa 3 lần, đồng thời mở rộng hợp tác với Nvidia, Voyager Technologies và Nissan.