Elon Musk cho biết Grok 4.7 vẫn cần tiếp tục tinh chỉnh trước khi ra mắt. Ảnh: Shutterstock

Elon Musk cho biết Grok 4.7, mẫu AI mới của xAI hiện bị lùi lịch ra mắt, nhiều khả năng chỉ đạt trình độ tương đương Opus 5 của Anthropic. Tỷ phú này cũng thừa nhận mô hình vẫn còn kém Opus 5.1 và cần cải thiện thêm về năng lực đa phương thức.

Theo Cryptopolitan ngày 14/9 (giờ địa phương), Musk viết trên X rằng Grok 4.7 “nhìn chung sẽ ở mức tương tự Opus 5”, “tốt hơn ở một số mặt nhưng kém hơn ở những mặt khác”. Ông đồng thời nói xAI vẫn phải khắc phục hiệu năng ở mảng đa phương thức.

Musk cũng giải thích rõ hơn lý do trì hoãn việc phát hành. Theo ông, Grok 4.7 cần thêm vài ngày để tinh chỉnh và trong giai đoạn học tăng cường, mô hình có thể đã bị đặt mức phạt quá cao đối với các câu trả lời dài. Hệ quả là mô hình có xu hướng “bỏ cuộc quá sớm” ngay cả với những bài toán khó mà trên thực tế nó vẫn có thể giải được, trong khi khả năng tự rà soát kết quả chưa đủ chặt chẽ.

Grok 4.7 ban đầu được thông báo sẽ ra mắt ngày 12/9 nhưng sau đó bị hoãn. Theo các thông tin được chia sẻ, mô hình này có khoảng 2.100 tỷ tham số và được bổ sung dữ liệu kỹ thuật từ SpaceX. Nếu con số này chính xác, quy mô của Grok 4.7 sẽ lớn hơn khoảng 40% so với Grok 4.6, mẫu được cho là có khoảng 1.500 tỷ tham số.

Dù vậy, benchmark chính thức và biểu giá token của Grok 4.7 vẫn chưa được xác nhận. Tuyên bố cho rằng mô hình này “rẻ hơn tới 10 lần” so với đối thủ hiện cũng chưa được kiểm chứng.

Trong số các đối thủ được nhắc đến, Opus 5.1 của Anthropic đã được công bố cùng các đánh giá và thông tin giá. Mô hình này đạt 52,6% trên Terminal-Bench-Science, với mức giá 10 USD cho mỗi 1 triệu token đầu vào và 50 USD cho mỗi 1 triệu token đầu ra.

Musk cũng hé lộ lộ trình cho các phiên bản tiếp theo. Ông cho biết Grok 4.8 sẽ có quy mô 2.500 tỷ tham số và đang được huấn luyện trên bộ phần mềm C++ mới của xAI. Quá trình huấn luyện dự kiến hoàn tất trong tuần này, trước khi chuyển sang giai đoạn học tăng cường. Theo Musk, Grok 4.8 sẽ cải thiện đáng kể so với Grok 4.7.

Với Grok 4.9, Musk nói mô hình này có thể tiệm cận nhóm Astra của OpenAI và dòng Fable của Anthropic. Ông cho rằng mô hình 2.500 tỷ tham số sẽ tốt hơn mô hình 2.100 tỷ tham số, đồng thời cho biết một số lỗi phát sinh trong quá trình huấn luyện bằng JAX ở thế hệ trước đã được sửa trong lúc phát triển.

Musk cũng nhắc tới kế hoạch huấn luyện một mô hình 3.000 tỷ tham số bằng phần mềm huấn luyện nội bộ đã được cải tiến cùng bộ dữ liệu tinh lọc hơn.

Phiên bản được kỳ vọng nhất hiện là Grok 5. Musk nói Grok 5 “có thể tốt hơn bất cứ thứ gì”, nhưng nhấn mạnh rằng vẫn cần chờ kết quả thực tế. Khi được hỏi năng lực cụ thể đó sẽ xuất hiện ở phiên bản nào, ông trả lời ngắn gọn: “Grok 5 sẽ làm được điều đó”.

Tuy nhiên, Musk không đưa ra mốc phát hành cụ thể cho Grok 5, cũng chưa nêu cơ sở chi tiết để chứng minh tuyên bố về hiệu năng.

Ở thời điểm hiện tại, mẫu xAI có thể được kiểm chứng trên thị trường vẫn là Grok 4.6. Trong khi Opus 5.1 và Astra, hai cột mốc hiệu năng mà Musk nhắc tới, đã ra mắt, Grok 4.7 vẫn đang trong giai đoạn tinh chỉnh trước khi công bố. Vì vậy, năng lực cạnh tranh thực tế của Grok 4.7 chỉ có thể được xác nhận sau khi phát hành chính thức và xuất hiện các benchmark độc lập.

Từ khóa

#xAI #Grok #Elon Musk #AI #Anthropic #OpenAI
Copyright © DigitalToday. All rights reserved. Unauthorized reproduction and redistribution are prohibited.