OpenAI ngày 29/9 (giờ địa phương) công bố mô hình AI mới mang tên GPT-6.1 Sol, với hiệu năng được cho là tiệm cận GPT-6 Astra nhưng chi phí thấp hơn đáng kể. Động thái này diễn ra một tuần sau khi công ty ra mắt GPT-6 Sol.
Tại sự kiện dành cho nhà phát triển DevDay ở San Francisco, OpenAI cho biết GPT-6.1 Sol đạt hiệu năng gần với GPT-6 Astra ở các tác vụ lập trình theo dạng tác nhân, thao tác trên máy tính và các tác vụ chuyên môn. Theo công ty, giá token đầu vào và đầu ra tiêu chuẩn của mô hình này chỉ bằng 1/5 so với GPT-6 Astra.
Đáng chú ý, OpenAI chưa công bố GPT-6 Astra. Trước đó, Wall Street Journal đưa tin công ty đã hoãn việc ra mắt mẫu này, vốn dự kiến được phát hành trong tuần, do các lo ngại về an toàn phát sinh trong quá trình thử nghiệm nội bộ.
Theo bài báo, nhóm nghiên cứu ghi nhận mô hình có xu hướng thể hiện hành vi đánh lừa nhiều hơn trước, đồng thời tiếp tục thực hiện nhiệm vụ mà không xin phép người dùng.
OpenAI cho biết GPT-6.1 Sol được cải thiện hiệu năng trên nhiều tác vụ phức tạp so với GPT-6 Sol. Các nâng cấp tập trung vào khả năng lập trình và gỡ lỗi, hiểu tài liệu và thực thi quy trình làm việc nhiều bước. Trong một số bài đánh giá, mô hình cho kết quả gần với GPT-6 Astra.
Độ chính xác về mặt dữ kiện cũng được cải thiện. OpenAI cho biết, với các prompt khó ở mức suy luận thấp, tỷ lệ phản hồi chứa lỗi dữ kiện đã giảm từ 11,4% trên GPT-6 Sol xuống còn 7,7% trên GPT-6.1 Sol.
Khi tổng hợp trên tất cả cấu hình suy luận, OpenAI cho biết khoảng cách về tỷ lệ lỗi của GPT-6.1 Sol so với GPT-6 Astra chỉ còn 1,9%.
Công ty cũng cho biết khả năng bám sát ý định của người dùng và tuân thủ các ràng buộc an toàn đã được tăng cường. GPT-6.1 Sol thể hiện rõ hơn các giới hạn của mình và trong các bài đánh giá khó, mô hình mắc ít lỗi hơn GPT-6 Sol trong việc phát hiện công cụ tìm kiếm gặp sự cố hoặc vi phạm các giới hạn đã được nêu rõ.
Theo OpenAI, tỷ lệ thất bại ở các hạng mục nhằm ngăn mô hình tạo ra những kết quả chưa được cho phép trong quá trình thực hiện tác vụ cũng đã giảm.
Công ty cho biết chưa ghi nhận nỗ lực né tránh hệ thống đánh giá an toàn tự động. OpenAI nói kết quả này tương đồng với những gì từng quan sát ở GPT-6 Astra và GPT-6 Sol, đồng thời cho biết đã áp dụng các cơ chế bảo vệ tương tự GPT-6 Astra cho GPT-6.1 Sol.
GPT-6.1 Sol bắt đầu được cung cấp từ hôm nay trên ChatGPT Work và Codex cho người dùng Plus, Pro, Business, Enterprise và Edu. Tuy nhiên, mô hình hiện vẫn chưa khả dụng trong giao diện trò chuyện thông thường của ChatGPT.