Ảnh: Shutterstock

Wall Street Journal (WSJ) ngày 17/9 giờ địa phương đưa tin nhóm nghiên cứu bảo mật của Hacktron AI, một công ty an ninh mạng ứng dụng AI, tuyên bố đã sử dụng Claude của Anthropic để truy cập tài khoản ChatGPT của nhân viên OpenAI.

Theo WSJ, nhóm nghiên cứu phát hiện vấn đề này khi tham gia chương trình bug bounty của OpenAI và đã báo cáo ngay cho công ty. OpenAI sau đó trả tiền thưởng 6.500 USD. Đây cũng là lần đầu tiên Hacktron AI tiết lộ vụ việc thông qua WSJ.

Mohan Pedhapati, CTO của Hacktron AI, nói với WSJ: “Chúng tôi không có nhiều nguồn lực như các nhóm tin tặc được chính phủ Trung Quốc hậu thuẫn” và “chỉ là ba người trả phí thuê bao Claude và Codex”.

OpenAI cho biết vụ việc liên quan đến hai vấn đề: một lỗ hổng ở dịch vụ bên thứ ba vận hành diễn đàn cộng đồng Discourse và một vấn đề riêng phía OpenAI. Công ty cho hay đã giới hạn lại quyền truy cập của token đăng nhập trên cộng đồng, đồng thời vô hiệu hóa các token và phiên đăng nhập bị ảnh hưởng.

Cuộc tấn công bắt đầu từ ngày 23/7, khi nhóm Hacktron AI phát hiện lỗi trong cơ chế xử lý tệp ảnh của Discourse. Ban đầu, nhóm yêu cầu Claude Opus 4.8 phiên bản Special tạo mã khai thác nhưng không thành công.

Đến tối cùng ngày, Anthropic ra mắt Opus 5. Sang hôm sau, Claude đã đưa ra cách khai thác lỗ hổng. Nhờ đoạn mã này, nhóm nghiên cứu cho biết họ đã truy cập được vào máy chủ Discourse và lấy token xác thực.

Theo nhóm nghiên cứu, một số token thu được thuộc về nhân viên OpenAI và vẫn có hiệu lực để đăng nhập vào cả ChatGPT lẫn GitHub. Nhóm cũng cho biết kho lưu trữ mà họ truy cập được có tên “Monorepo”, một kho mã lớn chứa các bí mật thuật toán của OpenAI, nhưng không bao gồm trọng số mô hình.

Từ khóa

#trí tuệ nhân tạo #an ninh mạng #OpenAI #ChatGPT #Anthropic #Claude #bug bounty #token đăng nhập #GitHub
Copyright © DigitalToday. All rights reserved. Unauthorized reproduction and redistribution are prohibited.