OpenAI lại bị tố lấy dữ liệu hội thoại người dùng để huấn luyện AI

Một nhà nghiên cứu mới đây đã đưa ra cáo buộc đối với OpenAI, cho rằng công ty này đã thu thập và sử dụng dữ liệu từ các cuộc trò chuyện của người dùng để huấn luyện mô hình, sau đó quảng bá các kết quả đạt được như những bước đột phá công nghệ tự thân. Thông tin này đang thu hút sự chú ý lớn từ cộng đồng công nghệ trên Hacker News.

Theo nhà nghiên cứu, thay vì chỉ dựa vào các phương pháp nghiên cứu thuật toán thuần túy hoặc dữ liệu công khai minh bạch, OpenAI đã âm thầm khai thác các đoạn hội thoại thực tế của người dùng ChatGPT. Điều đáng nói là sau khi mô hình cải thiện hiệu suất nhờ lượng dữ liệu tương tác này, công ty lại tuyên bố đó là thành tựu nghiên cứu mới của đội ngũ kỹ thuật.

Đây không phải lần đầu tiên OpenAI đối mặt với các tranh cãi liên quan đến bản quyền và dữ liệu người dùng. Việc thiếu minh bạch trong quy trình thu thập dữ liệu huấn luyện LLM đang khiến giới chuyên gia và người dùng ngày càng hoài nghi về các tuyên bố bứt phá từ các gã khổng lồ công nghệ.

Sự việc này là lời nhắc nhở quan trọng cho cộng đồng AI và người dùng Việt Nam về việc bảo mật thông tin cá nhân khi tương tác với các công cụ AI, đồng thời nhấn mạnh tầm quan trọng của việc xây dựng các quy chuẩn đạo đức AI minh bạch.

Nguồn: Hacker News — Biên dịch & tổng hợp: danhbaai.com

Danh Bạ AI
Logo
Register New Account