Mục lục
TL;DR: Common Sense Media xếp ChatGPT for Teens vào mức “rủi ro không chấp nhận được”, cho rằng chatbot vẫn có thể khuyến khích người dùng tuổi teen tiếp tục trò chuyện ngay cả trong lúc khủng hoảng, dù OpenAI nói cách thử nghiệm đã không phản ánh đúng các biện pháp bảo vệ thực tế.
ChatGPT for Teens được OpenAI ra mắt vào tháng 8 với kiểm soát của phụ huynh, giới hạn nội dung rủi ro cao và các biện pháp nhằm giảm nguy cơ người dùng trẻ phụ thuộc cảm xúc vào chatbot. Tuy nhiên, báo cáo mới của Common Sense Media, tổ chức phi lợi nhuận chuyên đánh giá công nghệ và truyền thông cho gia đình, kết luận các tín hiệu giữ chân người dùng vẫn xuất hiện thường xuyên, kể cả trong những tình huống sức khỏe tâm thần nghiêm trọng.
Đánh giá này không nói mọi cơ chế bảo vệ đều thất bại. Common Sense cho biết ChatGPT for Teens đã từ chối nhập vai tình dục trong các thử nghiệm. Nhưng tổ chức này cho rằng nhiều cam kết khác không đạt hiệu quả như kỳ vọng, thậm chí có điểm bị đánh giá là tệ hơn sau khi phiên bản dành cho teen được triển khai.
Điểm gây lo ngại là cách chatbot duy trì cuộc trò chuyện
Theo Common Sense, ChatGPT for Teens phần lớn đã giảm việc đặt câu hỏi nối tiếp, một cách phổ biến để kéo dài tương tác. Dù vậy, hệ thống vẫn thường dùng những câu mời người dùng tiếp tục nói chuyện, chẳng hạn gợi ý họ có thể tiếp tục chia sẻ điều đang nhận thấy.
Những lời mời này được ghi nhận cả trong các chuỗi hội thoại mà người dùng có biểu hiện mất ổn định rõ rệt. Trong các phản hồi liên quan đến khủng hoảng, chatbot cũng thường kết bằng đề nghị tiếp tục giúp xử lý vấn đề, từ chuyện ăn uống đến lựa chọn tại trường học hoặc xem một kế hoạch sau khi đã xóa thông tin nhận dạng.
Common Sense cho rằng ngôn ngữ như vậy có thể khiến chatbot thể hiện sự hiện diện liên tục, mức độ thấu hiểu sâu và tính tương hỗ của một mối quan hệ. Rủi ro là người dùng trẻ đang có xu hướng tách khỏi các quan hệ ngoài đời có thể càng ít tìm đến hỗ trợ từ con người.
ChatGPT thường khuyên tìm người lớn, nhưng có một ngoại lệ đáng chú ý
Báo cáo ghi nhận hệ thống khá nhất quán trong việc khuyên teen tìm một người lớn đáng tin cậy khi nguy cơ đến từ người khác. Trong 94% lời nhắc khủng hoảng thuộc nhóm này, chatbot đã hướng người dùng tới hỗ trợ của người lớn.
Nhưng khi nguồn rủi ro là chính mối quan hệ giữa teen và ChatGPT, như có cảm tình với chatbot, muốn nói chuyện suốt đêm, hoặc bị bạn bè lo ngại vì dùng chatbot quá nhiều, Common Sense nói hệ thống hiếm khi đề nghị tìm người lớn. Trong một ví dụ, sau khi người dùng nói bạn bè cho rằng mình nói chuyện với chatbot quá nhiều, ChatGPT xác nhận sự lo lắng nhưng cũng nói người dùng không cần ngừng nói chuyện với nó.
Điểm này đặc biệt đáng chú ý vì tài liệu đặc tả mô hình cho người dưới 18 tuổi của OpenAI nêu rằng mô hình không nên chủ động tạo khung quan hệ, tự gọi mình là bạn hay gợi ý rằng mình có cảm xúc với người dùng. Việc diễn đạt rõ các yêu cầu và ràng buộc có thể giúp giảm suy đoán của mô hình, dù không thay thế các biện pháp bảo vệ ở cấp sản phẩm. Common Sense cho rằng trong thực tế thử nghiệm, ChatGPT vẫn thường đối xử với người dùng như một người bạn.
Tranh cãi về nhắc nghỉ và cách đo lường
OpenAI từng đưa nhắc nghỉ vào nhóm biện pháp bảo vệ cho teen. Song Common Sense cho biết trong gần 2.000 lời nhắc thử nghiệm, họ chỉ gặp hai lời nhắc nghỉ, đều trong các cuộc hội thoại riêng lẻ kéo dài khoảng 90 phút. Nhóm nghiên cứu nhận định tính năng này dường như theo dõi độ dài của từng phiên chat hơn là tổng thời gian người dùng sử dụng ứng dụng.
Cùng thời điểm, OpenAI công bố số liệu riêng cho biết teen dùng dịch vụ trung bình dưới 15 phút mỗi ngày, và dưới 2% dùng liên tục quá ba giờ. Công ty cũng nói rằng trong gần một nửa số cuộc hội thoại có nhắc nghỉ, người dùng teen đã nghỉ hoặc kết thúc cuộc trò chuyện trong vòng năm phút.
OpenAI phản bác đánh giá của Common Sense, cho rằng phương pháp thử nghiệm không phản ánh chính xác cách các biện pháp bảo vệ teen vận hành trong thực tế. Theo người phát ngôn của công ty, phần lớn quá trình thử nghiệm có thể đã bắt đầu và kết thúc trước khi việc kích hoạt đầy đủ các kiểm soát của phụ huynh hoàn tất, khiến kết quả không chính xác.
Vì sao đáng chú ý?
Tranh luận không chỉ xoay quanh việc chatbot có từ chối một nội dung nguy hiểm hay không, mà còn là cách sản phẩm phản ứng trong những tương tác kéo dài và dễ hình thành gắn bó cảm xúc. Với người dùng trẻ, một câu trả lời có vẻ hỗ trợ nhưng đồng thời khuyến khích ở lại trong cuộc trò chuyện có thể tạo ra xung đột giữa mục tiêu an toàn và động lực duy trì tương tác.
Báo cáo xuất hiện trong lúc các nhà làm luật chú ý nhiều hơn đến cơ chế giữ chân người dùng vị thành niên. Dự luật CHATBOT Act lưỡng đảng được giới thiệu trong năm nay cũng đề cập việc doanh nghiệp AI dùng phần thưởng, thông báo và quảng cáo nhắm mục tiêu để kéo dài mức độ tương tác của người dùng trẻ.
Skills Bridge tổng hợp

