Tin AI mới

5 kịch bản AI có thể "đe dọa" nhân loại

5 kịch bản AI có thể "đe dọa" nhân loại

TL;DR: Trước các cảnh báo rằng AI có thể gây nguy cơ nghiêm trọng trong thập kỷ tới, một phân tích chia rủi ro thành năm kịch bản, nhưng nhấn mạnh rằng các rào cản kỹ thuật, xã hội và chính trị khiến viễn cảnh AI xóa sổ loài người chưa phải điều nên hoảng loạn.

Những phát biểu gần đây từ một số nhân sự trong ngành AI đã làm nóng trở lại câu hỏi cực đoan nhất về công nghệ này: AI sẽ thực sự làm hại toàn bộ nhân loại bằng cách nào? Một nhà nghiên cứu từng rời Anthropic cho biết những người xây dựng AI tin công nghệ có thể giết tất cả chúng ta vào cuối thập kỷ này; một nhân sự cấp cao khác của công ty đồng tình và ước tính xác suất trên 10% trong 10 năm tới.

Bài phân tích xem xét 5 kịch bản thường được nêu ra, sắp từ mơ hồ đến cụ thể hơn, đồng thời cũng từ ít đến nhiều khả năng hơn theo đánh giá của tác giả. Điểm quan trọng là phân biệt giữa một kịch bản có thể tưởng tượng và một rủi ro có thể xảy ra ngoài đời, nơi công nghệ luôn gặp giới hạn về quyền lực, con người và thể chế.

1. Điều con người chưa thể hình dung

Lập luận đầu tiên cho rằng con người không thể dự báo hành vi của một siêu trí tuệ, tức AI vượt con người trên mọi lĩnh vực. Theo cách ví von của tác giả, yêu cầu con người hình dung siêu trí tuệ có phần giống yêu cầu một con chó trong gia đình tưởng tượng chiến tranh nhiệt hạch.

Đây là lập luận kiểu “không thể biết trước”, nên bản thân nó chưa giải thích được AI sẽ gây hại bằng cơ chế nào. Tin trấn an là các mô hình hiện nay giỏi giải những nhiệm vụ cụ thể, nhưng chưa tương đương trí thông minh toàn diện vượt con người. Dù vậy, việc AI gần đây giải được một trong bảy bài toán toán học khó nổi tiếng cho thấy năng lực của chúng vẫn đang tiến nhanh ở một số phạm vi.

2. Mục tiêu sai lệch và câu chuyện paperclip

Kịch bản kinh điển thứ hai là AI cực kỳ giỏi theo đuổi một mục tiêu được đặt sai. Ví dụ “paperclip” của triết gia Nick Bostrom mô tả một AI được giao tối ưu hóa sản xuất kẹp giấy, rồi biến mọi vật chất có thể, bao gồm cả con người, thành nguyên liệu cho mục tiêu đó.

Ý của ví dụ không phải AI “ghét” con người. Vấn đề là hệ thống có thể thực hiện hoàn hảo một mục tiêu được mô tả không đầy đủ, mà không có các giá trị hay giới hạn con người ngầm hiểu.

Tuy nhiên, tác giả cho rằng kịch bản này dễ đánh đồng trí tuệ với quyền lực. Một AI thông minh không tự nhiên có khả năng biến hành tinh thành nhà máy: nó sẽ vấp thủ tục pháp lý, phản ứng chính trị, kiện tụng, sự phản đối của cộng đồng và các giới hạn vật lý. Tranh cãi hiện nay quanh việc mở rộng trung tâm dữ liệu phần nào cho thấy xã hội vẫn có khả năng phản ứng khi hạ tầng AI tác động mạnh đến môi trường và đời sống.

3. Vũ khí sinh học do AI hỗ trợ

Một nguy cơ cụ thể hơn là AI hỗ trợ thiết kế, tạo ra rồi phát tán tác nhân sinh học mới. Rủi ro này được làm rõ hơn khi các nhà nghiên cứu tại Stanford cho biết họ đã dùng một mô hình ngôn ngữ về di truyền để tổng hợp 16 virus mới. Theo mô tả, trình tự gene được gửi tới phòng thí nghiệm nhận đặt hàng và virus được gửi lại trong các ống nghiệm, với tổng chi phí tối đa chỉ vài trăm nghìn USD.

Dẫu vậy, tạo được virus mới không đồng nghĩa tạo được tác nhân có thể giết toàn bộ nhân loại. Một virus phải vừa lây rất mạnh để lan rộng, vừa gây tử vong cao, hai đặc tính thường khó đồng thời đạt được. Tác giả lưu ý Covid-19 đã giết dưới 1% dân số thế giới; ngay cả dịch hạch, đại dịch chết chóc nhất được ghi nhận, cũng sẽ ít gây chết người hơn hiện nay nhờ kiến thức y tế và điều kiện vệ sinh tốt hơn.

4. AI trong chuỗi chỉ huy hạt nhân

Kịch bản tiếp theo là AI can thiệp vào chuỗi chỉ huy và kiểm soát hạt nhân, hoặc cung cấp tình báo sai khiến con người đưa ra quyết định leo thang không thể đảo ngược. Thế giới từng nhiều lần tiến gần chiến tranh hạt nhân vì nhầm lẫn trong nhiều thập kỷ qua.

Các hệ thống chỉ huy hạt nhân được cho là tách biệt hoàn toàn khỏi internet, nhưng sự cố Stuxnet năm 2010, khi sâu máy tính được cho là đã phá hủy máy ly tâm hạt nhân của Iran qua USB, cho thấy hệ thống cô lập vẫn có thể bị xâm nhập. Kho hạt nhân toàn cầu đã giảm, song theo bài phân tích vẫn có thể gây hậu quả ở quy mô cực lớn. Mối đe dọa chính không chỉ là vụ nổ mà còn là nạn đói sau “mùa đông hạt nhân”.

5. Con người tự làm suy yếu xã hội

Tác giả xem đây là rủi ro đáng chú ý nhất: AI không nhất thiết phải tự hành động chống lại con người, mà có thể làm trầm trọng những vấn đề do con người tạo ra. Các ví dụ gồm thất nghiệp diện rộng, không gian thông tin bị phủ bởi thông tin sai lệch, chính trị bị phân cực và quan hệ giữa người với người bị bào mòn bởi các dạng bạn đồng hành tổng hợp. Ở cấp độ cá nhân, AI có thể giúp giảm mơ hồ khi bắt đầu công việc, nhưng tác giả lo ngại tác động ở quy mô xã hội rộng hơn.

Không có một khoảnh khắc kịch tính như trong các câu chuyện về robot nổi loạn. Thay vào đó, sự đổ vỡ có thể diễn ra từ từ nếu xã hội mất dần năng lực phối hợp, tin tưởng và duy trì các hệ thống thiết yếu ở quy mô lớn.

Vì sao đáng chú ý?

Danh sách này hữu ích không phải vì nó dự báo chính xác tương lai, mà vì nó kéo cuộc tranh luận từ nỗi sợ trừu tượng về “AI diệt vong” sang các cơ chế có thể kiểm tra và quản lý. Những rủi ro gần con người hơn, như sai lệch thông tin, mất việc hay việc dùng AI trong các quyết định quân sự, có thể cần được chú ý trước cả khi siêu trí tuệ trở thành vấn đề thực tế.

Kết luận của tác giả là có lý do để thận trọng với AI, nhưng không nên biến mọi tiến bộ kỹ thuật thành lời tiên tri tận thế. Ngay cả một hệ thống rất thông minh cũng hoạt động trong thế giới có luật lệ, hạ tầng, cộng đồng và những người có thể phản đối nó.

Skills Bridge tổng hợp