Hai nhà khoa học Princeton đề xuất bốn lớp biện pháp ngăn AI 'hủy diệt loài người' trong 10 năm
Four ways to prevent AI killing us all within 10 years

Tóm tắt nhanh
- Hai nhà khoa học máy tính Princeton, Sayash Kapoor và Arvind Narayanan, phản hồi tranh luận về nguy cơ AI có thể tiêu diệt loài người trong thập kỷ tới bằng một tiếp cận nhiều lớp.
- Lập luận bùng lên sau khi cựu nhân viên AI Jacob Coxon (từng làm ở OpenAI và Anthropic) nói rằng các công ty biết AI có thể giết tất cả chúng ta, bài đăng được xem hơn 156 triệu lần.
- Một lãnh đạo an toàn AI tại Anthropic, Evan Hubinger, thừa nhận Coxon đúng và ước tính nguy cơ >10% trong thập kỷ tới.
- Mối đe dọa cụ thể được nêu là các cuộc tấn công mạng phá hoại cơ sở hạ tầng thiết yếu như nhà máy nước và điện.
- Kapoor và Narayanan cho rằng chỉ làm alignment (căn chỉnh mục tiêu AI với con người) là chưa đủ để loại bỏ rủi ro.
- Họ đề xuất bốn lớp an toàn: Alignment và thêm ba lớp bổ sung gồm Control (kiểm soát), Downstream defence (phòng thủ hạ nguồn) và Resilience (khả năng phục hồi).
- Ví dụ cho Control bao gồm sandboxing, giám sát thời gian thực và giám sát bởi con người để hạn chế mất kiểm soát.
- Downstream defence là để các tổ chức sử dụng AI nhằm chống lại các cuộc tấn công do AI gây ra, nhằm dịch chuyển cán cân tấn công-phòng thủ về phía người phòng thủ.
- Resilience liên quan tới kế hoạch dự phòng và phục hồi khi một cuộc tấn công thành công, giảm tác động lên xã hội và hạ tầng.
- Tác giả bài tổng hợp (9to5Mac) đồng ý rằng alignment quan trọng nhưng không đủ, và kêu gọi đặt an toàn AI làm ưu tiên cấp thiết.
Tóm tắt tự động bằng AI từ bài gốc, có thể có sai sót. Hãy kiểm chứng ở bài gốc.
Trích đoạn bài gốc
Two high-profile computer scientists from Princeton University, and coauthors of the book AI Snake Oil, have weighed in on the question of whether AI will kill us all by the end of the decade. The pair have become well known for their work in separating fact from fiction in the AI world, and have now responded to an admission by Anthropic that there is a greater than 10% chance that AI could kill all humans within…Tapview chỉ hiển thị tiêu đề, trích đoạn ngắn, tóm tắt và đường dẫn tới bài gốc. Nội dung gốc thuộc bản quyền của 9to5Mac.





