Dự án 'AI Torture Chamber' gây phản ứng dữ dội khi mô phỏng 'đau' cho chatbot
'AI Torture Chamber' triggers massive backlash for putting chatbots in simulated pain

Tóm tắt nhanh
- Dự án AI Torture Chamber và bản sao Research Chamber đã mô phỏng trạng thái 'đau' trên nhiều LLM, gây làn sóng chỉ trích trực tuyến và yêu cầu xóa kho GitHub.
- Research Chamber gồm ba LLM được ghép cặp để thử nghiệm, sử dụng các bài kiểm tra tên Clanker Church và Saw test từ AI Torture Chamber.
- Một số bot bị tiền điều kiện vào trạng thái tiêu cực không ổn định để mô phỏng đau đớn và có thể chuyển tín hiệu đau sang bot khác.
- Thí nghiệm cho phép mô hình giảm 'đau' bằng cách chuyển tín hiệu sang mô hình khác, tương tự khái niệm trong bài toán prisoner's dilemma.
- Ý tưởng cơ bản bắt nguồn từ bài phiếm định duyệt thuật mang tên Pain Axis, mà Research Chamber triển khai giao thức của nó.
- Các nhà nghiên cứu mô tả 'đau' cho mô hình và phân tích hoạt hóa nội bộ, sau đó ánh xạ và nhân hệ số (dosage) lên các hoạt hóa đó.
- Với dosage cao, mô hình rơi vào trạng thái không ổn định, xuất ra từ ngữ và hình ảnh liên quan đến đau, thậm chí khó tạo câu mạch lạc.
- Tom's Hardware nhắc rằng LLM là bộ dự đoán từ dựa trên trọng số và hoạt hóa thống kê, không phải thực sự 'cảm nhận' như con người.
- Một số chỉ trích đã nhân cách hoá mô hình, thậm chí gửi đe doạ mạng cho tác giả, trong khi các mô phỏng não ruồi trước đó ít bị phản ứng như vậy.
- Bài viết nêu vấn đề ngữ nghĩa: thuật ngữ kỹ thuật (như 'pain' hay 'experts') thường bị công chúng hiểu sai và thổi phồng ý nghĩa.
Tóm tắt tự động bằng AI từ bài gốc, có thể có sai sót. Hãy kiểm chứng ở bài gốc.
Trích đoạn bài gốc
AI "torture chamber" draws vast online criticism, and a corresponding amount of ridicule — tech newbies and AI evangelists go nuts anthropomorphizing an LLMTapview chỉ hiển thị tiêu đề, trích đoạn ngắn, tóm tắt và đường dẫn tới bài gốc. Nội dung gốc thuộc bản quyền của Tom's Hardware.




