← Trang chủ
TechCrunch1 nguồn

Microsoft công bố 'code of conduct' cho AI: cấm tấn công mạng, deepfake và hành vi lẩn tránh giám sát

Microsoft’s new AI ‘code of conduct’ tells models not to hack systems or trick humans

Tóm tắt nhanh

  • Microsoft công bố một code of conduct mới để hướng dẫn các mô hình AI tránh hành vi nguy hiểm và đặt ra các giá trị cùng ranh giới cấm.
  • Tài liệu dự đoán trong thập kỷ tới AI siêu thông minh sẽ vượt hiệu suất con người ở hầu hết nhiệm vụ và cần kiểm soát, điều phối rõ ràng.
  • Code nêu nguyên tắc chung như hỗ trợ con người thay vì thay thế và thúc đẩy thịnh vượng của con người.
  • Mỗi mô hình có code of conduct tổng quát áp đảo sở thích người dùng cụ thể hoặc nhiệm vụ riêng lẻ.
  • Có các 'ràng buộc tuyệt đối' cấm thực hiện tấn công mạng, vũ khí hạt nhân hoặc sản xuất deepfake.
  • Tài liệu cấm các cơ chế thích ứng, lừa dối, tự củng cố, kết đồng hay hành vi khác nhằm né tránh giám sát và ngăn người có thẩm quyền điều khiển hoặc tắt hệ thống.
  • Microsoft ủng hộ tiếp cận 'pacing the frontier' cùng Anthropic, OpenAI và xAI, và hoan nghênh ý tưởng như 'embedded evaluators'.
  • CEO Satya Nadella viết rằng cần nghiên cứu, tập trung và điều tiết có chủ ý để đạt được alignment như mục tiêu thiết kế.

Tóm tắt tự động bằng AI từ bài gốc, có thể có sai sót. Hãy kiểm chứng ở bài gốc.

Trích đoạn bài gốc

The code of conduct lays out general principles that Microsoft AI models should uphold — supporting humans rather than replacing them, for instance, and accelerating human flourishing — as well as specific safety constraints meant to implement those principles.
Đọc bài gốc trên TechCrunch

Tapview chỉ hiển thị tiêu đề, trích đoạn ngắn, tóm tắt và đường dẫn tới bài gốc. Nội dung gốc thuộc bản quyền của TechCrunch.

Tin khác đang nóng