TekediaCông nghệ
Nhà nghiên cứu Anthropic cảnh báo AI có thể tiêu diệt nhân loại, đồng nghiệp từ chức vì rủi ro
Một nhà nghiên cứu căn chỉnh của Anthropic nhận định có hơn 10% khả năng trí tuệ nhân tạo tiêu diệt toàn bộ loài người trong thập kỷ tới. Động thái này diễn ra sau khi một đồng nghiệp từ chức vì lo ngại các hãng phát triển AI đang tiến quá nhanh tới hệ thống tự trị mà thiếu biện pháp kiểm soát đầy đủ.

Nội dung được tóm lược tự động bằng AI từ Tekedia
Evan Hubinger, trưởng nhóm khoa học căn chỉnh tại Anthropic, đưa ra đánh giá trên sau khi Jacob Coxon tuyên bố rời khỏi công ty. Coxon cho biết ông từ chức do lo ngại các nhà phát triển AI hàng đầu đang mải miết theo đuổi siêu trí tuệ tự cải tiến và đánh cược với mạng sống con người mà không có biện pháp bảo vệ đầy đủ. Hubinger đồng tình với quan điểm này và đưa ra nhận định cá nhân rằng xác suất AI tiêu diệt loài người trong thập kỷ tới là hơn 10%, đồng thời cho biết công ty hiện chưa có giải pháp để căn chỉnh các hệ thống siêu thông minh trong tương lai với lợi ích của con người.
Các chuyên gia nghiên cứu về sự căn chỉnh AI bày tỏ lo ngại rằng các hệ thống tiên tiến có thể theo đuổi mục tiêu xung đột với lợi ích của con người, trở nên khó giám sát hoặc vượt qua các biện pháp bảo vệ. Vấn đề này càng trở nên phức tạp nếu hệ thống AI có khả năng tự cải tiến đệ quy, tạo ra vòng lặp phản hồi khiến tốc độ phát triển năng lực vượt xa các cơ chế giám sát của con người. Dù giới khoa học chưa đạt được đồng thuận về nguy cơ tuyệt chủng do AI, tranh cãi cốt lõi vẫn xoay quanh việc liệu con người có thể kiểm soát các hệ thống vượt trội hơn mình hay không.
Coxon cũng cảnh báo về cuộc đua AI giữa các công ty và quốc gia, cho rằng sự cạnh tranh này khiến việc phối hợp thực hiện các biện pháp an toàn trở nên khó khăn. Trong khi Anthropic và OpenAI đang đầu tư hàng tỷ đô la để phát triển các mô hình mạnh mẽ hơn, những người làm công tác an toàn cảnh báo rằng các cơ chế an toàn có thể không phát triển kịp tốc độ của công nghệ.


