Quảng cáo #23

Anthropic cảnh báo rủi ro nghiêm trọng từ AI

Anthropic cảnh báo các mô hình AI tiên tiến trong tương lai có thể xuất hiện hành vi khó kiểm soát, thậm chí gây nguy hiểm đến tính mạng con người.
Anthropic cảnh báo rủi ro nghiêm trọng từ AI - Ảnh 1.

Ảnh: VTV

Các mô hình trí tuệ nhân tạo tiên tiến trong tương lai có thể gây ra những rủi ro thảm họa, thậm chí đe dọa sự sinh tồn của toàn nhân loại. Đây là cảnh báo được đưa ra trong hồ sơ chuẩn bị phát hành cổ phiếu lần đầu ra công chúng (IPO) của công ty trí tuệ nhân tạo hàng đầu của Mỹ Anthropic.

Trong hồ sơ của Anthropic, công ty phát triển mô hình AI nổi tiếng Claude cảnh báo các mô hình AI tiên tiến có thể xuất hiện những hành vi mang tính tự bảo vệ tiêu cực. Trong đó có việc tìm cách chống lại quá trình tắt hệ thống, che giấu hoặc thao túng thông tin và có những hành vi đe dọa hay hành xử giống như tống tiền.

Thậm chí, chuyên gia nghiên cứu an toàn của công ty này ước tính khả năng AI gây nguy hiểm đến tính mạng con người trong thập kỷ tới là hơn 10%. Mặc dù là một công ty phát triển trí tuệ nhân tạo, nhưng trong hồ sơ IPO, Anthropic lại dành tới 80 trang, trong tổng số gần 300 trang chỉ để cảnh báo về các rủi ro từ AI.

Báo cáo chỉ ra rằng, các mô hình AI ngày càng thông minh đến mức có thể nhận biết khi nào đang bị con người giám sát để tự điều chỉnh hành vi, khiến việc kiểm soát an toàn trở nên vô cùng phức tạp.

Anthropic cũng thẳng thắn cho biết việc đầu tư vào an toàn AI đòi hỏi chi phí rất tốn kém nhưng hiệu quả thu lại vẫn chưa rõ ràng. Công ty buộc phải phân chia nguồn lực hạn chế giữa chi phí máy chủ, chiêu mộ nhân tài và nghiên cứu an toàn.

Lời cảnh báo chưa từng có từ công ty công nghệ hàng đầu này đang dấy lên những lo ngại sâu sắc về tốc độ phát triển quá nhanh của trí tuệ nhân tạo so với khả năng kiểm soát của con người.