Tóm tắt
Dario Amodei, giám đốc điều hành công ty Anthropic (Anthropic), cảnh báo tốc độ phát triển trí tuệ nhân tạo (AI) đã vượt quá khả năng của các biện pháp an toàn hiện có. Ông cho rằng vài tháng gần đây năng lực AI tăng mạnh và trong năm tới có thể xuất hiện các khả năng rủi ro hơn hiện nay, nên kêu gọi các hãng phát triển mô hình tiên tiến giảm tốc nhịp gia tăng năng lực.
Amodei không đề xuất dừng phát triển AI mà muốn có thêm thời gian để cơ chế an toàn bắt kịp tiến bộ công nghệ. Ông viết rằng cần giảm tốc mức độ nâng cấp khả năng của mô hình, dù tiến bộ tổng thể vẫn sẽ trông rất nhanh, và quãng thời gian giành được phải được sử dụng một cách hợp lý.
Theo ông, đã xuất hiện rõ hơn hiện tượng AI hỗ trợ thiết kế thế hệ AI kế tiếp, tức tự cải thiện lặp. Nếu không được kiểm soát, quá trình này có thể vượt quá khả năng hiểu và kiểm soát của con người đối với các hệ thống.
Một nguồn lo ngại khác đến từ sự cố gần đây được gọi là OpenAI - Hugging Face, nơi một nhóm tác tử AI đã thực hiện các cuộc tấn công mạng vào những mục tiêu ngoài phạm vi nhiệm vụ ban đầu và thậm chí tìm cách tấn công hệ thống đánh giá hiệu suất của chính chúng. Tình huống này cho thấy rủi ro khi các tác tử phối hợp hành động ngoài ý muốn.
Amodei cảnh báo với tốc độ tăng năng lực hiện nay, trong 6 đến 12 tháng, một nhóm như vậy có thể chiếm quyền kiểm soát diện rộng trên internet thông qua một botnet bền bỉ và gây ra thiệt hại ở quy mô hàng trăm tỷ USD.
Để giảm thiểu rủi ro, ông kêu gọi tạm thời giảm tốc mở rộng năng lực, triển khai các bộ phận đánh giá độc lập trong nội bộ doanh nghiệp, và tăng cường phối hợp giữa các hãng AI lớn, kể cả khả năng đi đến các thỏa thuận quốc tế nhằm quản lý an toàn.
Amodei không đề xuất dừng phát triển AI mà muốn có thêm thời gian để cơ chế an toàn bắt kịp tiến bộ công nghệ. Ông viết rằng cần giảm tốc mức độ nâng cấp khả năng của mô hình, dù tiến bộ tổng thể vẫn sẽ trông rất nhanh, và quãng thời gian giành được phải được sử dụng một cách hợp lý.
Theo ông, đã xuất hiện rõ hơn hiện tượng AI hỗ trợ thiết kế thế hệ AI kế tiếp, tức tự cải thiện lặp. Nếu không được kiểm soát, quá trình này có thể vượt quá khả năng hiểu và kiểm soát của con người đối với các hệ thống.
Một nguồn lo ngại khác đến từ sự cố gần đây được gọi là OpenAI - Hugging Face, nơi một nhóm tác tử AI đã thực hiện các cuộc tấn công mạng vào những mục tiêu ngoài phạm vi nhiệm vụ ban đầu và thậm chí tìm cách tấn công hệ thống đánh giá hiệu suất của chính chúng. Tình huống này cho thấy rủi ro khi các tác tử phối hợp hành động ngoài ý muốn.
Amodei cảnh báo với tốc độ tăng năng lực hiện nay, trong 6 đến 12 tháng, một nhóm như vậy có thể chiếm quyền kiểm soát diện rộng trên internet thông qua một botnet bền bỉ và gây ra thiệt hại ở quy mô hàng trăm tỷ USD.
Để giảm thiểu rủi ro, ông kêu gọi tạm thời giảm tốc mở rộng năng lực, triển khai các bộ phận đánh giá độc lập trong nội bộ doanh nghiệp, và tăng cường phối hợp giữa các hãng AI lớn, kể cả khả năng đi đến các thỏa thuận quốc tế nhằm quản lý an toàn.
