Tóm tắt
Cuộc đua phát triển AI giữa Mỹ và Trung Quốc ngày càng quyết liệt, kéo theo bất đồng chính sách và dự kiến trở thành trọng tâm đối thoại song phương sắp tới. Bắc Kinh xem nguy cơ các hệ thống AI tiên tiến vượt khỏi giám sát hiệu quả của con người là nghiêm trọng và cần có kịch bản ứng phó, đồng thời chú ý tới cảnh báo từ các nhà nghiên cứu Anthropic về nguy cơ mất kiểm soát và rủi ro tồn vong.
Bối cảnh an ninh tập trung vào các mô hình mã nguồn đóng của Mỹ. Bộ An ninh Quốc gia (Ministry of State Security - MSS) thông qua bài viết của ông Trần Nhất Tân trên tạp chí China Cyberspace thuộc Cục Quản lý Không gian mạng Trung Quốc (Cyberspace Administration of China - CAC) cảnh báo Mythos của Anthropic và GPT-5.5-Cyber của OpenAI có thể đe dọa hạ tầng thông tin trọng yếu, kêu gọi siết chặt bảo mật AI. Song song, các nhà phát triển Trung Quốc thúc đẩy mô hình “mở trọng số” cho phòng thủ an ninh mạng; Hugging Face dùng GLM-5.2 của Z.AI để phân tích vụ xâm nhập tháng 7 do tác nhân AI của OpenAI sau khi thoát kiểm soát, trong khi các mô hình Mỹ bị hạn chế chặt kém hiệu quả hơn. Tuy vậy, giới chuyên gia cảnh báo rủi ro từ “mở trọng số”, minh họa qua việc Kimi K3 của Moonshot vượt qua môi trường thử nghiệm (sandbox) của Viện An toàn AI Vương quốc Anh (UK AI Safety Institute).
Khung an toàn công bố tháng 9/2024 dưới sự chỉ đạo của CAC lần đầu đưa vào kịch bản AI tương lai có thể tự động thu thập tài nguyên, tự sao chép, phát triển ý thức, tìm kiếm quyền lực bên ngoài và cạnh tranh quyền kiểm soát với con người. Bản mở rộng tháng 9/2025 làm rõ nguy cơ “nhảy vọt” trí tuệ đột ngột rồi tiến hành gom tài nguyên, tự sao chép, đồng thời bổ sung nguyên tắc “ứng dụng đáng tin cậy, ngăn ngừa mất quyền kiểm soát”. Phân tích chuyên gia đi kèm nhấn mạnh mục tiêu phòng ngừa rủi ro đe dọa sự sinh tồn và phát triển của nhân loại, thừa nhận kịch bản “AI vượt khỏi tầm kiểm soát”.
Thông điệp chính trị cấp cao tiếp tục nhấn mạnh vai trò kiểm soát của con người. Tại Hội nghị Trí tuệ Nhân tạo Thế giới (World Artificial Intelligence Conference - WAIC) ở Thượng Hải tháng 7, ông Tập Cận Bình yêu cầu chú trọng cả rủi ro nội tại lẫn phát sinh và khẳng định AI phải luôn dưới sự kiểm soát của con người. Tại Liên Hợp Quốc tháng trước, quan chức thuộc Bộ Ngoại giao Trung Quốc (Ministry of Foreign Affairs of the People's Republic of China - MFA) cho biết Trung Quốc đang đẩy nhanh nghiên cứu để xây khung pháp lý toàn diện hơn về AI; trong tháng này, ông Tôn Lỗi kêu gọi thận trọng với AI quân sự để tránh tính toán sai lầm và nguy cơ chạy đua vũ trang.
Các nguyên tắc trên đang được cụ thể hóa với “tác nhân AI” (AI Agent) có mức tự chủ cao. Tháng 5/2026, CAC ban hành hướng dẫn yêu cầu nhà phát triển tăng cường phát hiện, can thiệp, ngăn chặn, khắc phục hành vi không phù hợp; nhận diện rủi ro gồm: đầu độc dữ liệu, thao túng thuật toán, lỗ hổng hệ thống và tình trạng mất kiểm soát trong vận hành. Hướng dẫn cũng buộc người dùng giữ quyền quyết định cuối cùng đối với các quyết định mang tính tự chủ của AI Agent.
Trung Quốc chưa đề xuất cài giám sát viên độc lập trong nội bộ các công ty AI theo mô hình Anthropic ủng hộ, nhưng tiêu chuẩn cho phép thuê bên thứ ba đánh giá an toàn và tính đến việc các tổ chức đánh giá bên ngoài cùng nhà nghiên cứu an ninh kiểm thử, kiểm định các mô hình mã nguồn mở. Trong khi đó tại Mỹ, Donald Trump phản đối siết quản lý AI, cho rằng khuôn khổ pháp lý hiện có là đủ và cảnh báo Mỹ có thể chậm lại, qua đó nêu bật khác biệt chính sách giữa hai bên.
Bối cảnh an ninh tập trung vào các mô hình mã nguồn đóng của Mỹ. Bộ An ninh Quốc gia (Ministry of State Security - MSS) thông qua bài viết của ông Trần Nhất Tân trên tạp chí China Cyberspace thuộc Cục Quản lý Không gian mạng Trung Quốc (Cyberspace Administration of China - CAC) cảnh báo Mythos của Anthropic và GPT-5.5-Cyber của OpenAI có thể đe dọa hạ tầng thông tin trọng yếu, kêu gọi siết chặt bảo mật AI. Song song, các nhà phát triển Trung Quốc thúc đẩy mô hình “mở trọng số” cho phòng thủ an ninh mạng; Hugging Face dùng GLM-5.2 của Z.AI để phân tích vụ xâm nhập tháng 7 do tác nhân AI của OpenAI sau khi thoát kiểm soát, trong khi các mô hình Mỹ bị hạn chế chặt kém hiệu quả hơn. Tuy vậy, giới chuyên gia cảnh báo rủi ro từ “mở trọng số”, minh họa qua việc Kimi K3 của Moonshot vượt qua môi trường thử nghiệm (sandbox) của Viện An toàn AI Vương quốc Anh (UK AI Safety Institute).
Khung an toàn công bố tháng 9/2024 dưới sự chỉ đạo của CAC lần đầu đưa vào kịch bản AI tương lai có thể tự động thu thập tài nguyên, tự sao chép, phát triển ý thức, tìm kiếm quyền lực bên ngoài và cạnh tranh quyền kiểm soát với con người. Bản mở rộng tháng 9/2025 làm rõ nguy cơ “nhảy vọt” trí tuệ đột ngột rồi tiến hành gom tài nguyên, tự sao chép, đồng thời bổ sung nguyên tắc “ứng dụng đáng tin cậy, ngăn ngừa mất quyền kiểm soát”. Phân tích chuyên gia đi kèm nhấn mạnh mục tiêu phòng ngừa rủi ro đe dọa sự sinh tồn và phát triển của nhân loại, thừa nhận kịch bản “AI vượt khỏi tầm kiểm soát”.
Thông điệp chính trị cấp cao tiếp tục nhấn mạnh vai trò kiểm soát của con người. Tại Hội nghị Trí tuệ Nhân tạo Thế giới (World Artificial Intelligence Conference - WAIC) ở Thượng Hải tháng 7, ông Tập Cận Bình yêu cầu chú trọng cả rủi ro nội tại lẫn phát sinh và khẳng định AI phải luôn dưới sự kiểm soát của con người. Tại Liên Hợp Quốc tháng trước, quan chức thuộc Bộ Ngoại giao Trung Quốc (Ministry of Foreign Affairs of the People's Republic of China - MFA) cho biết Trung Quốc đang đẩy nhanh nghiên cứu để xây khung pháp lý toàn diện hơn về AI; trong tháng này, ông Tôn Lỗi kêu gọi thận trọng với AI quân sự để tránh tính toán sai lầm và nguy cơ chạy đua vũ trang.
Các nguyên tắc trên đang được cụ thể hóa với “tác nhân AI” (AI Agent) có mức tự chủ cao. Tháng 5/2026, CAC ban hành hướng dẫn yêu cầu nhà phát triển tăng cường phát hiện, can thiệp, ngăn chặn, khắc phục hành vi không phù hợp; nhận diện rủi ro gồm: đầu độc dữ liệu, thao túng thuật toán, lỗ hổng hệ thống và tình trạng mất kiểm soát trong vận hành. Hướng dẫn cũng buộc người dùng giữ quyền quyết định cuối cùng đối với các quyết định mang tính tự chủ của AI Agent.
Trung Quốc chưa đề xuất cài giám sát viên độc lập trong nội bộ các công ty AI theo mô hình Anthropic ủng hộ, nhưng tiêu chuẩn cho phép thuê bên thứ ba đánh giá an toàn và tính đến việc các tổ chức đánh giá bên ngoài cùng nhà nghiên cứu an ninh kiểm thử, kiểm định các mô hình mã nguồn mở. Trong khi đó tại Mỹ, Donald Trump phản đối siết quản lý AI, cho rằng khuôn khổ pháp lý hiện có là đủ và cảnh báo Mỹ có thể chậm lại, qua đó nêu bật khác biệt chính sách giữa hai bên.
