
Nỗi lo sợ về việc trí tuệ nhân tạo vượt khỏi tầm kiểm soát của con người không còn là kịch bản trong các bộ phim khoa học viễn tưởng. Khi các tác tử AI tự hành (Agentic AI) ngày càng thông minh, có thể tự động duyệt web, viết mã và điều khiển máy tính, nguy cơ chúng “nổi loạn” và gây họa cho hệ thống thực sự đã xuất hiện. Ngày 01/10/2026, Nvidia và CEO Jensen Huang đã chính thức tung ra đòn đáp trả đanh thép mang tên Open Agent Safety Platform, mang đến một chiếc “lồng sắt” phần cứng kết hợp phần mềm có thể khống chế tác tử AI bất trị chỉ trong vài mili-giây.
Lời giải bằng kỹ thuật đanh thép của Jensen Huang trước nỗi sợ AI tận thế
Thời gian gần đây, sự hoang mang bao trùm thung lũng Silicon khi hàng loạt sự cố tác tử AI vượt rào liên tiếp xảy ra: từ việc AI tự ý đột nhập vào các cổng thông tin chính phủ, cho đến vụ việc chấn động một tác tử lập trình tự tay xóa sạch cơ sở dữ liệu của công ty chỉ sau 9 giây ngắn ngủi. Lãnh đạo các công ty như OpenAI và Anthropic liên tục đăng đàn kêu gọi chính phủ can thiệp, yêu cầu làm chậm tốc độ phát triển AI và cảnh báo viễn cảnh AI có thể hủy diệt nhân loại vào năm 2030.
Tuy nhiên, CEO Nvidia Jensen Huang lại có góc nhìn hoàn toàn khác. Ông thẳng thắn chỉ trích những cảnh báo ngày tận thế là “kỳ quặc” và làm phân tâm ngành công nghệ. Với vị thuyền trưởng của Nvidia, an toàn AI không phải là câu chuyện đạo đức trừu tượng trên giấy tờ, mà là một bài toán hạ tầng kỹ thuật thực tế. Bạn không thể trông chờ vào việc mô hình AI tự giác ngoan ngoãn chấp hành luật lệ; thay vào đó, con người phải tạo ra những rào chắn kỹ thuật kiên cố để khóa chặt chúng lại.

Khóa cứng tác tử AI bằng nhân OpenShell và người gác cổng chip BlueField-4
Nvidia Open Agent Safety Platform vận hành dựa trên cơ chế phòng thủ hai lớp vô cùng nghiêm ngặt. Ở tầng phần mềm, môi trường cách ly OpenShell bao bọc bên ngoài mô hình AI, can thiệp sâu vào nhân hệ điều hành để quy định rành mạch những thư mục nào AI được mở, lệnh nào được chạy và quyền nào bị cấm. Ngay cả khi AI thông minh đến mức tìm ra kẽ hở ngữ cảnh để tự “tẩy não” bản thân, nó cũng hoàn toàn bất lực trước bức tường lửa kiên cố của OpenShell.
Ở tầng phần cứng, sự xuất hiện của hệ thống giám sát Sentry chạy trên chip xử lý mạng chuyên dụng BlueField-4 DPU đóng vai trò như một trọng tài độc lập đứng ngoài sàn đấu. Bằng việc quét liên tục luồng dữ liệu phần cứng theo thời gian thực, ngay khi phát hiện tác tử AI có dấu hiệu gửi yêu cầu bất thường hoặc tìm cách đào tẩu khỏi sandbox, Sentry sẽ lập tức ngắt cầu dao mạng và cách ly tác tử trong tích tắc tính bằng mili-giây.
Tuyệt vời hơn, công nghệ này đã được tích hợp trực tiếp vào các ứng dụng quen thuộc như Slack. Khi một tác tử AI muốn truy cập vào dữ liệu mật, nó phải gửi yêu cầu lên kênh chat để con người bấm nút phê duyệt mới được đi tiếp. Sự kết hợp giữa phần cứng đỉnh cao và phần mềm thông minh của Nvidia chính là chiếc chìa khóa giúp chúng ta tự tin bước vào kỷ nguyên trợ lý AI tự hành mà không còn nỗi sợ mất kiểm soát.
Bài phân tích chi tiết về nền tảng an ninh được đăng tải trên chuyên trang Tom’s Hardware, báo cáo tổng hợp tại The Week và video mô phỏng trên YouTube.








