Siêu trí tuệ (SI) được kiểm soát như một định chế tài chính?
Khi trí tuệ nhân tạo ngày càng tiến gần tới những hệ thống có khả năng tự thực hiện các nhiệm vụ phức tạp, bài toán không còn chỉ là chúng mạnh đến đâu. Một câu hỏi khác đang trở nên quan trọng không kém: ai sẽ kiểm soát những hệ thống này?
Theo Thỏa thuận Nhà Trắng về Siêu trí tuệ (White House Accord on Super Intelligence) được ký vào cuối tháng 9, những hệ thống AI mạnh nhất sẽ được đặt dưới 4 lớp kiểm soát: kiểm soát nội bộ, kiểm toán nội bộ, kiểm toán độc lập, và uỷ ban độc lập thuộc HĐQT.
Điều đáng chú ý không chỉ nằm ở số lượng lớp kiểm soát.
Cách Super Intelligence (SI) được giám sát đang ngày càng giống cách thế giới kiểm soát rủi ro trong ngân hàng, chứng khoán và các doanh nghiệp lớn.
Google, Meta, Nvidia, OpenAI, xAI và Anthropic nằm trong nhóm tham gia thỏa thuận. Các công ty cam kết áp dụng cấu trúc trên đối với những mô hình AI tiên tiến nhất, hay frontier models.
Tuy nhiên, đây hiện vẫn là cam kết tự nguyện, chưa phải quy định pháp lý bắt buộc và chưa đi kèm chế tài nếu doanh nghiệp không thực hiện.

Tổng thống Mỹ Donald Trump đổi tên AI thành 'siêu trí tuệ'
Lớp 1: Kiểm soát nội bộ - giám sát năng lực và hành vi AI
Lớp đầu tiên nằm ngay tại doanh nghiệp phát triển mô hình.
Theo thỏa thuận, các công ty phải xây dựng hệ thống kiểm soát nội bộ đủ mạnh để theo dõi năng lực và mức độ alignment - tức sự phù hợp giữa hành vi của mô hình với ý định, mục tiêu của con người - trong quá trình phát triển và hoạt động thực tế.
Phạm vi đặc biệt tập trung vào những lĩnh vực có khả năng gây hậu quả lớn như an ninh mạng, sinh học và hóa học.
Một yêu cầu đáng chú ý khác là doanh nghiệp phải có biện pháp ngăn mô hình tự ý hack hoặc truy cập các hệ thống kỹ thuật ngoài dự kiến.
Hiểu đơn giản, đây là tuyến phòng thủ nằm gần AI nhất.
Nếu một mô hình bắt đầu thể hiện một năng lực nguy hiểm trong quá trình thử nghiệm, hệ thống giám sát phải phát hiện được trước khi vấn đề lan sang môi trường bên ngoài.
Lớp 2: Giám sát nội bộ - kiểm tra hiệu quả, bảo đảm khắc phục
Có hệ thống kiểm soát chưa đủ. Doanh nghiệp còn cần một đội ngũ nội bộ được trao quyền để kiểm tra xem những hàng rào đó có thực sự hoạt động hay không.
Đội ngũ này phải bảo đảm các cơ chế kiểm soát, giám sát và phát hiện đang vận hành đúng thiết kế, đồng thời theo dõi việc khắc phục khi phát hiện vấn đề.
Đây là lớp khá giống chức năng internal assurance/kiểm toán nội bộ trong một tổ chức tài chính.
Một nghiên cứu đăng trên Risk Analysis trước đó cũng đề xuất các nhà phát triển frontier AI cần có chức năng kiểm toán nội bộ. Theo tác giả Jonas Schuett, kiểm toán nội bộ có thể đánh giá hiệu quả của quản trị rủi ro và hệ thống kiểm soát, đồng thời cung cấp cho HĐQT một cái nhìn độc lập hơn so với thông tin từ ban điều hành.
Sự khác biệt nằm ở chỗ White House Accord không chính thức gọi lớp thứ hai là "internal audit". Vì vậy, chính xác hơn nên coi đây là lớp bảo đảm nội bộ.
Lớp 3: Đánh giá độc lập - kiểm chứng hệ thống kiểm soát
Lớp thứ ba đưa việc kiểm chứng ra ngoài doanh nghiệp.
Các công ty ký thỏa thuận phải hợp tác với một kiểm toán viên hoặc tổ chức đánh giá độc lập bên ngoài để kiểm tra xem những hệ thống kiểm soát, giám sát và phát hiện rủi ro có thực sự hoạt động như doanh nghiệp tuyên bố hay không.
Logic này rất quen thuộc trong tài chính.
Một ngân hàng hay doanh nghiệp niêm yết không thể chỉ nói rằng báo cáo và hệ thống kiểm soát của mình đáng tin cậy. Một bên độc lập được đưa vào để kiểm chứng.
Với SI, thứ cần được đánh giá không chỉ là những con số.
Bên đánh giá có thể phải kiểm chứng liệu hệ thống giám sát có phát hiện được hành vi nguy hiểm của mô hình, các hàng rào an toàn có hoạt động đúng thiết kế và doanh nghiệp có thực sự khắc phục những lỗ hổng đã phát hiện hay không.
Đây là bước chuyển từ "hãy tin chúng tôi" sang "hãy kiểm chứng chúng tôi".
EY nhận định xu hướng quản trị AI đang dịch chuyển từ niềm tin dựa trên tuyên bố sang niềm tin được chứng minh bằng bằng chứng. Khi AI được trao nhiều quyền tự chủ hơn, việc đánh giá cũng sẽ phải trở nên liên tục và độc lập hơn.
Lớp 4: Giám sát của HĐQT - theo dõi cảnh báo và khắc phục
Nếu ba lớp đầu tiên đều phát hiện vấn đề nhưng ban lãnh đạo không hành động, toàn bộ cấu trúc kiểm soát vẫn có thể thất bại.
Vì vậy, tầng cuối cùng được đưa lên HĐQT.
Các doanh nghiệp phải chỉ định một ủy ban độc lập thuộc HĐQT, chịu trách nhiệm nhận báo cáo từ các đội ngũ vận hành hệ thống kiểm soát, bộ phận đánh giá bên trong và đơn vị đánh giá độc lập bên ngoài.
Vai trò này có nét tương đồng với ủy ban kiểm toán trong quản trị doanh nghiệp. Tuy nhiên, văn bản không yêu cầu ủy ban đó phải mang tên hoặc có đầy đủ chức năng của một ủy ban kiểm toán.
HĐQT không cần tự đọc từng dòng mã hay hiểu chi tiết kiến trúc của từng mô hình. Nhưng họ phải biết doanh nghiệp đang trao cho AI quyền gì, hệ thống kiểm soát có hoạt động hay không và những cảnh báo nghiêm trọng đã được xử lý chưa.
Điểm cốt lõi là đưa thông tin về rủi ro lên cấp có trách nhiệm giám sát ban điều hành, đồng thời theo dõi việc xử lý sau cảnh báo.
Vì sao AI lại học cách quản trị của ngành tài chính?
Điểm chung nằm ở một vấn đề: rủi ro có thể lớn hơn rất nhiều so với một giao dịch đơn lẻ.
Sau các cuộc khủng hoảng tài chính, ngành ngân hàng phát triển nhiều tuyến phòng thủ vì không thể để bộ phận tạo ra rủi ro đồng thời là bên duy nhất đánh giá rủi ro đó.
Frontier AI đang đối diện với bài toán tương tự.
Một nhóm nghiên cứu có động lực đẩy nhanh năng lực của mô hình. Nhưng chính nhóm đó không nên là chủ thể duy nhất quyết định liệu mô hình đã đủ an toàn để triển khai hay chưa.
Do đó, mỗi bước đi xa hơn khỏi nhóm trực tiếp phát triển AI lại tạo thêm một mức độ độc lập: người vận hành kiểm soát mô hình → một đội ngũ khác kiểm tra hệ thống kiểm soát → một bên độc lập bên ngoài kiểm chứng → HĐQT chịu trách nhiệm giám sát cuối cùng.
Ý tưởng này cũng không hoàn toàn mới.
Từ năm 2023, OpenAI từng đề xuất rằng những hệ thống vượt một ngưỡng năng lực hoặc tài nguyên tính toán nhất định trong tương lai có thể cần chịu sự giám sát của một cơ quan quốc tế tương tự Cơ quan Năng lượng Nguyên tử Quốc tế (IAEA), có quyền kiểm tra hệ thống, yêu cầu kiểm toán, thử nghiệm mức độ tuân thủ và thậm chí hạn chế triển khai./.
