OpenAI, Google và Anthropic đang thảo luận việc lập một cơ quan chuẩn an toàn AI do chính ngành dẫn dắt, sau chuỗi họp nhóm làm việc kéo dài từ tháng 7/2026 và còn tiếp diễn trong tuần đầu tháng 9. Đây là lần đầu ba phòng thí nghiệm cạnh tranh gay gắt nhất ngồi chung một bàn để bàn về chuẩn an toàn AI, dù tới nay chưa có tổ chức nào được công bố chính thức. (tham khảo: Reuters)
Theo các nguồn tin trong ngành, đại diện ba hãng đã gặp nhau nhiều lần kể từ tháng 7, lần gần nhất diễn ra trong tuần qua. Chưa có bộ quy tắc nào hoàn thiện, chưa có ban lãnh đạo, cũng chưa có cơ chế xử lý khi một mô hình không vượt qua bài kiểm định. Nói cách khác, chuẩn an toàn AI hiện vẫn ở dạng thảo luận giữa các bên chứ không phải cam kết ràng buộc.
Ý tưởng không mới. Tháng 7/2026, CEO Google DeepMind Demis Hassabis công khai đề xuất một tổ chức chuẩn hoá cho AI tiên phong, lấy cảm hứng từ FINRA — cơ quan tự quản giám sát các công ty môi giới chứng khoán tại Mỹ dưới sự giám sát của SEC. Theo đề xuất, các hãng sẽ tự nguyện nộp mô hình cho bên thứ ba kiểm định trước khi phát hành, tập trung vào những năng lực nguy hiểm như tấn công mạng, hỗ trợ chế tạo tác nhân sinh học và hành vi đánh lừa người đánh giá. (xem thêm: Axios)
Vấn đề mà một chuẩn an toàn AI chung muốn giải quyết nằm ở chỗ mỗi hãng hiện đo rủi ro theo một thước riêng. Anthropic dùng Responsible Scaling Policy, OpenAI dùng Preparedness Framework, còn Google DeepMind dùng Frontier Safety Framework. Một bản đối chiếu độc lập công bố hồi tháng 7 cho thấy cả ba đều gắn năng lực nguy hiểm với mức bảo vệ tương ứng, nhưng khác nhau đáng kể về cấu trúc, thuật ngữ và ngưỡng kích hoạt.
Hệ quả là khi một hãng tuyên bố mô hình của mình đã chạm ngưỡng năng lực nguy hiểm, không ai bên ngoài biết chính xác câu đó nghĩa là gì. Đây là lý do những người ủng hộ chuẩn an toàn AI chung cho rằng ba đối thủ không cần chính sách giống hệt nhau, họ chỉ cần thống nhất dùng chung một cây thước.
Áp lực tăng thêm từ cuối tuần trước, khi CEO Anthropic Dario Amodei đăng bài luận kêu gọi các phòng thí nghiệm giảm tốc độ mở rộng năng lực và mời người đánh giá độc lập vào bên trong công ty. Sam Altman của OpenAI nói hãng sẵn sàng làm điều tương tự; Demis Hassabis và Elon Musk cũng lên tiếng ủng hộ. Amodei còn đề nghị cân nhắc miễn trừ chống độc quyền có giới hạn, để các hãng được chia sẻ thông tin rủi ro mà không vướng luật cạnh tranh.
Mục lục bài viết
Vì sao chuẩn an toàn AI chung khó thành hình trong năm 2026
Trở ngại lớn nhất là tính độc lập. Nếu OpenAI, Google và Anthropic cùng lập ra tổ chức viết luật chơi cho chính OpenAI, Google và Anthropic, khó tránh câu hỏi tổ chức đó độc lập tới đâu. Đề xuất của Hassabis đã tính trước điều này bằng cách yêu cầu hội đồng quản trị có tỷ lệ thành viên độc lập cao, gồm chuyên gia kỹ thuật, đại diện chính phủ và cộng đồng mã nguồn mở.
Nhưng danh sách câu hỏi quản trị vẫn dài: ai bổ nhiệm lãnh đạo, ai trả chi phí vận hành, người đánh giá có được công khai chỉ trích hãng thành viên hay không, một hãng có quyền bỏ qua kết quả kiểm định thất bại hay không, và báo cáo có được công bố hay không. Câu trả lời cho những câu hỏi đó sẽ quyết định chuẩn an toàn AI trở thành công cụ thật hay chỉ là tấm biển trang trí.
Rào cản thứ hai là chi phí. Nếu một vòng kiểm định trước phát hành tiêu tốn hàng triệu USD, các hãng lớn có thể trả được còn startup thì không. Khi đó chuẩn an toàn AI vô tình trở thành hào cạnh tranh, đẩy đối thủ nhỏ và các nhóm phát triển mô hình trọng số mở ra ngoài cuộc chơi. Đây cũng là lý do giới nghiên cứu độc lập đòi có ghế trong bất kỳ tổ chức nào được lập ra.
Rào cản thứ ba đến từ chính trị. Ngày 14/9, Tổng thống Donald Trump bác bỏ lời kêu gọi giảm tốc và chỉ trích Amodei, cho rằng nước Mỹ không cần thêm rào chắn cho AI. Trong bối cảnh đó, các hãng có thêm lý do tự xây chuẩn an toàn AI thay vì chờ luật, nhưng cũng mất chỗ dựa để buộc mọi bên tham gia. Sam Altman thì nhắc tới khả năng Mỹ và Trung Quốc thống nhất một bộ quy tắc kiểm định chung, mục tiêu còn xa hơn nữa.

Doanh nghiệp Việt Nam nên theo dõi điều gì
Với phần lớn doanh nghiệp Việt Nam, vai trò trong câu chuyện này là bên dùng API chứ không phải bên huấn luyện mô hình. Lợi ích trực tiếp nếu chuẩn an toàn AI chung ra đời là khả năng so sánh: khi ba nhà cung cấp cùng công bố kết quả theo một khung, đội kỹ thuật ở Hà Nội hay TP HCM có thể đọc hai bản đánh giá cạnh nhau mà không phải tự quy đổi thuật ngữ.
Hiện tại việc quy đổi đó gần như bất khả thi. Một ngân hàng muốn chọn mô hình cho hệ thống hỗ trợ khách hàng phải đọc ba tài liệu viết theo ba logic khác nhau, trong khi các rủi ro sát sườn như ảo giác AI hay rò rỉ dữ liệu lại không nằm trong nhóm năng lực nguy hiểm mà một cơ quan chuẩn an toàn AI dự kiến kiểm tra. Chuẩn chung nhắm tới rủi ro thảm hoạ, không thay thế được khâu kiểm thử nội bộ.
Vì vậy, lời khuyên thực tế cho năm 2026 là đừng chờ. Doanh nghiệp vẫn cần bộ kiểm thử riêng cho từng ca sử dụng, nhật ký truy vết và người chịu trách nhiệm cuối cùng khi mô hình trả lời sai. Những ai đang triển khai chatbot AI cho khách hàng nên coi khung an toàn của nhà cung cấp là điểm khởi đầu, không phải bảo chứng. Bối cảnh cạnh tranh cũng đang siết chặt hơn sau khi Mỹ nêu tên sáu hãng Trung Quốc trong hồ sơ chưng cất mô hình.
Mốc cần theo dõi là cuối năm 2026, thời điểm Hassabis từng đặt mục tiêu để một cơ quan chuẩn an toàn AI đi vào hoạt động. Nếu tới đó vẫn chưa có tên tổ chức, ngân sách và danh sách thành viên hội đồng, khả năng cao đây chỉ là thêm một vòng thảo luận nữa giữa các đối thủ.
Nguồn: Reuters, Axios. Xem thêm: Chưng cất mô hình AI: Mỹ nêu tên 6 hãng Trung Quốc.




