HomeCông nghệ AIChưng cất mô hình AI: Mỹ nêu tên 6 hãng Trung Quốc

Chưng cất mô hình AI: Mỹ nêu tên 6 hãng Trung Quốc

Ngày 8/9, Cơ quan An ninh Quốc gia Mỹ (NSA), Cục Điều tra Liên bang (FBI) và Cơ quan An ninh mạng CISA cùng ký cảnh báo mang mã AA26-251A, cáo buộc sáu công ty Trung Quốc chưng cất mô hình AI của Mỹ ở “quy mô công nghiệp”. Theo The Register, sáu cái tên bị nêu đích danh gồm DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun và Z.AI. Điều đáng chú ý nhất là văn bản mô tả hoạt động chưng cất mô hình AI như “cốt lõi, chứ không chỉ là phần bổ trợ” trong chiến lược phát triển của nhóm này.

Đây không phải lần đầu Washington nêu nghi vấn. Từ đầu năm 2026, giới chức Mỹ đã nhiều lần cho rằng một số phòng thí nghiệm Trung Quốc rút ngắn quãng đường bằng cách chưng cất mô hình AI của phương Tây. Nhưng AA26-251A là lần đầu tiên ba cơ quan cùng đứng tên trong một tài liệu kỹ thuật, liệt kê từng công ty và từng mô hình bị nhắm tới.

Chưng cất mô hình AI là gì và vì sao Mỹ coi đây là mối đe doạ

Về mặt kỹ thuật, chưng cất (distillation) là quá trình một mô hình nhỏ liên tục đặt câu hỏi cho một mô hình lớn rồi học cách mô hình lớn trả lời. Qua hàng triệu lượt hỏi đáp, mô hình nhỏ hấp thụ được cách suy luận, cách trình bày và cả những mẹo tối ưu mà mô hình lớn đã phải trả giá rất đắt mới có. Nói cách khác, chưng cất mô hình AI là cách rút gọn hàng trăm triệu USD chi phí huấn luyện thành vài tháng gọi API.

Bản thân kỹ thuật này hoàn toàn hợp pháp khi một hãng tự chưng cất mô hình AI của chính mình để tạo bản nhỏ gọn hơn — đó là cách phổ biến để có phiên bản “mini” hay “flash” chạy nhanh và rẻ. Vấn đề nằm ở chỗ gần như mọi nhà cung cấp thương mại đều cấm bên thứ ba làm điều đó với mô hình của họ, và điều khoản sử dụng ghi rõ điều này để bảo vệ khoản đầu tư khổng lồ vào dữ liệu, hạ tầng và nhân lực.

Cảnh báo của ba cơ quan Mỹ đi vào chi tiết từng trường hợp. DeepSeek bị cho là nhắm vào năng lực suy luận, khả năng chạy tác vụ tự động và các tối ưu chuyên biệt của GPT-4, GPT-5 cùng nhiều phiên bản Claude để huấn luyện R1 và V3. Moonshot AI bị cáo buộc rút dữ liệu từ Claude Fable 5 phục vụ mô hình Kimi K3. Alibaba bị nói đã dùng hoạt động chưng cất mô hình AI ở quy mô lớn để nâng chất lượng dòng Qwen. MiniMax, StepFun và Z.AI bị nêu tên với các mảng kỹ thuật phần mềm, lập trình, chăm sóc khách hàng và chuỗi suy luận.

Đáng chú ý hơn cả là mô tả về đường đi của dữ liệu. Theo tài liệu, các yêu cầu chưng cất mô hình AI được định tuyến qua nhiều ngả: API gốc, nhà cung cấp đám mây trung gian, và các “aggregator” bên thứ ba tự động xoá dấu vết siêu dữ liệu người dùng. Bên cạnh đó là một chợ xám gồm những proxy được gọi là “trạm trung chuyển”, bán lại quyền truy cập mô hình tiên phong với giá chỉ bằng một phần nhỏ giá chính thức, giúp lách giới hạn địa lý và làm mờ khả năng truy vết.

Lý do Washington phản ứng gay gắt không chỉ nằm ở bản quyền. Tài liệu cáo buộc DeepSeek dùng chưng cất mô hình AI để sinh dữ liệu tổng hợp phục vụ huấn luyện, khiến tuyên bố “chỉ tốn lượng tính toán rất nhỏ” của hãng này trở nên không chính xác. Tuyên bố đó từng khiến nhà đầu tư hoảng loạn vì lo hàng tỷ USD đổ vào hạ tầng có thể là thừa. Với dòng Qwen, vấn đề còn trực diện hơn: nhiều mô hình chất lượng cao được phát hành miễn phí, cạnh tranh thẳng với các hãng Mỹ đang thu phí mà vẫn lỗ nặng.

Phần khuyến nghị của cảnh báo cũng khác thường. Ba cơ quan đề nghị các hãng AI Mỹ triển khai công cụ giám sát hành vi, xem việc một tài khoản mới lập tức dùng hết hạn mức là dấu hiệu đáng ngờ, và “âm thầm chỉnh sửa câu trả lời” đối với những phiên bị nghi là chưng cất mô hình AI nhằm làm giảm giá trị dữ liệu thu được. Họ cũng khuyến khích các nhà cung cấp đối chiếu hoạt động chéo giữa nền tảng đám mây và aggregator để lộ ra những chiến dịch phân tán.

Người dùng Việt làm việc cùng công cụ AI giữa tranh cãi chưng cất mô hình AI
Người dùng Việt vẫn đang hưởng lợi từ những mô hình giá rẻ ra đời sau làn sóng chưng cất mô hình AI.

Người dùng Việt nên nhìn cuộc tranh cãi này thế nào

Với người dùng trong nước, đây không phải câu chuyện xa lạ. DeepSeek, Qwen và Kimi nằm trong nhóm được dùng nhiều nhất tại Việt Nam, phần lớn vì miễn phí hoặc rẻ hơn hẳn các lựa chọn từ Mỹ. Nếu cáo buộc là đúng, một phần lợi thế giá đó đến từ việc chưng cất mô hình AI thay vì tự trả chi phí nghiên cứu gốc.

Tuy vậy cần giữ khoảng cách với kết luận. AA26-251A là cáo buộc của cơ quan an ninh, không phải phán quyết của toà. Phía Trung Quốc trước đó đã phản bác rằng chính các hãng Mỹ mới là bên chưng cất mô hình AI của họ, đồng thời ngỏ ý sẽ đáp trả nếu Washington ban hành lệnh cấm dựa trên những cáo buộc này. Cho tới lúc này chưa bên nào công bố bằng chứng kỹ thuật đầy đủ ra công chúng.

Có ba điều thiết thực rút ra được. Thứ nhất, tuyệt đối tránh mua khoá API “giá hời” trôi nổi trên các nhóm chat — đó chính là mô hình “trạm trung chuyển” mà cảnh báo mô tả, và người mua vừa vi phạm điều khoản vừa có nguy cơ mất tài khoản lẫn dữ liệu công việc.

Thứ hai, khuyến nghị “âm thầm chỉnh sửa câu trả lời” đáng để lưu tâm. Nếu các hãng lớn thực sự làm vậy, chất lượng đầu ra có thể bị hạ ngầm mà người dùng không hề hay biết, chỉ vì hành vi truy cập bị xếp vào diện nghi vấn. Dùng tài khoản chính danh, đúng khu vực, với hạn mức hợp lý là cách rẻ nhất để không rơi vào nhóm đó.

Thứ ba, các mô hình trọng số mở như Qwen vẫn có thể tải về và dùng hợp pháp theo giấy phép của chúng. Tranh cãi về nguồn gốc dữ liệu huấn luyện là chuyện giữa các hãng và cơ quan quản lý, không tự động biến người dùng cuối thành bên vi phạm.

Điều khó đoán hơn là chuyện gì xảy ra tiếp theo. Nếu các nhà cung cấp Mỹ siết chặt truy cập và triển khai giám sát như khuyến nghị, chi phí để một phòng thí nghiệm mới bắt kịp nhóm dẫn đầu sẽ tăng lên đáng kể. Kỷ nguyên mô hình mở, mạnh và gần như miễn phí — thứ mà nhiều người Việt đang tận hưởng — nhiều khả năng phụ thuộc vào việc cuộc tranh cãi quanh chưng cất mô hình AI ngã ngũ theo hướng nào.

Nguồn: The Register, CISA — Advisory AA26-251A, Engadget.

Xem thêm: Cẩm nang công cụ AI 2026 · DeepSeek là gì · AI an ninh mạng 2026.

Đọc thêm: 10 nghề mới nhờ AI đáng chú ý năm 2026 · AI agent doanh nghiệp: 97% dùng, 79% gặp khó · Công cụ AI 2026: cách chọn, đánh giá và dùng

Đặng Trọng Khôi
Đặng Trọng Khôi
Marketer chuyên automation với n8n, Zapier, Make. Chia sẻ công thức kết hợp AI với no-code để tự động hoá quy trình marketing, sales, CSKH.
Bài viết liên quan

LEAVE A REPLY

Please enter your comment!
Please enter your name here

- Advertisment -
Google search engine

Xem nhiều nhất

Bình luận gần đây