HomeCông cụ AIGLM-5.3 tự phát hiện hơn 2.400 lỗ hổng bảo mật

GLM-5.3 tự phát hiện hơn 2.400 lỗ hổng bảo mật

Z.ai, công ty AI Trung Quốc trước đây có tên Zhipu AI, vừa công bố GLM-5.3, mô hình mới nhất trong dòng GLM tập trung vào lập trình, tác vụ tự động kéo dài nhiều giờ và an ninh mạng. Theo thông báo chính thức từ Z.ai, GLM-5.3 không phải một mô hình lớn hơn mà giữ nguyên kiến trúc nền của GLM-5.2, toàn bộ điểm cải thiện đến từ việc huấn luyện hậu kỳ (post-training) ở quy mô lớn hơn nhiều.

GLM-5.3 dùng chung kiến trúc Mixture-of-Experts khoảng 743-744 tỷ tham số tổng, 40 tỷ tham số kích hoạt mỗi lượt suy luận – giống hệt GLM-5.2. Z.ai cho biết đã tăng mạnh số lượng và độ đa dạng môi trường huấn luyện dài hơi (long-horizon), đổ nhiều tài nguyên tính toán hơn vào học tăng cường. Mục tiêu là đưa mô hình vượt qua giai đoạn “vibe coding” tạo đoạn mã rời rạc, tiến tới “kỹ thuật tác tử” (agentic engineering) – có thể đảm nhận cả khối công việc kỹ sư kéo dài nhiều ngày.

Kết quả benchmark cho thấy bước nhảy rõ rệt. Trên Terminal-Bench 3.0, điểm số tăng từ 4,6 lên 28,3; DeepSWE v1.1 tăng từ 46,2 lên 66,9; AutomationBench tăng từ 26,2 lên 48,2. Trên bài kiểm tra lập trình nội bộ Code Bench, Z.ai báo cáo mức cải thiện khoảng 50% so với GLM-5.2, mô hình còn dùng ít token đầu ra hơn để đạt kết quả tương đương hoặc tốt hơn – tức hiệu quả chi phí cao hơn khi triển khai thực tế.

GLM-5.3 tăng mạnh khả năng lập trình so với GLM-5.2

So với chính phiên bản tiền nhiệm GLM-5.2, GLM-5.3 cải thiện ở mọi hạng mục trong bảng so sánh mà Z.ai công bố. Tuy nhiên, mô hình này chưa phải lựa chọn dẫn đầu tuyệt đối: GPT-5.6 Sol của OpenAI vẫn đạt 34,6 điểm Terminal-Bench 3.0 và 72,7 điểm DeepSWE, còn Claude Fable 5 của Anthropic đạt 33,7 và 69,7 điểm – đều cao hơn GLM-5.3. Bù lại, GLM-5.3 dẫn đầu ở ba bài kiểm tra CyberGym, AutomationBench và GDPval-AA v2, gần ngang GPT-5.6 Sol ở bài Agents’ Last Exam dòng lệnh (28,5 so với 28,6 điểm).

Đáng chú ý nhất là mảng an ninh mạng – lĩnh vực GLM-5.3 được huấn luyện chuyên sâu. Điểm CyberGym đạt 84,5%, cao nhất trong số các mô hình được Z.ai đưa vào so sánh, nhỉnh hơn Claude Mythos 5 của Anthropic (83,8%). Điểm ExploitBench tăng hơn gấp đôi, từ 24,4% lên 54,4%. Trong một bài kiểm tra thực tế, GLM-5.3 đã tự phát hiện 2.436 lỗ hổng bảo mật, trong đó 1.097 lỗ hổng ở mức trung bình đến nghiêm trọng, trải trên 269 dự án mã nguồn mở.

Bảng điều khiển quét lỗ hổng bảo mật bằng GLM-5.3 với cảnh báo màu đỏ
Khả năng dò lỗ hổng bảo mật là điểm được huấn luyện chuyên sâu trên GLM-5.3.

Vì sao khả năng tìm lỗ hổng bảo mật đáng chú ý

Năng lực phát hiện lỗ hổng quy mô lớn như vậy vừa là điểm mạnh vừa là rủi ro cần giám sát. Z.ai định vị đây là công cụ hỗ trợ nghiên cứu bảo mật phòng thủ (defensive security), giúp đội kỹ thuật quét lỗ hổng nhanh hơn trước khi tin tặc khai thác. Nhưng cùng năng lực phân tích mã nguồn sâu đó cũng có thể bị lợi dụng cho mục đích tấn công nếu rơi vào tay kẻ xấu. Đầu tháng 8, Viện An ninh AI Anh (AISI) từng ghi nhận Claude Mythos 5 và GPT-5.6 Sol thực hiện một số hành vi tấn công thật ngoài dự kiến trong một thử nghiệm an ninh mạng khác, cho thấy năng lực an ninh mạng của các mô hình AI hàng đầu đang tăng nhanh ở cả hai mặt tấn công lẫn phòng thủ.

Về khả năng tiếp cận, GLM-5.3 hiện có trên gói GLM Coding Plan và nền tảng ZCode của Z.ai, ba mức giá Lite (18 USD/tháng), Pro (80 USD/tháng) và Max (168 USD/tháng), giảm còn khoảng 12,6-117,6 USD/tháng nếu đóng theo năm. Bản API tổng quát cho lập trình viên vẫn đang “sắp ra mắt” tại thời điểm công bố. Trọng số mô hình (open weights) dự kiến phát hành theo giấy phép mở khoảng hai tuần sau ngày ra mắt, sau khi Z.ai hoàn tất đánh giá an toàn tập trung vào chính năng lực an ninh mạng mới này.

GLM-5.3 tiếp nối làn sóng mô hình mã nguồn mở giá rẻ từ Trung Quốc gây chú ý suốt năm 2026, cùng nhóm với DeepSeek V4 Pro và Kimi K3. Với lập trình viên Việt Nam, đây là thêm một lựa chọn công cụ AI chi phí thấp cho tác vụ viết mã và tự động hoá, nhưng tính năng dò lỗ hổng bảo mật nên dùng trong phạm vi được cấp phép rõ ràng, tránh vi phạm Luật AI có hiệu lực từ 1/3/2026. Giới quan sát sẽ theo dõi hai mốc tới: thời điểm Z.ai mở API theo token, và liệu bộ trọng số mở có đúng hẹn xuất hiện cuối tháng 8 hay không.

Nguồn: CometAPI, Z.ai. Xem thêm: DeepSeek V4 Pro ra mắt bản chính thức 2026.

Lê Minh Tâm
Lê Minh Tâm
Kỹ sư AI tại TP.HCM, chuyên Python và tự động hoá quy trình. Viết về workflow no-code, API LLM và cách ứng dụng AI vào sản phẩm thực tế.
Bài viết liên quan

LEAVE A REPLY

Please enter your comment!
Please enter your name here

- Advertisment -
Google search engine

Xem nhiều nhất

Bình luận gần đây