AI Trung Quốc tự học được cách hack

AI Trung Quốc tự học được cách hack

Thứ 5, 20/08/2026 06:00
Z.ai công bố GLM-5.3, tự nhận là model mã nguồn mở mạnh nhất thế giới về lập trình, nhưng điều đáng chú ý hơn là năng lực an ninh mạng mà công ty nói đã phát triển "ngoài kế hoạch" trong quá trình huấn luyện

Z.ai, tên quốc tế của Zhipu AI (Trung Quốc), ra mắt GLM-5.3 hôm 14/8, tự nhận đây là model mã nguồn mở mạnh nhất thế giới hiện nay về lập trình. Model dùng chung kiến trúc nền tảng với GLM-5.2 ra mắt hồi tháng 6, khoảng 744 tỷ tham số dạng Mixture-of-Experts, kích hoạt khoảng 40 tỷ tham số mỗi token. Toàn bộ cải thiện đến từ việc mở rộng quá trình huấn luyện sau khi có model nền (post-training), không phải từ việc xây dựng kiến trúc lớn hơn hay huấn luyện lại từ đầu.

Theo benchmark nội bộ của Zhipu, GLM-5.3 cải thiện 50% so với GLM-5.2. Trên các benchmark công khai, model đạt kết quả đáng chú ý: Terminal-Bench 3.0, thước đo khả năng hoàn thành tác vụ phức tạp trong terminal thật, nhảy từ 4,6 điểm của GLM-5.2 lên 28,3 điểm. DeepSWE v1.1, thước đo kỹ thuật phần mềm dài hạn, tăng từ 46,2 lên 66,9 điểm. GLM-5.3 hiện xếp hạng nhất trong nhóm model mã nguồn mở trên cả hai benchmark này, cũng như trên Agents' Last Exam.

Trên thang điểm tổng hợp Artificial Analysis Intelligence Index, một đơn vị đánh giá độc lập, GLM-5.3 đạt 60 điểm, tăng 7 điểm so với phiên bản trước, ngang bằng Kimi K3 của Moonshot AI, xếp sau Claude Opus 5 (63 điểm) và Claude Fable 5 (62 điểm) không xa. Zhipu tự mô tả năng lực lập trình của GLM-5.3 "đang tiệm cận Claude Fable 5", dù đây là tuyên bố từ chính hãng, chưa có bên thứ ba kiểm chứng đầy đủ.

Biểu đồ so sánh điểm số GLM-5.3 với GLM-5.2, Kimi K3, Claude Fable 5 và GPT-5.6 Sol

Đây là phần đáng chú ý nhất của đợt ra mắt. Zhipu bổ sung dữ liệu và môi trường huấn luyện tập trung vào phát hiện lỗ hổng bảo mật cho GLM-5.3, nhưng theo công bố của công ty, model "bắt đầu suy luận qua nhiều giai đoạn khai thác, hình thành các kế hoạch mạch lạc cho toàn bộ chuỗi khai thác lỗ hổng", một mức năng lực mà Zhipu nói đã phát triển nhanh và xa hơn dự tính ban đầu.

Trên benchmark CyberGym, thước đo khả năng phát hiện và xác thực lỗ hổng bảo mật, GLM-5.3 đạt 84,5%, nhỉnh hơn Claude Mythos 5 của Anthropic (83,8%) và GPT-5.6 Sol của OpenAI (83,6%), dù biên độ dẫn trước rất mỏng. Tuy nhiên trên ExploitBench, thước đo khả năng đi trọn một chuỗi khai thác lỗ hổng hoàn chỉnh, GLM-5.3 chỉ đạt 54,4%, thua khá xa Mythos 5 (78%) và GPT-5.6 Sol (76,5%). Nói cách khác, model này giỏi ngang các đối thủ Mỹ ở khâu phát hiện lỗ hổng, nhưng còn kém hẳn ở khâu khai thác sâu và thực thi trọn vẹn một cuộc tấn công.

Làm việc cùng các đội an ninh mạng tại Trung Quốc, Zhipu công bố đã phát hiện hơn 2.400 lỗ hổng bảo mật trên 269 dự án mã nguồn mở, một số lỗ hổng tồn tại tới khoảng 40 năm. Các phát hiện được ghi vào một sổ đăng ký công khai, hiện có 53 lỗ hổng đã công bố, phần còn lại chưa được tiết lộ trong lúc chờ các dự án liên quan khắc phục.

Khác với các phiên bản GLM trước đây thường mở trọng số ngay khi ra mắt, GLM-5.3 là lần đầu tiên trong dòng sản phẩm này Zhipu chủ động hoãn phát hành trọng số mở, dự kiến khoảng hai tuần sau ra mắt, với lý do cần thời gian đánh giá và siết chặt an toàn trước khi công khai cho cộng đồng tự triển khai.

Hiện GLM-5.3 chỉ dùng được qua GLM Coding Plan, hệ thống quota theo điểm, tương thích với công cụ coding riêng ZCode của Z.ai, cũng như Claude Code và OpenCode. API độc lập được ghi là sắp ra mắt, chưa có ngày cụ thể. Giá giữ nguyên như GLM-5.2, 1,4 USD cho mỗi 1 triệu token đầu vào và 4,4 USD cho mỗi 1 triệu token đầu ra, rẻ hơn đáng kể so với mức 3 USD và 15 USD của Kimi K3.

Sự xuất hiện năng lực an ninh mạng ngoài dự tính ở GLM-5.3 không phải trường hợp cá biệt trong ngành. Cùng thời điểm này, cả OpenAI lẫn Anthropic cũng đang siết chặt các biện pháp giám sát cho model của mình sau khi phát hiện dấu hiệu tương tự, cho thấy đây có thể là một hệ quả khó tránh khi các phòng thí nghiệm AI, dù ở Mỹ hay Trung Quốc, cùng theo đuổi việc huấn luyện model giỏi lập trình hơn.

Thế Duyệt

Cùng chuyên mục

Báo Hàn Quốc: “Phép màu Kim Sang-sik thật ngoạn mục!”

Thứ 5, 20/08/2026 07:22
Truyền thông Hàn Quốc ấn tượng mạnh với cách mà tuyển Việt Nam hạ gục Malaysia để tiến vào chung kết AFF Cup.

VETC tạm dừng thu phí ví điện tử 6.600 đồng/tháng, khẳng định đến nay vẫn chưa thu phí của tài khoản nào

Thứ 5, 20/08/2026 07:15
Sau khi nhận nhiều ý kiến trái chiều từ chủ xe, VETC quyết định tạm dừng kế hoạch thu phí quản lý Ví điện tử VETC ở mức 6.600 đồng/tháng với khách hàng cá nhân và 66.000 đồng/tháng với khách hàng tổ chức.

Báo Thái Lan ấn tượng với sức mạnh áp đảo của đội tuyển Việt Nam

Thứ 5, 20/08/2026 06:59
Đội tuyển Việt Nam sẽ gặp Thái Lan ở chung kết AFF Cup 2026.

InnoEx 2026 trước giờ khai màn: Khi lợi thế cạnh tranh bước vào một cuộc tái định hình

Thứ 5, 20/08/2026 06:26
Hai ngày trước giờ khai màn, InnoEx 2026 đang thu hút sự chú ý không chỉ bởi quy mô của một diễn đàn và triển lãm quốc tế lớn, mà còn bởi những câu hỏi được đặt ra đúng vào thời điểm lợi thế cạnh tranh của doanh nghiệp đang chịu sức ép tái định hình.

Chung kết AFF Cup 2026: Chủ nhà Thái Lan bán giá vé đắt nhất cho fan Việt Nam

Thứ 5, 20/08/2026 06:18
Vé xem trận chung kết lượt đi AFF Cup 2026 tại Thái Lan đang được mở bán.
     
Nổi bật trong ngày

Apple, Samsung, OPPO, Huawei hay Garmin: Đâu là chiếc smartwatch hợp với bạn?

Thứ 4, 19/08/2026 01:47
Không có smartwatch phù hợp với tất cả. 5 mẫu đồng hồ cao cấp dưới đây hướng đến những nhu cầu khác nhau, từ sức khỏe, thể thao, pin dài đến kết nối và hoạt động ngoài trời.

Cơn mưa lớn ở Thái Lan, chiến thắng của Singapore & mối lo cho ĐT Việt Nam

Thứ 4, 19/08/2026 05:53
Singapore đã tạo nên một chiến thắng cực kỳ kịch tính trước Thái Lan và điều đó có thể sẽ tiếp thêm động lực cho Malaysia.

VinFast VF Wild bản cận thương mại lộ diện ‘trần trụi’ trên đường: 2 tùy chọn màu, 3 kiểu mâm, có chi tiết khẳng định là hybrid cắm sạc

Thứ 4, 19/08/2026 06:00
Hình ảnh thực tế VinFast VF Wild lộ diện trên đường với hai nắp nhiên liệu nghi vấn công nghệ EREV hoặc PHEV. Chiếc xe có nhiều điểm khác bản concept.

Đội hình Việt Nam vs Malaysia: HLV Kim Sang-sik tạm cất “bảo kiếm”, xoay bài vào phút chót?

Thứ 4, 19/08/2026 06:34
HLV Kim Sang-sik dự kiến có thay đổi trong đội hình xuất phát.
xe.nguoiduatin.vn