GLM-5.2: Mô hình AI mã nguồn mở đánh bại GPT-5.5 và đang đuổi kịp Claude Opus 4.8

02/07/2026 20:49
MXH mygo - GLM-5.2 của Z.ai đã đánh bại GPT-5.5 trên nhiều tiêu chuẩn mã hóa với chi phí chỉ bằng 1/6. Được cấp phép theo giấy phép MIT, có 1 triệu ngữ cảnh và có thể chạy cục bộ thông qua lượng tử hóa Unsloth...

Một mô hình mở với 744 tỷ tham số từ Z.ai vừa đánh bại GPT-5.5 trên nhiều bài kiểm tra mã hóa dài hạn — với chi phí chỉ bằng một phần sáu. GLM-5.2 là mô hình mở mạnh nhất từng được phát hành, và nó thay đổi cách tính toán cho bất kỳ doanh nghiệp nào đang đánh giá cơ sở hạ tầng AI vào năm 2026.

GLM-5.2 là mô hình ngôn ngữ lớn mở mới nhất của Z.ai, được phát hành vào ngày 16 tháng 6 năm 2026 theo giấy phép MIT không hạn chế. Nó có tổng cộng 744 tỷ tham số với khoảng 40 tỷ tham số hoạt động trên mỗi token (thông qua Mixture-of-Experts), cửa sổ ngữ cảnh 1 triệu token và những cải tiến kiến ​​trúc giúp nó cạnh tranh với — và trong một số hạng mục tốt hơn — các mô hình độc quyền tiên tiến từ OpenAI và Anthropic. Điều này rất quan trọng bởi vì khoảng cách giữa các mô hình AI mở và đóng đang thu hẹp nhanh chóng, nhưng GLM-5.2 đại diện cho một điều mới mẻ: một mô hình mở không chỉ "tiến gần" đến ranh giới mà còn sánh ngang hoặc vượt trội hơn trên các tiêu chuẩn quan trọng cụ thể. Đối với các doanh nghiệp, điều này có nghĩa là việc xây dựng hay mua cơ sở hạ tầng AI đã thay đổi về cơ bản. Giờ đây, bạn có thể tải xuống một mô hình hàng đầu, tinh chỉnh nó trên dữ liệu của mình và chạy nó trên phần cứng của riêng bạn mà không ảnh hưởng đáng kể đến khả năng.



GLM-5.2 liên tục được xếp hạng là mô hình trọng số mở đạt điểm cao nhất trong các đánh giá của bên thứ ba. Trên Chỉ số Trí tuệ Phân tích Nhân tạo v4.1 — tổng hợp 9 đánh giá bao gồm GDPval, Terminal-Bench, Humanity's Last Exam và GPQA Diamond — nó đạt 51 điểm, trở thành mô hình trọng số mở hàng đầu. Quan trọng hơn, nó cạnh tranh sòng phẳng với các mô hình độc quyền hàng đầu trên các tiêu chuẩn quan trọng nhất đối với công việc kỹ thuật thực tế. Các kết quả nổi bật được công bố như sau:
FrontierSWE: 74,4% — chỉ kém Claude Opus 4.8 (75,1%) 1% và vượt trội hơn GPT-5.5 (72,6%)
PostTrainBench: 34,3% — vượt xa GPT-5.5 (25,0%)
SWE-Marathon: 13,0% — chỉ đứng sau Claude Opus 4.8, đánh bại GPT-5.5 (12,0%)
SWE-bench Pro: 62,1 — vượt trội hơn hẳn GPT-5.5 (58,6) và phiên bản tiền nhiệm GLM-5.1 (58,4)
MCP-Atlas (sử dụng công cụ): 77,0 — vượt trội hơn GPT-5.5 (75,3), chỉ kém Claude Opus 4.8 (77,8)
Bài kiểm tra cuối cùng của nhân loại (với công cụ): 54,7 — vượt trội hơn GPT-5.5 (52,2), xếp sau Claude Opus 4.8 (57,9)
Terminal-Bench 2.1: 81,0 — một bước nhảy vọt đáng kể so với 63,5 của GLM-5.1, gần bằng Claude Opus 4.8 (85,0)
Design Arena: Đứng đầu với điểm ELO 1360, thậm chí vượt qua cả Claude Fable 5
Code Arena (Frontend): Thực tế là số 1 ở mức nỗ lực tối đa, vượt trội hơn Claude Opus 4.7 Thinking

Mô hình rất rõ ràng: GLM-5.2 vượt trội trong các tác vụ phức tạp, nhiều bước, đòi hỏi khả năng suy luận liên tục trong thời gian dài. Đó chính xác là nơi mà hầu hết giá trị AI doanh nghiệp được tạo ra vào năm 2026...

Trích dẫn https://flowtivity.ai/blog/glm-5-2-open-source-frontier-model/


Tin xem thêm

Kết quả sau 3 năm áp dụng giới hạn sạc 80% trên iPhone

Chuyên mục Ngày
08/10/2026 08:55

MXH mygo - Kể từ năm 2023, các mẫu iPhone đời mới của Apple đã được trang bị tính năng giới hạn mức sạc ở mức 80% dành cho những người dùng muốn kéo dài tuổi thọ pin. Việ...

Windows 11 26H2 là một trong những bản cập nhật tiết kiệm bộ nhớ nhất từ ​​trước đến nay

Chuyên mục Ngày
07/10/2026 10:06

MXH mygo - Các thử nghiệm ban đầu cho thấy Windows 11 26H2 sử dụng ít RAM hơn đáng kể trên một số máy tính, đánh dấu bước tiến trong nỗ lực tối ưu hóa bộ nhớ trên diện rộ...

Viture giới thiệu kính thông minh VONDER với giá dưới 300 USD

Chuyên mục Ngày
07/10/2026 09:52

MXH mygo - Viture mở rộng sang lĩnh vực kính thông minh với VONDER

Ý nghĩa đằng sau tên gọi của các cơn bão là gì?

Chuyên mục Ngày
06/10/2026 09:37

MXH mygo - Quy trình đặt tên bão tuân theo một hệ thống được thiết kế kỹ lưỡng

OpenAI sẽ bắt đầu gắn watermark vào văn bản của ChatGPT tại EU.

Chuyên mục Ngày
06/10/2026 09:32

MXH mygo - OpenAI cho biết trong một bài đăng trên blog hôm thứ Hai rằng họ sẽ bắt đầu thêm hình mờ (watermark) vô hình vào văn bản do ChatGPT và Codex tạo ra tại Liên mi...

Việc bán Leica hiện đã tạm dừng.

Chuyên mục Ngày
05/10/2026 09:15

MXH - Tin đồn mới về thương vụ bán cổ phần Leica

Mặt trái của nền kinh tế AI dành cho người tiêu dùng

Chuyên mục Ngày
05/10/2026 08:46

MXH mygo - Mảng AI dành cho người dùng cá nhân đang trỗi dậy mạnh mẽ.

Chương trình bốc thăm mua PS5 Pro mới của Sony!

Chuyên mục Ngày
04/10/2026 10:08

MXH mygo - Hình thức bốc thăm nhằm ngăn chặn dân buôn đầu cơ này có thể phản tác dụng ngay đúng thời điểm nhu cầu đang tăng vọt nhờ sức hút của GTA VI.

Giải pháp cho người dùng iPhone 18 Pro Max gặp sự cố mạng di động AT&T

Chuyên mục Ngày
04/10/2026 09:42

MXH mygo - Apple cho biết người dùng iPhone 18 Pro Max gặp sự cố mạng di động AT&T cần được đổi thiết bị mới.