Trí Bản phát hành GLM-5.3 Flash, do 100.000 chip nội địa cung cấp dịch vụ suy diễn, đối đầu với DeepSeek V4 Flash
Tin tức từ ChainCatcher, Zhipu phát hành mô hình flagship nhẹ GLM-5.3 Flash, nhằm đối đầu với DeepSeek V4 Flash, và gọi đến hơn 100.000 chip nội địa cung cấp dịch vụ suy diễn. Quy mô tham số của mô hình khoảng 300B, khoảng 40% so với GLM-5.3, tương đương với DeepSeek V4 Flash; sử dụng kiến trúc MoE, tham số thực tế được kích hoạt khoảng 18B, có khả năng đa phương thức nguyên bản, hỗ trợ đầu vào hình ảnh và video, cũng là mô hình mới đầu tiên có khả năng đa phương thức sau khi Zhipu tập trung vào chiến lược coding.
Điểm đánh giá tổng hợp vượt qua thế hệ flagship trước đó GLM-5.2, ngang bằng với Claude Opus 4.8, và cao hơn điểm số của phiên bản chính thức DeepSeek V4 Pro. Giá cả là 0.8 nhân dân tệ cho mỗi triệu token đầu vào, 2.8 nhân dân tệ cho đầu ra, 0.23 nhân dân tệ cho hit bộ nhớ, khoảng một phần mười so với GLM-5.3, cung cấp ưu đãi nửa giá trong hai tuần đầu tiên ra mắt. Mô hình hoàn toàn tương thích với sức mạnh tính toán nội địa, lưu lượng trực tuyến được đảm nhận bởi chip nội địa, Zhipu cho biết hiệu suất phần cứng của cụm và chi phí mỗi token đã đạt mức tương đương với GPU Nvidia chính thống; mô hình này trước đó đã được thử nghiệm ẩn danh trên nền tảng nước ngoài với mã hiệu Ox Alpha.






