BTC $78,786.24 -1.13%
ETH $2,470.14 -0.39%
BNB $734.89 -1.46%
XRP $1.38 -1.92%
SOL $103.23 -2.36%
TRX $0.3337 -0.43%
DOGE $0.0889 +0.06%
ADA $0.2173 -0.02%
BCH $258.80 +1.39%
LINK $12.87 +5.32%
HYPE $85.13 -3.58%
AAVE $130.61 -2.30%
SUI $0.8016 +1.39%
XLM $0.1885 +2.57%
ZEC $1,147.26 -1.82%
BTC $78,786.24 -1.13%
ETH $2,470.14 -0.39%
BNB $734.89 -1.46%
XRP $1.38 -1.92%
SOL $103.23 -2.36%
TRX $0.3337 -0.43%
DOGE $0.0889 +0.06%
ADA $0.2173 -0.02%
BCH $258.80 +1.39%
LINK $12.87 +5.32%
HYPE $85.13 -3.58%
AAVE $130.61 -2.30%
SUI $0.8016 +1.39%
XLM $0.1885 +2.57%
ZEC $1,147.26 -1.82%

glm-5

Tất cả
Bài viết
Tin nhanh

first_img Trí Bản phát hành GLM-5.3 Flash, do 100.000 chip nội địa cung cấp dịch vụ suy diễn, đối đầu với DeepSeek V4 Flash

Tin tức từ ChainCatcher, Zhipu phát hành mô hình flagship nhẹ GLM-5.3 Flash, nhằm đối đầu với DeepSeek V4 Flash, và gọi đến hơn 100.000 chip nội địa cung cấp dịch vụ suy diễn. Quy mô tham số của mô hình khoảng 300B, khoảng 40% so với GLM-5.3, tương đương với DeepSeek V4 Flash; sử dụng kiến trúc MoE, tham số thực tế được kích hoạt khoảng 18B, có khả năng đa phương thức nguyên bản, hỗ trợ đầu vào hình ảnh và video, cũng là mô hình mới đầu tiên có khả năng đa phương thức sau khi Zhipu tập trung vào chiến lược coding.Điểm đánh giá tổng hợp vượt qua thế hệ flagship trước đó GLM-5.2, ngang bằng với Claude Opus 4.8, và cao hơn điểm số của phiên bản chính thức DeepSeek V4 Pro. Giá cả là 0.8 nhân dân tệ cho mỗi triệu token đầu vào, 2.8 nhân dân tệ cho đầu ra, 0.23 nhân dân tệ cho hit bộ nhớ, khoảng một phần mười so với GLM-5.3, cung cấp ưu đãi nửa giá trong hai tuần đầu tiên ra mắt. Mô hình hoàn toàn tương thích với sức mạnh tính toán nội địa, lưu lượng trực tuyến được đảm nhận bởi chip nội địa, Zhipu cho biết hiệu suất phần cứng của cụm và chi phí mỗi token đã đạt mức tương đương với GPU Nvidia chính thống; mô hình này trước đó đã được thử nghiệm ẩn danh trên nền tảng nước ngoài với mã hiệu Ox Alpha.

Trí Bản ra mắt và mở nguồn mô hình "Niu Lai" GLM-5.3-Flash

ChainCatcher thông báo, Zhìpǔ chính thức công bố ra mắt và mã nguồn mở GLM-5.3-Flash, đây là mô hình đa phương thức gốc đầu tiên trong dòng sản phẩm GLM-5.Theo thông tin, hiệu suất tổng thể của GLM-5.3-Flash vượt qua GLM-5.2, đánh giá lập trình và Agent đã gần đạt đến Claude Opus 4.8, nhưng giá chỉ bằng một phần mười của GLM-5.2. Nó cũng đã thay đổi một bộ mô hình cơ sở mới, lần đầu tiên trong dòng sản phẩm chính của GLM giới thiệu kiến trúc hỗn hợp chú ý thưa thớt và chú ý tuyến tính, và được tiền huấn luyện bằng dữ liệu đa phương thức 30T Token.Zhìpǔ cho biết, để thu thập phản hồi rộng rãi và chuyên nghiệp từ người dùng, trước khi phát hành chính thức, mô hình ẩn danh Ox-Alpha (cộng đồng Trung Quốc gọi là Niu Lai) đã được thử nghiệm quy mô lớn trên OpenCode và OpenRouter. Ox-Alpha nhanh chóng trở thành mô hình phổ biến nhất trong tuần, thiết lập kỷ lục mới về lượng truy cập trên cả hai nền tảng, và tất cả lưu lượng yêu cầu này đều được hỗ trợ bởi sức mạnh tính toán từ chip nội địa.Trước đó, cộng đồng đã thực hiện bài kiểm tra mẫu nhỏ DeepSWE của Ox Alpha đạt đến 80%, nhưng chỉ có 10 câu hỏi. Sau khi mở rộng mẫu, điểm số đã giảm xuống khoảng 63%, và người thử nghiệm cũng đã chủ động sửa lại tuyên bố ban đầu. Điểm số này vẫn thuộc về nhóm đầu tiên, nhưng không còn ấn tượng như 80% ban đầu. Sau khi mã nguồn được mở, các nhà phát triển có thể trực tiếp sử dụng các khung như vLLM, SGLang, KTransformers để triển khai mà không cần phải sử dụng API của mô hình ẩn danh.

Mô hình flagship GLM-5.2 chính thức ra mắt trên nền tảng B.AI, API và Web Chat hiện đã hoàn toàn mở cửa

Tin tức từ ChainCatcher, mô hình flagship GLM-5.2 của Web Chat chính thức ra mắt trên nền tảng B.AI, sau khi API được mở trước vào ngày 18 tháng 6, đến nay dịch vụ đa nền tảng đã hoàn toàn được mở.Là một tác phẩm đại diện cho thế hệ trọng số mã nguồn mở mới, mô hình này sở hữu cửa sổ ngữ cảnh siêu dài 1M hàng đầu trong ngành, được thiết kế đặc biệt cho các tình huống hiệu suất cao như phát triển mã quy mô lớn, suy diễn phức tạp và nhiệm vụ của các tác nhân thông minh, đồng thời cân bằng giữa hiệu suất tiên tiến và khả năng thực thi ổn định. Người dùng hiện có thể linh hoạt truy cập thông qua kênh API tiêu chuẩn chính thức và mô hình ưu đãi từ nhiều nhà cung cấp, cũng có thể sử dụng trực tiếp giao diện web để trò chuyện, thực hiện quy trình làm việc liền mạch trong mọi tình huống.B.AI, với tư cách là nền tảng dịch vụ mô hình AI một cửa hàng đầu, luôn cam kết cung cấp cho các nhà phát triển và doanh nghiệp trải nghiệm triển khai và gọi mô hình hiệu quả, an toàn và dễ sử dụng. Việc tiếp cận toàn diện GLM-5.2 lần này sẽ làm phong phú thêm hệ sinh thái của nền tảng, trao quyền cho các ứng dụng thông minh khác nhau.
2026-06-20
app_icon
ChainCatcher Building the Web3 world with innovations.