BTC $84,340.36 +1.29%
ETH $2,740.95 +2.46%
BNB $766.28 -0.20%
XRP $1.55 +2.47%
SOL $120.68 +0.79%
TRX $0.3353 +0.20%
DOGE $0.0960 +1.93%
ADA $0.2528 +0.51%
BCH $312.94 -0.16%
LINK $15.30 +4.77%
HYPE $88.38 -1.94%
AAVE $172.96 +15.37%
SUI $1.17 -0.68%
XLM $0.2327 +1.79%
ZEC $1,438.10 -9.35%
AAPL $337.04 -0.91%
AMZN $246.92 -0.32%
GOOGL $342.67 +0.42%
MSFT $508.74 -0.44%
META $723.88 -3.09%
NVDA $230.46 +0.57%
TSLA $359.17 -3.15%
SNDK $1,723.70 -0.77%
INTC $116.69 -3.32%
SPCX $146.90 -1.73%
MU $1,067.32 -0.45%
AMD $613.90 -1.91%
BTC $84,340.36 +1.29%
ETH $2,740.95 +2.46%
BNB $766.28 -0.20%
XRP $1.55 +2.47%
SOL $120.68 +0.79%
TRX $0.3353 +0.20%
DOGE $0.0960 +1.93%
ADA $0.2528 +0.51%
BCH $312.94 -0.16%
LINK $15.30 +4.77%
HYPE $88.38 -1.94%
AAVE $172.96 +15.37%
SUI $1.17 -0.68%
XLM $0.2327 +1.79%
ZEC $1,438.10 -9.35%
AAPL $337.04 -0.91%
AMZN $246.92 -0.32%
GOOGL $342.67 +0.42%
MSFT $508.74 -0.44%
META $723.88 -3.09%
NVDA $230.46 +0.57%
TSLA $359.17 -3.15%
SNDK $1,723.70 -0.77%
INTC $116.69 -3.32%
SPCX $146.90 -1.73%
MU $1,067.32 -0.45%
AMD $613.90 -1.91%

glm-5

すべて
記事
速報

first_img 智谱はGLM-5.3 Flashを発表しました。10万枚の国産チップが推論サービスを提供し、DeepSeek V4 Flashに対抗しています。

智谱は軽量級フラッグシップモデル GLM-5.3 Flash を発表しました。これは DeepSeek V4 Flash に対抗することを目的としており、10 万枚以上の国産チップクラスターを利用して推論サービスを提供します。このモデルのパラメータ規模は約 300B で、GLM-5.3 の約 40% に相当し、DeepSeek V4 Flash とほぼ同等です。MoE アーキテクチャを採用しており、実際に活性化されるパラメータは約 18B で、ネイティブなマルチモーダル能力を備え、画像と動画の入力をサポートしています。また、智谱がコーディング戦略に焦点を当てた後、初めてマルチモーダル能力を持つ新しいモデルです。総合評価スコアは前世代フラッグシップ GLM-5.2 を上回り、Claude Opus 4.8 と同等で、DeepSeek V4 Pro 正式版の関連スコアを上回っています。価格は、入力 1 百万トークンあたり 0.8 元、出力 2.8 元、キャッシュヒット 0.23 元で、GLM-5.3 の約十分の一となっており、オンライン開始前の2週間は半額の特典が提供されます。このモデルは、国産の計算能力に完全に適応しており、オンラインのトラフィックは国産チップによって処理されます。智谱は、クラスターのハードウェア効率と単位トークンコストが主流のNVIDIA GPUと同等のレベルに達していると述べています。このモデルは以前、コードネーム Ox Alpha として海外プラットフォームで匿名テストされていました。

智谱が「牛来」モデル GLM-5.3-Flashをオンラインで公開し、オープンソース化しました。

智谱公式は GLM-5.3-Flash のオンラインおよびオープンソース化を発表しました。これは GLM-5 シリーズの最初のネイティブマルチモーダルモデルです。報告によると、GLM-5.3-Flash の全体的な性能は GLM-5.2 を上回り、プログラミングとエージェントの評価は Claude Opus 4.8 に近づいていますが、価格は GLM-5.2 の十分の一です。また、新しい基盤モデルに切り替え、GLM メインシリーズで初めてスパースアテンションと線形アテンションの混合アーキテクチャを導入し、30T トークンのマルチモーダルデータで事前トレーニングを行いました。智谱は、広範で専門的なフィードバックを収集するために、正式なリリース前に匿名モデル Ox-Alpha(中国のコミュニティでは牛来と呼ばれています)を OpenCode と OpenRouter で大規模テストを実施しました。Ox-Alpha は瞬く間にその週で最も人気のあるモデルとなり、両プラットフォームでの呼び出し量の新記録を樹立しましたが、これらのリクエストトラフィックはすべて国産チップによって提供された計算力によるものです。以前、コミュニティは Ox Alpha の DeepSWE 小サンプルテストで一時的に 80% の結果を出しましたが、それは 10 問だけでした。サンプルを拡大した後、成績は約 63% に戻り、テスターも最初の発言を自主的に訂正しました。この成績は依然として第一梯隊に属していますが、最初の 80% ほど誇張されたものではありません。重みがオープンソース化された後、開発者は vLLM、SGLang、KTransformers などのフレームワークを使用して直接デプロイでき、匿名モデルの API を通じて行う必要はありません。

GLM-5.2 フラッグシップモデルが B.AI プラットフォームに正式に登場し、API と Web チャットが全面的にオープンしました。

GLM-5.2 旗艦モデル Web Chat 端が正式に B.AI プラットフォームに登場し、6 月 18 日に API が先行して開放された後、これで両端のサービスがすべて開放されました。新世代のオープンソースの重みを代表するこのモデルは、業界をリードする 1M の超長文コンテキストウィンドウを備えており、大規模なコード開発、複雑な推論、インテリジェントタスクなどの高性能シーンのために設計されています。最先端の性能と安定した実行能力を兼ね備えています。ユーザーは現在、公式 API 標準チャネルと複数のサービスプロバイダーの割引モデルを通じて柔軟に接続でき、ウェブ端での対話を直接使用することも可能で、全シーンのワークフローがシームレスに接続されます。B.AI は、先進的なワンストップ AI モデルサービスプラットフォームとして、常に開発者と企業に効率的、安全、使いやすいモデルの展開と呼び出し体験を提供することに尽力しています。今回の GLM-5.2 の全面的な接続は、プラットフォームのエコシステムをさらに豊かにし、さまざまなインテリジェントなアプリケーションの実現を支援します。
2026-06-20
app_icon
ChainCatcher Building the Web3 world with innovations.