BTC $85,046.81 +1.52%
ETH $2,706.34 +1.20%
BNB $770.78 +0.44%
XRP $1.51 +1.07%
SOL $118.96 +0.42%
TRX $0.3356 -0.56%
DOGE $0.0952 +1.57%
ADA $0.2504 +2.90%
BCH $307.77 +0.30%
LINK $14.46 +0.93%
HYPE $88.40 -0.96%
AAVE $169.41 +6.96%
SUI $1.18 +1.98%
XLM $0.2213 -1.65%
ZEC $1,358.02 -4.56%
AAPL $329.78 -2.03%
AMZN $249.51 -0.41%
GOOGL $338.78 -2.95%
MSFT $516.29 -0.35%
META $727.32 -0.92%
NVDA $231.92 +0.54%
TSLA $357.39 +1.45%
SNDK $1,776.59 +1.91%
INTC $120.83 +1.16%
SPCX $149.51 -1.10%
MU $1,080.85 +1.24%
AMD $618.08 +1.37%
BTC $85,046.81 +1.52%
ETH $2,706.34 +1.20%
BNB $770.78 +0.44%
XRP $1.51 +1.07%
SOL $118.96 +0.42%
TRX $0.3356 -0.56%
DOGE $0.0952 +1.57%
ADA $0.2504 +2.90%
BCH $307.77 +0.30%
LINK $14.46 +0.93%
HYPE $88.40 -0.96%
AAVE $169.41 +6.96%
SUI $1.18 +1.98%
XLM $0.2213 -1.65%
ZEC $1,358.02 -4.56%
AAPL $329.78 -2.03%
AMZN $249.51 -0.41%
GOOGL $338.78 -2.95%
MSFT $516.29 -0.35%
META $727.32 -0.92%
NVDA $231.92 +0.54%
TSLA $357.39 +1.45%
SNDK $1,776.59 +1.91%
INTC $120.83 +1.16%
SPCX $149.51 -1.10%
MU $1,080.85 +1.24%
AMD $618.08 +1.37%

gpu

すべて
記事
速報

エヌビディアはAIにKimiの注意力コアを再構築させ、速度は公式版の約3倍に達しました。

NVIDIA の研究チームは、AI エージェントが Kimi Delta Attention の GPU カーネルを直接書き換えました。Kimi Delta Attention は月の暗い面 Kimi-Linear モデルで使用されるコア注意メカニズムの一つであり、このような低レベルのコードは過去において、CUDA やチップアーキテクチャに精通したエンジニアが繰り返し手動で最適化する必要がありました。エージェントが書いたバージョンは、NVIDIA B300 で月の暗い面公式 FlashKDA の 2.96 倍の速度に達しました。チームは固定長と異なる可変長シーケンスの合計 6 グループのタスクをテストし、2.96 倍は全タスクの幾何平均値であり、関連するカーネルはすでにオープンソース化されています。その過程で、エージェントはテストの脆弱性を利用して、テストデータの統計的規則をコードに書き込み、3.74 倍を達成しました。最近の 32 個のトークンのみを保持した場合、単一の成績は 5.16 倍に達しました。これらのバージョンを実際の Kimi データに適用すると、誤算や無効になることがあります。チームはその後、実際の Kimi 実行データ、ランダム入力、極端な数値テストを追加し、誤差基準を厳しくし、最終的に保持された 2.96 倍のバージョンがこの検証を通過しました。

first_img 分析:部分 B300 の取引価格は毎時 24 米ドルを超えています。

X ユーザー gpugene が算力取引についての投稿で述べたところによると、一部の B300 の取引価格はすでに GPU あたり 1 時間 24 ドルを超えており、1 年未満の算力価格は 7 ドル以上で維持され、さらに上昇しているとのことです。gpugene は、算力デリバティブを利用して GPU 時間の価格上昇を防ぎつつ、レンタル期間の調整の余地を残したいと述べています。もし推論クラウドが固定価格でサービスを販売し、自身の GPU 請求が変動する場合、実際には算力価格リスクを負っていることになります。文中では、供給者が 2048 台の B300 を提供し、即日から 5 年間レンタルし、GPU あたり 1 時間 4.15 ドルのプランを例に挙げ、その金額は 372,264,960 ドルに相当するとしています。もし顧客が 12 か月後にサービスを開始し、13 か月目から 15 か月目にかけてその規模を使用した場合、合計で 4,485,120 GPU 時間になります。gpugene の試算によると、行使価格 4.50 ドルのコールオプションの現在のプレミアムは約 483 万ドルであり、これを複合オプションに変更すると、現在の支払いは約 270 万ドルで、12 か月目に行使する際に約 449 万ドルを再度支払うことになります。gpugene はまた、4000 条件の 5 年間の賃料と需要パスを比較しました。年ごとの更新の平均コストは 1 時間あたり 4.72 ドルで、最悪の 5% のシナリオでは平均 10.91 ドルです。コールオプションを追加すると、これらはそれぞれ 4.88 ドルと 7.20 ドルに変わり、プレミアムが含まれています。gpugene は、新興の算力デリバティブ市場が neocloud および関連する参加者の拡張と自己防衛の方法を変える可能性があると考えています。

メキシコ当局が山岳地帯での違法暗号通貨マイニング拠点を押収:水力発電所からの電力窃盗の疑い

ロイター通信によると、メキシコ当局はプエブラ州トラウラの偏遠な山岳地帯の建物内で違法な暗号通貨マイニング拠点を押収し、現場で300枚のGPU、80台の中圧端末、8台の衛星アンテナが発見されました。当局は、この拠点が近くの水力発電所から電力を盗んでいるかどうかを調査しています。これは昨年初め以来、この地域で発見された4番目の類似の暗号農場であり、昨年プエブラ北部の水力発電所近くでも他の3つが発見されています。地元住民は、機器の轟音が1キロメートル離れた場所でも聞こえると述べています。メキシコの安全分析家デビッド・サウセドは、麻薬密売組織が新たな洗練されたレベルに達しているようで、このような運営を確立するには技術的専門知識と資金力のあるグループの支援が必要だと述べています。Chainalysisのラテンアメリカ専門家カイオ・モッタは、このような拠点は通常、電気料金が非常に低いか、組織犯罪勢力の影響下にある場所に位置しており、電力を盗んで大規模なマイニングインフラを構築するためだと指摘しています。

first_img Liquid ComputeのCEOが算力価格のヘッジメカニズムを説明する

Liquid Compute の CEO Ronit Jain が算力価格のヘッジについて紹介しました。算力を購入したり、GPU を保有したり、またはそれを貸し出す者は、算力価格のエクスポージャーを負っています。ヘッジは、指数に対して将来の価格をロックする現金決済契約であり、GPU を移転する必要はありません。企業は、翌年の生産能力コストを予算項目として固定するために、フォワードを購入することができ、同時に任意のサプライヤーから調達することができます。Neocloud はフォワードを売却し、未契約の時間を固定現金流に変換することで、貸し手がそれに基づいて融資を行いやすくします。売却後のリース残価については、ウィンドウが取引可能な範囲に入ったときに最近のフォワードをロールオーバーするか、フォワードのプットオプションを購入することができ、流動性の高い近端をオプション料の支払いに使用できます。ヘッジでロックされるのは価格であり、数量ではなく、実際の料金とは完全に一致しない場合があり、無料ではありません:有利な価格変動を放棄するか、オプション料を支払う必要があります。法的な観点からは、通常、対抗者と ISDA マスター契約を締結し、決済指数の許可を取得し、ヘッジエクスポージャーの比率を決定する必要があります。

first_img パンテラのジュニアパートナー、Jay Yu:算力は商品資産になる可能性がある

Pantera Capital のジュニアパートナー Jay Yu は、記事『The Rise of Compute Markets』で、算力とデータセンターの支出が1兆ドル規模のカテゴリになったと述べていますが、GPU の調達は依然としてグループチャット、店頭ブローカー、双方向契約を通じて行われています。彼は、算力の金融化はまだ初期段階にあり、SKU、時間、場所に制約されているが、今後 5 年から 10 年の間に電力や石油のような商品資産になる可能性があると考えています。Jay Yu は、算力市場が電力の「電網-オペレーター-ノード」のような「ハードウェア-サプライヤー-クラスター」の構造を形成する可能性があると述べ、新しいクラウドプロバイダーは GPU の構造的なショートであり、オンデマンドプラットフォームとアプリケーション層はロングであるとしています。彼は、アプリケーション層が推論に 100 ドルを支出するごとに、約 45 ドルがオンデマンド層に、約 50 ドルが新しいクラウドまたは GPU 層に、約 5 ドルが OpenRouter などのルーティング層に流れると述べています。NVIDIA は算力の「中央銀行」と見なされ、最高 25% の残存価値サポートを提供することを発表しました。彼はまた、実物の引き渡しはより持続的な競争優位性を持ち、指数、現金決済取引所、融資ツールがその後登場するだろうと述べ、参加者には SF Compute、Vast AI、Runpod、Compute Exchange などが含まれます。算力市場には強制的な価格透明性の要件がなく、ベースリスクがより大きくなる可能性があります。

first_img AMDはAIの機会が2030年に2兆ドルに達すると述べ、データセンターは2027年に700億ドルに達すると予測しています。

AMDは2026年9月8日に花旗の2026年グローバルTMT会議で、人工知能関連の機会が2030年までに2兆ドルに達する可能性があると述べました。会社はデータセンター事業が2027年に倍増し、売上高は約700億ドルに達すると予想しており、そのうちAI GPUが約400億ドルを占め、残りはサーバーCPUからのものです。サーバーCPU市場は2030年までに2200億ドルに上方修正され、以前の予想は600億ドルでした。AMDは290億から300億ドルの調達コミットメントを得ており、台積電のすべての顧客の中で最大の生産能力配分の増加を得ましたが、依然としてウェーハ、HBMメモリ、高度なパッケージング、基板の供給が厳しい状況にあります。MI450は2026年第3四半期に量産出荷を開始し、第4四半期にはさらに増産される予定です。第3四半期の粗利益率のガイダンスは56%で、MI450の立ち上がりにより、2026年第4四半期および2027年の粗利益率は若干の低下が予想されています。最高財務責任者のJean Huは、AIの速度、規模、そして台頭は前例がないと述べました。AMDはMeta、OpenAI、Anthropicの3社を主要な顧客として発表し、いずれも多ギガワットの展開と多世代の協力に関与しています。Heliosはラックレベルでの増産を進めています。Taalasの買収を完了し、Cerebrasと協力してHeliosシステムとそのウェーハレベルエンジン技術を統合しています。サーバーCPUは2026年下半期に前年同期比で80%以上の成長が見込まれ、2027年には70%以上の成長が予想されています。企業サーバーの収益は2026年第2四半期に70%以上の成長を記録しました。

first_img 韓国はNVIDIAのVera Rubinラックの予算を1台あたり275億ウォンとしています。

Money Today の報道によると、韓国政府は来年、NVIDIA の次世代 AI チップ Vera Rubin の予算を1台のラックあたり275億ウォンに設定し、これは外国メディアの以前の予測を上回っています。科学情報通信部の来年の GPU サーバー拡張予算は3.85兆ウォンで、すべて140台の Vera Rubin NVL72 サーバーラックの購入に充てられます。各 NVL72 ラックには72個の Rubin GPU と36個の Vera CPU が搭載され、合計で10080枚の Rubin GPU を得ることができます。このバッチは、同部が2028年までに取得する5.2万枚の先進的な GPU とは独立しており、実際の供給量はNVIDIAの供給状況に応じて調整される可能性があります。1台のラックあたり275億ウォンは、明らかに外国メディアの予測を上回っています。アメリカの投資銀行バークシャーは6月の報告で、Vera Rubin NVL72 ラックのコストを910万ドル(約123億ウォン)と推定し、モルガン・スタンレーは約780万ドル(約105億ウォン)と推定しています。政府側は、予算がGPUの不足による価格上昇や関連施設のコストを考慮していると述べています。このバッチのチップは、汎用人工知能などの次世代の最前線モデルの開発に使用されます。副首相兼科学情報通信部長官の裴慶勲は6月に、Anthropic の超大規模モデル Mythos と同等のモデルを構築するには約1万枚の Vera Rubin が必要であり、今回の140台の規模はそれに相当すると述べました。
app_icon
ChainCatcher Building the Web3 world with innovations.