BTC $79,365.72 -0.70%
ETH $2,488.46 -0.46%
BNB $743.15 -1.96%
XRP $1.40 -1.52%
SOL $104.87 -1.64%
TRX $0.3367 +0.74%
DOGE $0.0893 -0.78%
ADA $0.2182 -0.45%
BCH $255.61 -1.85%
LINK $13.29 +8.31%
HYPE $87.35 -0.46%
AAVE $133.54 -0.59%
SUI $0.8090 +1.44%
XLM $0.1901 +2.14%
ZEC $1,190.39 +0.57%
BTC $79,365.72 -0.70%
ETH $2,488.46 -0.46%
BNB $743.15 -1.96%
XRP $1.40 -1.52%
SOL $104.87 -1.64%
TRX $0.3367 +0.74%
DOGE $0.0893 -0.78%
ADA $0.2182 -0.45%
BCH $255.61 -1.85%
LINK $13.29 +8.31%
HYPE $87.35 -0.46%
AAVE $133.54 -0.59%
SUI $0.8090 +1.44%
XLM $0.1901 +2.14%
ZEC $1,190.39 +0.57%

groq

Tất cả
Bài viết
Tin nhanh

first_img NVIDIA thông báo rằng khung Groq đã bắt đầu sản xuất hàng loạt và sẽ được triển khai tại Nebius

Tin tức từ ChainCatcher, Giám đốc cao cấp của NVIDIA, Dion Harris, đã thông báo vào thứ Hai theo giờ địa phương rằng giá đỡ Groq 3 LPX đã bước vào giai đoạn sản xuất hàng loạt và sẽ được triển khai tại trung tâm dữ liệu của nhà cung cấp dịch vụ đám mây mới Nebius, dự kiến sẽ ra mắt vào cuối năm nay. Động thái này đánh dấu việc công nghệ mà NVIDIA đạt được thông qua thỏa thuận cấp phép công nghệ trị giá khoảng 20 tỷ USD với Groq vào tháng 12 năm ngoái chính thức được thương mại hóa, nhiều nhân viên cốt lõi của Groq đã gia nhập NVIDIA, và người sáng lập Jonathan Ross đảm nhận vị trí Kiến trúc sư phần mềm chính của NVIDIA.NVIDIA đang tăng tốc sản xuất chip Groq và cung cấp sản phẩm cho khách hàng, nhấn mạnh tầm quan trọng của suy luận độ trễ thấp. Groq 3 LPX được phát hành vào tháng 3 năm nay là bộ tăng tốc suy luận cho nền tảng Vera Rubin, với kiến trúc tích hợp 500 megabyte SRAM tốc độ cao trên chip để giảm thiểu nút thắt bộ nhớ. Mỗi giá đỡ LPX có thể tích hợp 256 chip Groq 3, NVIDIA dẫn chứng từ các bài kiểm tra cho biết có thể xử lý 3400 token mỗi giây; chip này được sản xuất bởi Samsung.Harris cho biết, chip độ trễ thấp không phải là để thay thế GPU, mà là sử dụng bộ xử lý phù hợp cho các giai đoạn khác nhau của khối lượng công việc, các nhà cung cấp dịch vụ đám mây có thể cung cấp gói dịch vụ cao cấp hơn cho người dùng nhạy cảm với độ trễ. CEO NVIDIA, Huang Renxun, dự định phân bổ khoảng một phần tư không gian trung tâm dữ liệu cho các ứng dụng lập trình cho chip Groq, phần còn lại sẽ sử dụng hệ thống Vera Rubin, và dự kiến đến năm 2027, doanh thu tích lũy của Blackwell và Vera Rubin sẽ đạt 1 nghìn tỷ USD.

NVIDIA: SpaceXAI sẽ triển khai Vera CPU để tăng tốc AI theo kiểu proxy và mở rộng nền tảng Vera Rubin đến tính toán trên vệ tinh

Tin tức từ ChainCatcher, NVIDIA chính thức thông báo rằng SpaceXAI sẽ triển khai CPU Vera của NVIDIA để tăng tốc ứng dụng AI đại lý thế hệ tiếp theo. Vera là CPU đầu tiên được xây dựng đặc biệt cho AI đại lý, sở hữu 88 lõi Olympus do NVIDIA tự phát triển, sử dụng công nghệ đa luồng không gian và bộ nhớ LPDDR5X băng thông cao, với băng thông đạt 1.2TB/s, trong các tình huống như AI đại lý, học tăng cường và xử lý dữ liệu, tốc độ hoàn thành nhiệm vụ có thể tăng lên tới 1.8 lần so với CPU x86.Chủ tịch SpaceXAI, Mike Nicolls, cho biết hiệu suất CPU và băng thông bộ nhớ của Vera đủ để hỗ trợ lập kế hoạch nhiệm vụ quy mô lớn, thực thi mã và xử lý dữ liệu, giúp GPU hoạt động hiệu quả nhất, từ đó thu được nhiều sản lượng hiệu quả hơn từ mỗi watt tính toán.SpaceXAI cũng có kế hoạch mở rộng cơ sở hạ tầng AI đứng sau Grok dựa trên nền tảng NVIDIA Vera Rubin, tiến tới khả năng tính toán cấp gigawatt. Vera Rubin tích hợp tính toán tăng tốc của NVIDIA, kết nối NVLink, mạng Spectrum-X và công nghệ xử lý dữ liệu BlueField, với mục tiêu giảm chi phí mỗi token và nâng cao hiệu suất năng lượng tổng thể của nhà máy AI.Điều đáng chú ý hơn nữa là SpaceXAI sẽ đưa hệ thống Vera Rubin NVL72 phiên bản tối ưu lên không gian, với vệ tinh AI Starmind thế hệ đầu tiên sẽ sử dụng kiến trúc giá đỡ này, trở thành triển khai biểu tượng đầu tiên của tính toán tăng tốc NVIDIA mở rộng từ trung tâm dữ liệu mặt đất ra không gian.
app_icon
ChainCatcher Building the Web3 world with innovations.