Marvell представила архитектуру "разделения памяти" для AI, которая решит узкое место пропускной способности вывода Agentic AI
Сообщение от ChainCatcher, согласно официальным данным, Marvell Technology объявила о запуске нового поколения решений по памяти для инфраструктуры AI, охватывающих серверный уровень AI-хранения, расширение и пуллинг памяти уровня стойки CXL, а также совместно используемую память с оптическим соединением между несколькими стойками, направленных на решение растущих узких мест по объему памяти и пропускной способности в процессе вывода AI Agentic.Marvell заявила, что с увеличением масштаба моделей AI, продлением контекстного окна и ростом потребности в KV Cache традиционная архитектура, тесно связанная с вычислениями и памятью, ограничивает эффективность вывода AI. Через разъединение памяти (memory disaggregation) можно сделать ресурсы памяти более независимыми от ресурсов вычислений, повысить коэффициент использования GPU и снизить задержку передачи данных. Выпущенные продукты включают:Контроллер SSD Bravera SC6 PCIe 6.0: предназначен для сценариев хранения вывода AI, может помочь облачным провайдерам перенести больше KV Cache на высокопроизводительные SSD, повысив эффективность инфраструктуры. Этот продукт использует архитектуру, совместимую с NAND от нескольких поставщиков, и ожидается, что образцы начнут поставляться в четвертом квартале 2026 года.Решение по расширению памяти Marvell Structera X: основано на технологии CXL, поддерживает расширение памяти уровня стойки и пуллинг ресурсов, помогает центрам обработки данных более гибко делиться и распределять ресурсы памяти, снижая затраты на инфраструктуру AI.Решение по оптическому соединению памяти Marvell Photonic Fabric: строит архитектуру совместно используемой памяти через оптические соединения между несколькими стойками, может поддерживать выгрузку до 32TB теплого KV Cache и помогает кластерам вывода AI повысить пропускную способность.Marvell заявила, что решение Photonic Fabric может обеспечить увеличение пропускной способности Token на 2-3 раза при существующих ограничениях по пространству и потреблению энергии в центрах обработки данных, поддерживая более крупные модели и более длинные контекстные AI-приложения.Исполнительный директор Marvell Уилл Чу заявил, что инфраструктура AI переходит от архитектуры единственного сервера к системам, в которых вычисления, память и соединения работают совместно, и в будущем память должна расширяться более независимо, чтобы повысить коэффициент использования ресурсов и эффективность Token.С ростом потребностей в выводе AI Agent и больших моделей, объем памяти, пропускная способность и эффективность передачи данных становятся новым фокусом конкуренции в инфраструктуре AI после вычислительной мощности.