Прекратите добавлять больше GP... Заметка
VentureBeat на русском

Прекратите добавлять больше GPU: новая платформа хранения Weka снижает нагрузку, кэшируя 100% предварительно рассчитанных токенов модели ИИ

Память GPU — самый дорогой и быстро расходуемый ресурс в производстве ИИ. Длинные контекстные окна и многооборотные диалоги приводят к неэффективному пересчету ранее обработанной информации. Weka, с ее платформой NeuralMesh 6 и оборудованием Wekapod 3, стремится расширить память GPU, используя доступное флэш-хранилище. Их Augmented Memory Grid объединяет NAND-флэш для имитации памяти GPU при более низкой стоимости. Это новшество выходит на конкурентный рынок, где такие признанные игроки, как Dell и NetApp, также фокусируются на инфраструктуре ИИ. Weka подчеркивает свой ИИ-ориентированный дизайн, удовлетворяя потребности клиентов в немедленной доступности вычислений. Основное преимущество заключается в улучшении использования GPU, снижении затрат на инференс и ускорении развертывания ИИ-нагрузок. Эта технология особенно ценна для крупномасштабных ИИ-операций и тех, кто испытывает быстрый рост. Ключевые особенности NeuralMesh 6 включают компонуемую и виртуальную мультиарендность для эффективного совместного использования ресурсов. Она также предлагает унифицированное файловое и объектное хранилище, устраняя дублирование данных. Репликация с приоритетом метаданных ускоряет доступность данных в целевых средах. Augmented Memory Grid специально решает проблему неэффективного использования вычислительных ресурсов путем кэширования предварительно рассчитанных токенов, предотвращая избыточную обработку в расширенных диалогах. Этот подход позволяет использовать значительно больший объем NAND-хранилища, чем традиционная память GPU, обеспечивая полное кэширование предварительно рассчитанных токенов.