A WEKA lançou o array all-flash WEKAPod em escala exabyte, otimizado para seu software NeuralMesh de sexta geração. A nova plataforma oferece um fluxo de dados massivo para impulsionar cargas de trabalho de treinamento e inferência de IA em nível de produção. Ela posiciona a WEKA ao lado de fornecedores de armazenamento de IA premium, incluindo DDN, Everpure, NetApp e VAST Data, apresentando uma densidade líder de mercado de 1,1 exabytes de capacidade efetiva em um único rack de 56 RU.

O NeuralMesh v6 integra multilocação nativa em escala de hiperescala, uma pilha unificada de arquivos e objetos S3 baseada em NVMe, mobilidade inteligente de dados com replicação e cache remoto, redução de dados sempre ativa com desempenho garantido, fluxos de trabalho nativos do Kubernetes e observabilidade unificada. Em hardware Oracle Cloud Infrastructure (OCI) H100, sua Augmented Memory Grid oferece 10x mais throughput de tokens, 10x mais usuários simultâneos e 7x mais saída de tokens por GPU do que o NVIDIA CMX em produção. Para implantações CoreWeave, ele aumenta o throughput de tokens por GPU em 4,2x e reduz a latência TTFT em até 6x em comparação com o CMX.
O cofundador e CEO da WEKA, Liran Zvibel, comentou em julho de 2026: “A infraestrutura de IA legada construída para cargas de trabalho tradicionais não pode suportar as operações modernas da era da inferência. A lucratividade da IA hoje depende da eficiência do espaço em rack, consumo de energia, estabilidade da cadeia de suprimentos e densidade operacional.
“O WEKAPod foi projetado especificamente para se adequar a essas restrições. Projetado exclusivamente para computação da era da inferência com uma cadeia de suprimentos autogerenciada, ele oferece vantagens de custo inicial e TCO superior para necessidades de infraestrutura de IA de pilha completa, estabelecendo um novo padrão para avaliação de infraestrutura de IA de produção em larga escala.”
O WEKAPod é um appliance de armazenamento dedicado que alimenta dados para clusters de GPU, como os SuperPODs da NVIDIA, integrando hardware pré-configurado e o software de plataforma de dados da WEKA. Lançada pela primeira vez no final de 2025 com os modelos PCIe Gen4 Prime e Gen5 Nitro com SSDs em camadas AlloyFlash, a linha atualizada de terceira geração adiciona Nitro, Prime e novas configurações Prime Max baseadas em 2RU, adaptadas para inferência de IA em produção.
O Prime Max é o modelo de maior capacidade da WEKA, excedendo 1 EB por rack. O Prime oferece preço-performance equilibrado por meio de quatro servidores de rack 2U com 70 drives NVMe mistos QLC/TLC gerenciados pelo AlloyFlash. O Nitro visa fábricas de IA de alto desempenho e ambientes de GPU-como-serviço com centenas a milhares de GPUs ativas.
O WEKAPod de terceira geração é o primeiro sistema de rack único da indústria a superar a capacidade efetiva em escala exabyte. Ele contém 441,5 PB de armazenamento NVMe bruto para entregar 1,1 EB de capacidade efetiva via redução de dados NeuralMesh, juntamente com 10,2 TB/s de throughput por rack e 210 milhões de IOPS em nível de rack.
Sua pilha de hardware atualizada inclui fabric interno PCIe Gen6, interconexões de drive baseadas em cabos sem backplane, SuperNICs NVIDIA ConnectX com conectividade Ethernet Spectrum-X e gerenciamento térmico definido por software. A plataforma minimiza a pegada do data center, otimiza a utilização do espaço em rack e melhora a eficiência de tokens por watt sem comprometer o throughput ou o desempenho da carga de trabalho. A WEKA afirma que supera as soluções concorrentes em 267% em densidade de capacidade efetiva e 114% em densidade de throughput por unidade de rack.
Ao gerenciar diretamente o fornecimento de componentes sem depender de canais OEM, a WEKA oferece a provedores de nuvem de IA e empresas preços estáveis e prazos de entrega previsíveis para implantações de infraestrutura em larga escala. Todas as unidades WEKAPod são enviadas pré-configuradas de fábrica e pré-validadas com todas as capacidades do NeuralMesh v6, incluindo Augmented Memory Grid, eliminando a necessidade de equipes de armazenamento dedicadas no local.
O NeuralMesh v6, o sistema de arquivos paralelo da WEKA, utiliza a Augmented Memory Grid para estender a memória da GPU para cargas de trabalho de inferência. Ele externaliza o armazenamento como um cache KV de baixa latência (nível de microssegundo) com largura de banda multi-TB/s, fornecendo espaço de endereço estendido em escala de petabyte para modelos de IA.
As principais capacidades do NeuralMesh 6 incluem:
Clusters Componíveis: Oferece isolamento total de hardware com CPU, memória e armazenamento dedicados para tenants âncora, garantindo alocação de recursos garantida, separação estrita de cargas de trabalho e desempenho consistente sob cargas pesadas.
Multilocação Virtual: Oferece isolamento de nível VPC via Virtualized RDMA Data Fabric (VRDF), suportando VLANs privadas, espaços de IP sobrepostos, QoS por tenant, criptografia KMS independente e autenticação LDAP/AD. Ele escala para mais de 1.000 tenants lógicos isolados por cluster com provisionamento de novos tenants em menos de 30 minutos.
Drives NVMe físicos compartilhados entre múltiplos clusters NeuralMesh maximizam o paralelismo de dispositivos para inferência multi-tenant. Um único cluster de hardware suportando 50 Clusters Componíveis pode hospedar até 50.000 tenants lógicos isolados. Ele unifica o acesso a arquivos S3 e POSIX sob um único namespace, permitindo transferências de dados S3-over-RDMA sem cópia diretamente para a memória da GPU com 2.000 a 5.000 conexões de nó simultâneas — aproximadamente cinco vezes a concorrência S3 convencional.
Sua tecnologia AlloyFlash unifica de forma transparente flash NVMe QLC de baixo custo e TLC de alto desempenho em um único cluster, roteando cargas de trabalho sensíveis à latência para TLC e tarefas de capacidade em massa para QLC com um custo por TB 30-40% menor.
A redução de dados sempre ativa combina fingerprinting, hashing de similaridade, deduplicação e compressão com menos de 5% de sobrecarga de gravação, entregando até 6x de economia de capacidade para dados de treinamento de IA. A WEKA fornece garantias contratuais para taxas de redução e impacto no desempenho, com análise de carga de trabalho pré-vendas para prever a eficiência do mundo real.
Todos os processos de redução de dados são executados fora do caminho crítico de gravação por meio de compressão de similaridade em segundo plano e deduplicação entre sistemas de arquivos, permitindo gravações na velocidade nativa do NVMe, independentemente do uso da capacidade ou da carga em segundo plano. Isso evita a degradação do desempenho de gravação comum em arquiteturas de redução inline durante o treinamento de IA com muitas verificações, espelhando o design da zona de pouso sem deduplicação do ExaGrid para desempenho consistente.
O NeuralMesh v6 suporta capacidades completas de federação e namespace global. Sua replicação assíncrona permite mobilidade de dados de IA, cloudbursting e colaboração multi-site, com replicação de metadados prioritária para navegação instantânea no ambiente de destino e hidratação de dados sob demanda. Isso reduz o consumo de largura de banda WAN por meio de dados comprimidos replicados.
Um operador Kubernetes dedicado automatiza a implantação e o gerenciamento do ciclo de vida do cluster para nuvens de IA e laboratórios de pesquisa baseados em Kubernetes. A plataforma Observe unificada baseada em SaaS oferece painéis multi-cluster, diagnósticos em nível de cliente, alertas inteligentes configuráveis e roteamento integrado para Slack, PagerDuty ou e-mail com links diretos para o painel.
O Chief Product Officer da WEKA, Ajay Singh, declarou: “Os operadores de IA de produção de hoje dependem de pilhas de terceiros desconexas e adaptadas com camadas de arquivo/objeto isoladas, movimentação manual de dados e multilocação adicionada. O NeuralMesh 6 resolve esses problemas com uma plataforma unificada que converge armazenamento de arquivos de alto desempenho e objetos de alta capacidade em hardware compartilhado, com multilocação nativa, mobilidade inteligente de dados e eficiência de dados integrada. Ele foi projetado especificamente para cargas de trabalho de inferência de produção, não adaptado para elas.”
O NeuralMesh 6 estará disponível em geral no H2 2026, com atualizações gratuitas e contínuas disponíveis para todos os clientes WEKA existentes por meio de canais de atualização padrão.
Beijing Qianxing Jietong Technology Co., Ltd.
Sandy Yang/Diretor de Estratégia Global
WhatsApp / WeChat: +86 13426366826
E-mail: yangyd@qianxingdata.com
Website: www.qianxingdata.com/www.storagesserver.com
Foco de Negócios:
Distribuição de Produtos de TIC/Integração de Sistemas e Serviços/Soluções de Infraestrutura
Com mais de 20 anos de experiência em distribuição de TI, fazemos parceria com as principais marcas globais para fornecer produtos confiáveis e serviços profissionais.
“Usando a Tecnologia para Construir um Mundo Inteligente”Seu Provedor Confiável de Serviços de Produtos de TIC!