A SK Hynix investiu na Etched, uma startup americana de inferência de IA que está construindo sistemas em escala de rack com tecnologias proprietárias de Baixa Tensão de Inferência (LVI) e Memória em Escala de Cluster (CSM).
A Etched resolve um gargalo crítico da indústria: as GPUs tradicionais oferecem poder de computação excessivo, mas memória insuficiente para inferência de IA em larga escala, levando a frameworks de cache KV de vários níveis complexos. Seus chips de inferência personalizados reduzem o consumo de energia e superam as GPUs convencionais em HBM em largura de banda e capacidade de memória, mitigando a latência e a complexidade de design relacionadas ao cache KV.
Este investimento ocorre após a startup israelense Majestic Labs sair do modo stealth, com a empresa também construindo servidores de inferência com processadores personalizados e pools de memória compartilhada em larga escala.
Fundada em 2023 em San Jose por três estudantes de graduação de Harvard que abandonaram os estudos, a equipe principal da Etched é composta pelo CEO Gavin Uberti, pelo Presidente Robert Wachen e por Chris Zhu. A equipe obteve uma bolsa Thiel de US$ 250.000 por dois anos para impulsionar seu desenvolvimento inicial.
A equipe construiu processamento de pré-preenchimento LVI personalizado e memória compartilhada CSM para aumentar a eficiência da inferência. Sua solução full-stack, integrando chips internos, empacotamento, PCBs e módulos de interconexão, permite a implantação comercial de inferência em larga escala.
Zhu apontou que os chips de IA convencionais sofrem com severo estrangulamento térmico sob alta carga: o consumo de energia elevado reduz as velocidades de clock, cortando a taxa de transferência de inferência real para menos da metade do pico teórico. Os chips da Etched executam unidades aritméticas com metade da voltagem típica da indústria, aumentando significativamente a densidade de computação.
Ele também abordou as principais compensações de hardware: chips de IA equipados com HBM ficam atrás do SRAM em velocidade de decodificação devido a limites de memória e interconexão, enquanto chips puramente SRAM comprometem a densidade de computação e a capacidade para acesso mais rápido, reduzindo a taxa de transferência geral.
Isso prejudica a operação de grandes modelos MoE, pois a transmissão de tokens entre camadas em várias camadas de memória acumula latência. A arquitetura da Etched remove camadas de memória redundantes para resolver o problema.
A arquitetura CSM da Etched cria um pool de memória compartilhada unificado de baixa latência para hardware escalável, aproveitando interconexões proprietárias de alta velocidade para acelerar o acesso à memória entre chips.
Seu design híbrido HBM/SRAM equilibra a capacidade de memória e a latência entre chips, oferecendo inferência interativa de alta taxa de transferência. O CSM evita as falhas de custo, estabilidade, térmicas e de desempenho das soluções puramente SRAM, 3D DRAM e de chips ópticos.
Essa inovação desacopla os stacks HBM das restrições arquitetônicas da GPU, consolida recursos de memória dispersos e oferece velocidade de acesso em nível de SRAM por meio de tecnologia de interconexão avançada.
O sistema de rack da Etched apresenta um layout de alta interconexão, com 16 cabos dedicados conectando as portas traseiras a oito unidades de hardware principais.
O sistema suporta LLMs convencionais, modelos MoE e arquiteturas não-transformer como Mamba, com a empresa focando em P&D de sistema completo e vendas comerciais.
Histórico de Financiamento da Etched
2022 – Empresa fundada
2023 – Rodada seed de US$ 5,4 milhões
2024 – Série A de US$ 120 milhões
2025 – Série B de US$ 500 milhões
2026 – Série C de US$ 300 milhões
Financiamento total até o momento: US$ 925,4 milhões
A Sequoia Capital liderou a rodada Série C da Etched em 2026, com participação da Andreessen Horowitz, Jane Street e SK Hynix. A rodada avalia a empresa em US$ 10,3 bilhões, o dobro de sua avaliação na Série B de 2024.
Seu ritmo consistente de captação anual de recursos espelha a iteração contínua do produto, apoiada por forte demanda dos clientes e sólida confiança dos investidores.
Wachen disse que o novo capital acelerará a produção em massa de clusters de inferência. A empresa abriu um site de produção de 10 MW em Milpitas para aumentar a eficiência de prototipagem e fabricação.
O Arquiteto Chefe Saptadeep Pal revelou que a Etched tem mais de 400 funcionários com pedidos de clientes reservados excedendo US$ 1 bilhão. Sua base de P&D e fabricação em Taiwan permite operação 24 horas, otimizando a cooperação com fornecedores e testes de produtos para suportar escalonamento rápido.
Seus clientes principais abrangem grandes empresas, provedores de nuvem emergentes e hyperscalers globais que oferecem soluções de inferência como serviço.
Comentário
Se os novos racks de inferência da Etched e da Majestic Labs forem além do cache KV tradicional, eles reformularão o mercado de armazenamento corporativo. Esses sistemas exigem armazenamento de alta velocidade e baixa latência, criando oportunidades de colaboração para fornecedores como Dell, HPE, NetApp e VAST Data para emparelhar arrays de armazenamento com servidores de inferência de próxima geração para desempenho ideal.
Beijing Qianxing Jietong Technology Co., Ltd.
Sandy Yang/Diretor de Estratégia Global
WhatsApp / WeChat: +86 13426366826
E-mail: yangyd@qianxingdata.com
Website: www.qianxingdata.com/www.storagesserver.com
Foco de Negócios:
Distribuição de Produtos de TIC/Integração de Sistemas e Serviços/Soluções de Infraestrutura
Com mais de 20 anos de experiência em distribuição de TI, fazemos parceria com as principais marcas globais para entregar produtos confiáveis e serviços profissionais.
“Usando a Tecnologia para Construir um Mundo Inteligente”Seu Provedor de Serviços de Produtos de TIC Confiável!