SK Hynix ha sostenuto Etched, una startup statunitense di inferenza AI che costruisce sistemi su scala rack con tecnologie proprietarie di inferenza a bassa tensione (LVI) e memoria a scala di cluster (CSM).
Etched risolve un collo di bottiglia critico del settore: le GPU tradizionali offrono una potenza di calcolo in eccesso ma una memoria insufficiente per l'inferenza AI su larga scala, portando a framework di cache KV a più livelli ingombranti.I suoi chip di inferenza su misura riducono l'utilizzo di energia e superano le GPU HBM convenzionali in larghezza di banda e capacità di memoria, attenuando la latenza e la complessità della progettazione correlate alla cache KV.
Questo investimento arriva dopo che la startup israeliana Majestic Labs ha abbandonato la modalità stealth, con la società che costruisce anche server di inferenza su misura con pool di memoria condivisa su larga scala.
Fondata nel 2023 a San Jose da tre studenti universitari di Harvard che hanno abbandonato la scuola, il core team di Etched è composto dal CEO Gavin Uberti, dal presidente Robert Wachen e da Chris Zhu.000 Thiel Fellowship per alimentare il suo primo sviluppo.
Il team ha costruito un processore di precompilazione LVI personalizzato e una memoria condivisa CSM per aumentare l'efficienza dell'inferenza.consente l'implementazione di inferenze commerciali su larga scala.
Zhu ha sottolineato che i chip AI tradizionali subiscono un grave throttling termico sotto un carico elevato: un elevato consumo di energia riduce le velocità di clock,riducendo la capacità di inferenza reale a meno della metà del suo picco teoricoI chip di Etched eseguono unità aritmetiche a metà della tensione tipica del settore, aumentando significativamente la densità di calcolo.
Ha anche affrontato i principali compromessi hardware: i chip AI dotati di HBM sono in ritardo rispetto alla SRAM nella velocità di decodifica a causa dei limiti di memoria e di interconnessione,mentre i chip SRAM puri compromettono la densità di calcolo e la capacità per un accesso più veloce, riducendo il throughput complessivo.
Questo ostacola il funzionamento di grandi modelli MoE, in quanto la trasmissione di token a livello trasversale attraverso più livelli di memoria aumenta la latenza.
L'architettura CSM di Etched® crea un pool di memoria condivisa unificata a bassa latenza per hardware scalabile, sfruttando l'interconnessione proprietaria ad alta velocità per accelerare l'accesso alla memoria cross-chip.
Il suo design ibrido HBM/SRAM bilancia la capacità di memoria e la latenza cross-chip, fornendo un'inferenza interattiva ad alto throughput.difetti termici e di prestazione della SRAM pura, DRAM 3D e soluzioni per chip ottici.
Questa innovazione disassocia gli stack HBM dai vincoli architettonici della GPU, consolida le risorse di memoria disperse e offre velocità di accesso a livello SRAM tramite una tecnologia di interconnessione avanzata.
Il sistema rack di Etched® presenta un layout ad alta interconnessione, con 16 cavi dedicati che collegano le porte posteriori a otto unità hardware principali.
Il sistema supporta LLM mainstream, modelli MoE e architetture non trasformatrici come Mamba, con l'azienda focalizzata sulla ricerca e sviluppo di sistemi completi e sulle vendite commerciali.
Storia del finanziamento incisa
2022 Società fondata
2023 ¥ 5,4 milioni di dollari
2024 120 milioni di dollari Serie A
2025 500 milioni di dollari Serie B
2026 300 milioni di dollari Serie C
Finanziamento totale fino ad oggi: $925.4M
Sequoia Capital ha guidato il round di serie C di Etched's 2026, con la partecipazione di Andreessen Horowitz, Jane Street e SK Hynix..
Il suo costante ritmo annuale di raccolta di fondi rispecchia la continua iterazione dei prodotti, sostenuta da una forte domanda dei clienti e da una solida fiducia degli investitori.
La società ha aperto un sito di produzione di 10 MW a Milpitas per migliorare l'efficienza di prototipazione e produzione.
L'architetto capo Saptadeep Pal ha rivelato che Etched ha oltre 400 dipendenti con ordini di clienti superati il miliardo di dollari.ottimizzazione della cooperazione con i fornitori e dei test sui prodotti per supportare una rapida scalabilità.
I suoi clienti principali comprendono grandi imprese, fornitori emergenti di cloud e iperscaleeri globali che offrono soluzioni di inferenza come servizio.
Commento
Se i nuovi rack di inferenza di Etched e Majestic Labs andranno oltre il tradizionale KV caching, ridisegneranno il mercato dell'archiviazione aziendale.creare opportunità di collaborazione per fornitori come Dell, HPE, NetApp e VAST Data per accoppiare le matrici di archiviazione con i server di inferenza di nuova generazione per prestazioni ottimali.
Beijing Qianxing Jietong Technology Co., Ltd.
Sandy Yang, direttore della strategia globale
WhatsApp / WeChat: +86 13426366826
Email: yangyd@qianxingdata.com
Sito web: www.qianxingdata.com/www.storagesserver.com
Affari:
Distribuzione di prodotti TIC/integrazione di sistemi e servizi/soluzioni infrastrutturali
Con oltre 20 anni di esperienza nella distribuzione IT, collaboriamo con i principali marchi globali per fornire prodotti affidabili e servizi professionali.
Utilizzare la tecnologia per costruire un mondo intelligenteIl vostro fornitore di servizi di prodotti ICT di fiducia!