SIXUNITED × Jiangbolong iSA: Equipando a IA no lado do dispositivo com um armazenamento “capaz de pensar”


À medida que os grandes modelos se aceleram na implantação no lado do terminal, dispositivos como AIPC e estações de trabalho de IA estão passando de “executar modelos” para “executar agentes inteligentes”. No entanto, com a contínua expansão do tamanho dos parâmetros dos modelos e o crescente comprimento do contexto, o gargalo da IA no lado do terminal já não se resume apenas à capacidade computacional máxima do CPU, GPU ou NPU; a capacidade de memória, a largura de banda de dados, a taxa de transferência de armazenamento e a capacidade de escalonamento de múltiplas tarefas passam a determinar conjuntamente a experiência real de execução.


Em especial, após a arquitetura de grandes modelos MoE (Mixture of Experts) ter se tornado predominante, o tamanho dos parâmetros do modelo cresceu rapidamente, o cache de chaves‑valor (KV Cache) vem se expandindo continuamente e a pressão sobre a memória gráfica aumenta vertiginosamente. Uma grande quantidade de dados precisa ser transferida com frequência entre o armazenamento, a memória e as unidades de computação; já que o SSD tradicional atua como um suporte passivo de dados, ele passou a não conseguir mais atender às exigências de baixa latência, alta taxa de transferência e escalonamento inteligente na inferência de IA em dispositivos de borda.

 

Na próxima fase da concorrência em IA de borda, o diferencial já não se resume a “quem dispõe de maior poder computacional”, mas sim a quem conseguir primeiro estabelecer uma integração eficaz entre armazenamento e computação.

 

A SIXUNITED, em parceria com a Jiangbolong, desenvolveu uma solução de computação‑armazenamento colaborativa voltada para a IA no lado do dispositivo.
Como provedor de infraestrutura de IA de pilha completa, a SIXUNITED tem, nos últimos anos, avançado de forma contínua na implementação integrada de “hardware + software + agente inteligente de IA”, com produtos que abrangem diversos tipos de terminais, incluindo PCs com IA, Mini PCs, estações de trabalho com IA e servidores, além de construir um ecossistema completo de aplicativos de IA em torno da plataforma autônoma de agentes inteligentes de IA, OpenClaw.

 

Para liberar ainda mais a capacidade de inferência da IA no lado do terminal, a SIXUNITED estabeleceu uma cooperação técnica profunda com a empresa de marcas de armazenamento semicondutoras Jiangbolong, integrando o agente inteligente de armazenamento iSA (Intelligent Storage Agent) da Jiangbolong à linha de produtos de terminais AI da SIXUNITED, construindo assim uma arquitetura completa de colaboração entre armazenamento e computação no lado do terminal.


Diferentemente dos SSDs tradicionais, que se limitam a realizar leitura e escrita de dados, o iSA eleva ainda mais a capacidade de armazenamento, transformando‑o em um nó de inferência de IA com capacidade de escalonamento inteligente, permitindo que o armazenamento participe efetivamente do processo de inferência de grandes modelos e oferecendo ao AI de borda uma capacidade de fluxo de dados muito mais eficiente.

 

Essa parceria também significa que a SIXUNITED não apenas pode fornecer terminais de IA, mas também oferece uma solução completa que abrange computação, armazenamento e aplicações inteligentes.

 

O armazenamento passa a participar do raciocínio, tornando a execução no terminal de IA mais eficiente.
A capacidade central do iSA provém da sua unidade de processamento de armazenamento (SPU) de 5 nm integrada. Ao transferir parte da camada de especialistas MoE para ser executada no lado do armazenamento e ao combinar isso com um mecanismo inteligente de gestão do cache de chaves‑valor, é possível reduzir efetivamente a utilização da memória gráfica do GPU, diminuir o transporte de dados via I/O e aumentar a eficiência da inferência do modelo.


Para os dispositivos de borda, isso significa que modelos maiores podem ser implantados localmente, contextos mais longos podem ser processados de forma estável e agentes de IA complexos conseguem manter uma experiência de resposta mais fluida em cenários como conversas multi‑turno, recuperação de conhecimento e geração de código.

 

Na plataforma de terminal de IA construída pela SIXUNITED, o iSA deixou de ser apenas um hardware de base e passou a integrar-se como uma parte essencial do fluxo de inferência de IA, alcançando uma evolução na capacidade de passar de “armazenar dados” para “participar do cálculo”.


A otimização conjunta das duas plataformas permite que diferentes hardware explorem plenamente o potencial de modelos de grande porte.
Em torno da plataforma de IA dominante, a SIXUNITED e a Jiangbolong concluíram a otimização conjunta das duas principais linhas tecnológicas da Intel e da AMD.

 

Na plataforma AMD, as duas partes realizaram uma otimização conjunta com base na plataforma AMD Ryzen AI Max+ 395, permitindo a implantação local de modelos de grande porte com até 397 bilhões de parâmetros. Em cenários de contexto extremamente longo, de 256 mil tokens, a utilização de memória DRAM foi reduzida em quase 40%, enquanto a escala de implantação dos modelos aumentou até 3,2 vezes em relação às soluções tradicionais, oferecendo maior margem de manobra para aplicações complexas, como contextos ultra‑longos e coordenação entre múltiplos agentes.

 

Na plataforma Intel, com base nos produtos de PC e estação de trabalho AI da SIXUNITED, aliados ao processador Intel Core Ultra e aos recursos de computação NPU, o iSA consegue garantir a execução estável de grandes modelos locais, reduzindo a pressão sobre os recursos do sistema sem comprometer a experiência de inferência.

 

Os dados dos testes mostram que, na plataforma Intel Core Ultra X9 388H, após a implantação do iSA, o modelo Qwen3.5‑35B consegue manter uma velocidade de inferência de cerca de 23 a 26 tokens por segundo em um contexto de 128K; ao mesmo tempo, em diferentes tamanhos de modelo, a plataforma suporta a implantação de múltiplos modelos, variando de 35B a 397B, oferecendo maior escalabilidade para a IA em dispositivos finais. Para diferentes quantidades de memória gráfica, o iSA também permite ajustar de forma flexível a proporção de descarregamento do modelo, reduzindo o consumo de memória enquanto equilibra a capacidade do modelo e a eficiência da inferência.

 

iSAvsIlama.cpp: confronto direto entre modelos

 

Comparação do desempenho de inferência em múltiplos tamanhos de modelo

 


Da atualização de hardware à colaboração ecológica, impulsionamos a efetiva implementação da IA no lado do dispositivo.
O desenvolvimento da indústria de IA já ingressou em uma nova fase, passando da inovação de modelos para a implementação prática em cenários concretos. Para os fabricantes de dispositivos finais, contar apenas com a melhoria do desempenho do hardware já não é suficiente para atender às demandas integradas dos usuários corporativos por implantação local, inferência segura e aplicações inteligentes.

 

A SIXUNITED está aproveitando sua capacidade de pilha completa, que abrange terminais de IA, plataformas de agentes inteligentes e soluções setoriais, para integrar profundamente as capacidades de armazenamento inteligente da Jiangbolong iSA ao seu ecossistema de produtos, estabelecendo uma relação de colaboração ainda mais eficiente entre armazenamento, poder computacional e aplicativos de IA, oferecendo aos clientes corporativos soluções de IA no lado do dispositivo prontas para uso.

 

De PCs com IA, Mini PCs e estações de trabalho com IA até à infraestrutura de IA de nível empresarial, a SIXUNITED está, em parceria com seus parceiros do ecossistema, aperfeiçoando continuamente a base de capacidades de IA no lado do dispositivo. Como afirmou Cao Yalian, presidente da SIXUNITED: “Só mediante o apoio mútuo e a coexistência harmônica do ecossistema é que poderemos alcançar horizontes distantes.”

 

Quando o armazenamento passar a possuir capacidade de “pensar”, a exploração do valor da IA no lado do dispositivo também entrará em uma nova fase.