O projeto Galaxy da SenseTime visa a expansão doméstica de chips de IA

A SenseTime lançou o Projeto Galaxy, em parceria com quase 20 parceiros para dimensionar a infraestrutura doméstica de chips de IA na China. Em uma palestra intitulada 'Transformação Inteligente e Simbiose', Yang Fan - cofundador da empresa e presidente de seu grupo de negócios de grandes dispositivos - expôs o que SenseTime descreve como um circuito fechado conectando tecnologia em nível de chip, ecossistema [...].

Numa palestra intitulada “Transformação Inteligente e Simbiose”, Yang Fan – cofundador da empresa e presidente do seu Grupo de Negócios de Grandes Dispositivos – expôs o que a SenseTime descreve como um circuito fechado que liga tecnologia a nível de chip, parcerias de ecossistemas e implementação comercial para poder de computação de IA produzido internamente.

Juntamente com o Projeto Galaxy, a SenseTime assinou um acordo de computação espacial com o fabricante de satélites Guoxing Aerospace e firmou uma parceria de pesquisa com cinco instituições – incluindo o Laboratório de Inteligência Artificial de Xangai – voltada para aplicações de computação científica. a demanda por tokens está aumentando nas implantações empresariais, a adoção de IA industrial alcançando os casos de uso voltados para o consumidor e a comercialização de chips domésticos atingindo um ponto em que os centros de computação inteligentes construídos com silício chinês podem ser acelerados.

No entanto, se essa janela é tão aberta quanto afirma o SenseTime depende muito de números que a empresa não verificou de forma independente.

Os números de rendimento do token vêm com um grande asterisco.

A SenseTime afirma que sua plataforma de dispositivos de grande escala agora processa uma média de 2,42 trilhões de tokens diariamente, e a empresa projeta que esse número aumentará 25 vezes, para 10 trilhões de tokens por dia até o quarto trimestre de 2026. Isso é uma previsão, não um resultado medido, e os compradores empresariais que avaliam a infraestrutura da SenseTime devem tratá-la como tal até que os números trimestrais comecem a chegar.

As alegações de custo-eficácia associadas a esse crescimento são igualmente auto-relatadas. SenseTime afirma que sua tecnologia de inferência híbrida heterogênea oferece um aumento de 85-152 por cento na utilização de FLOPs de modelo em chips domésticos convencionais, juntamente com a relação custo-benefício de inferência que a empresa estima em 1,25x a das peças da série H da Nvidia.

Em comparação com configurações de inferência homogêneas domésticas, o SenseTime afirma um aumento de 2,5x na produção de tokens a um custo equivalente, um salto que, segundo ele, empurra os clusters de inferência híbrida otimizados além do que a indústria anteriormente considerava como o limite mínimo de lucratividade para o poder de computação doméstico.

As informações são do site AI News

Compartilhe este artigo

Continue lendo

Voltar ao Blog