ÚLTIMAS NOTÍCIAS
SELECIONADO PARA VOCÊ

DeepSeek adiciona visão enquanto a cadeia de suprimentos de chips da China mostra que finalmente pode acompanhar o ritmo

PorHania HumayunHania Humayun 3 min de leitura
DeepSeek adiciona visão enquanto a cadeia de suprimentos de chips da China mostra que finalmente pode acompanhar o ritmo
  • O DeepSeek adicionou visão ao seu chatbot e lançou um novo modelo principal, o V4.
  • Quatro fabricantes chineses de chips igualaram pela primeira vez a compatibilidade no dia do lançamento da Nvidia.
  • A competição em IA está mudando do desempenho dos modelos para custo e independência de hardware.

Uma empresa chinesa de inteligência artificial adicionou reconhecimento de imagens e vídeos ao seu chatbot principal.

Ao mesmo tempo, as fabricantes locais de chips mostraram que agora podem igualar o suporte rápido de lançamento que costumava ser uma força americana.

A DeepSeek, uma empresa sediada em Hangzhou, adicionou discretamente um novo recurso chamado “modo de reconhecimento de imagem” à sua plataforma de chat. Este novo modo se junta a outros dois modos lançados pela empresa no início deste mês: “expert” e “flash.”

O novo recurso permite que o chatbot entenda fotos e vídeos, não apenas texto.

Isso o coloca em conformidade com outros grandes chatbots de IA que oferecem capacidades semelhantes há algum tempo.

Chen Xiaokang, que lidera a equipe multimodal da DeepSeek, disse que a ferramenta foi testada inicialmente com um pequeno grupo de usuários tanto no site quanto no aplicativo móvel.

Chen Deli, um pesquisador sênior da empresa, celebrou o lançamento com uma postagem curta que se referia ao logotipo da empresa: “A pequena baleia agora pode ver.”

O recurso de imagem e vídeo saiu apenas alguns dias depois a DeepSeek ter lançado uma prévia de seu mais novo modelo principal, DeepSeek-V4, e disponibilizado os pesos do modelo para que qualquer pessoa possa baixar e usar.

V4 não é um único modelo, mas dois. O primeiro, DeepSeek-V4-Pro, tem 1,6 trilhão de parâmetros e é projetado para tarefas difíceis que exigem raciocínio complexo e fluxos de trabalho automatizados em várias etapas.

O segundo, DeepSeek-V4-Flash, é construído para lidar com um grande número de solicitações a um custo menor. Ambos os modelos suportam uma janela de contexto de um milhão de tokens.

Eles também usam um design de atenção híbrida que, segundo a empresa, reduz a potência de computação e a memória necessária durante a inferência.

Fabricantes chinesas de chips atingem um novo marco

O que chamou a atenção de muitos observadores da indústria não foi apenas o modelo em si, mas o que aconteceu no dia de seu lançamento.

Quatro empresas chinesas de chips, Huawei Ascend, Cambricon, Hygon Information e Moore Threads, confirmaram que seu hardware funcionou perfeitamente com o V4 desde o primeiro dia de seu lançamento.

Esse tipo de suporte no mesmo dia, em que um novo modelo funciona sem problemas em chips que não são da Nvidia logo no lançamento, em vez de semanas ou meses depois, anteriormente era quase impossível fora do ecossistema da própria Nvidia.

Os chips Ascend da Huawei, incluindo o A2, A3 e 950, suportam tanto o V4-Pro quanto o V4-Flash.

A empresa disse que seu chip Ascend 950 usa processos de computação fundida e fluxos de processamento paralelo para tornar a inferência mais rápida.

A Cambricon concluiu sua adaptação usando o framework de inferência de código aberto vLLM e compartilhou seu código no GitHub.

A Hygon disse que realizou otimizações profundas de modelos em sua plataforma DCU para criar um caminho suave desde o lançamento do modelo até o uso real.

A Moore Threads trabalhou com a Academia de Inteligência Artificial de Pequim para executar o V4 em sua placa MTT S5000 usando a pilha de software FlagOS.

Observadores da indústria dizem que este lançamento coordenado representa uma mudança real.

Por anos, chips feitos fora do ecossistema da Nvidia levariam meses para suportar um novo modelo importante. Conseguir que oito conjuntos de chips domésticos funcionassem no primeiro dia é um marco significativo.

O panorama geral: custo e independência para a DeepSeek

Observadores acreditam que o significado maior deste lançamento é que a DeepSeek mostrou que pode entregar IA de alto nível sem depender de hardware ocidental.

Ao fazer com que seus modelos funcionem nativamente em vários chips chineses ao mesmo tempo, ela reduz o risco de restrições de exportação que bloquearam o acesso de empresas chinesas aos processadores americanos mais poderosos.

O custo também é importante. A DeepSeek trabalhou arduamente para manter o preço de executar seus modelos baixo. Isso facilita para as empresas construírem sistemas automatizados sem enfrentar custos de computação muito altos.

Dessa forma, as atualizações e o lançamento da DeepSeek não são principalmente sobre um único avanço técnico. Eles são mais sobre toda uma cadeia de suprimentos se unindo.

A partir deste lançamento, a questão de quem lidera em IA parece estar se afastando de quem constrói o modelo mais inteligente, e para quem pode manter todo o sistema funcionando de forma barata e independente a longo prazo.

As mentes mais inteligentes do setor de criptomoedas já leem nosso boletim informativo. Quer entrar? Junte-se a eles.

Compartilhe este artigo
Hania Humayun

Hania Humayun

Hania juntou-se ao Cryptopolitan com um longo histórico na análise de finanças, tendências econômicas e mercados preditivos. Ela cobriu temas em tecnologia emergente, IA e fintech. A experiência de Hania como arquiteta licenciada trouxe vigor e precisão à redação de notícias. Ela se formou no National College of Arts em Lahore com graduação em Arquitetura,

MAIS … NOTÍCIAS