ÚLTIMAS NOTÍCIAS
SELECIONADO PARA VOCÊ

DeepSeek revela novo método de raciocínio de IA em meio à expectativa pelo seu modelo de próxima geração

PorOwotunse AdebayoOwotunse Adebayo 3 min de leitura
Deepseek revela novo método de raciocínio de IA em meio à expectativa pelo seu modelo de próxima geração.
  • A startup chinesa de inteligência artificial DeepSeek revelou um novo método de raciocínio em IA, enquanto o mercado aguarda seu modelo de próxima geração.
  • DeepSeek revela novo método de raciocínio em IA, mantendo sigilo sobre o possível lançamento do modelo R2.
  • A startup chinesa de IA focou em pesquisa e desenvolvimento, lançando a versão aprimorada de seu modelo V3.

A startup chinesa de inteligência artificial (IA) DeepSeek revelou um novo método de raciocínio, enquanto o mercado continua a aguardar a lançamento do seu modelo de próxima geração. De acordo com relatórios, a empresa acabou de introduzir uma abordagem inovadora que ajudará nas capacidades de raciocínio dos grandes modelos de linguagem (LLMs), enquanto o público aguarda o lançamento do seu novo modelo.

De acordo com relatórios, um documento publicado recentemente revelou que a façanha foi alcançada através de uma colaboração entre investigadores da Universidade de Tsinghua e a startup de IA. De acordo com o documento, a DeepSeek conseguiu desenvolver uma técnica que combina métodos conhecidos como modelação de recompensa generativa (GRM) e ajuste auto-princípio. A abordagem dupla permitirá que os LLMs entreguem resultados melhores e mais rápidos para consultas gerais.

DeepSeek revela novo método de raciocínio de IA

De acordo com os investigadores, os modelos DeepSeek-GRM resultantes foram capazes de superar os métodos existentes, alcançando um desempenho competitivo em comparação com modelos de recompensa públicos robustos. A modelação de recompensa é um processo que ajuda um LLM a determinar as preferências humanas. Os investigadores mencionaram que a startup de IA tem a intenção de tornar os modelos GRM de código aberto, mas a empresa ainda não forneceu um cronograma para o desenvolvimento.

A publicação do artigo de investigação académica surge após especulações sobre o próximo movimento potencial da startup, depois de ter recebido atenção global do seu modelo base DeepSeek V3 e do seu modelo de raciocínio R1. Na altura, o modelo R1, lançado no início deste ano, ganhou destaque após se descobrir que tinha um desempenho superior a alguns modelos mais antigos, incluindo o primeiro modelo ChatGPT da OpenAI.

O lançamento do modelo R1 também pegou a Silicon Valley de surpresa, considerando o facto de o modelo ser de código aberto e ter sido concluído com uma fração dos custos utilizados em outros modelos de IA. Embora a atenção pareça estar a diminuir, tem havido algum progresso notável entre empresas concorrentes na indústria da IA, mostrando que a rivalidade no setor é histórica.

No entanto, um relatório da Reuters no mês passado mencionou que a DeepSeek-2, sucessora do mundialmente celebrado R1, pode estar em desenvolvimento. De acordo com o relatório, a empresa poderia estar a olhar para o lançamento do mesmo para o final deste mês, à medida que procura capitalizar o seu perfil crescente na indústria da IA. A DeepSeek, por outro lado, manteve-se reservada sobre o modelo R2, mantendo silêncio nos canais públicos oficiais, com uma conta de atendimento ao cliente a negar o rumor junto dos clientes empresariais, de acordo com os relatórios.

O desenvolvimento do modelo V3 continua

A DeepSeek, sediada em Hangzhou, foi fundada em 2023 pelo empreendedor Liang Wenfeng e tem estado no centro das atenções globais pelos motivos certos nos últimos meses. No entanto, a empresa recusou fazer comunicações públicas, decidindo focar todo o seu tempo e energia na investigação e desenvolvimento. Embora ainda seja incerto o que a empresa tem para a indústria da IA, certamente que tem estado a trabalhar, graças aos rumores.

No mês passado, a empresa anunciou um desenvolvimento em que tinha estado a trabalhar, mostrando ao mundo o seu modelo V3 atualizado, nomeado DeepSeek-V3-0324. De acordo com a firma, o modelo atualizado oferecia “capacidades de raciocínio aprimoradas, desenvolvimento web front-end otimizado e proficiência em escrita em chinês atualizada”. Em fevereiro, a empresa externalizou cinco dos seus repositórios de código, permitindo que os desenvolvedores os revíssem e contribuíssem para o seu desenvolvimento de software. A startup mencionou que faria “progresso sincero com total transparência.”

No mesmo mês, Liang publicou um estudo técnico sobre atenção esparsa nativa, um método usado para melhorar a eficiência dos LLMs no processamento de grandes volumes de dados. Liang, de 40 anos, é também o fundador da empresa-mãe da DeepSeek, a High-Flyer Quant, o fundo de hedge que forneceu a força financeira para financiar os avanços técnicos da startup de IA. No final de fevereiro, o empreendedor participou de um simpósio que reuniu empresários de tecnologia, com o presidente chinês Xi Jinping a recebê-los. O presidente elogiou a startup como um sinal da resiliência do país face às medidas dos Estados Unidos para conter o progresso da IA na China.

As mentes mais inteligentes do setor de criptomoedas já leem nosso boletim informativo. Quer entrar? Junte-se a eles.

Compartilhe este artigo

Aviso Legal. As informações fornecidas não constituem aconselhamento de investimento. Cryptopolitan.com não assume responsabilidade por quaisquer investimentos realizados com base nas informações fornecidas nesta página. Recomendamos fortemente a realização de pesquisa independente e/ou consulta com um profissional qualificado antes de tomar quaisquer decisões de investimento.

Owotunse Adebayo

Owotunse Adebayo

Adebayo é um escritor com quatro anos de experiência no espaço cripto. Formou-se pela Universidade de Lagos, onde estudou Planejamento Urbano e Regional. Adebayo trabalhou na Tokenhell e na CryptoTicker, escrevendo notícias sobre criptomoedas e Fintech. Atualmente, é colaborador de notícias da Cryptopolitan.

MAIS … NOTÍCIAS