ÚLTIMAS NOTÍCIAS
SELECIONADO PARA VOCÊ

Llama 3 Programado para ser lançado no próximo mês

PorAamir SheikhAamir Sheikh 3 min de leitura
Llama 3
  • O modelo de IA principal da Meta, o Llama 3, deve ser lançado em maio.
  • O Llama 3 pode ser o modelo de código aberto mais avançado do mercado.
  • Após o Llama 2, o favorito do código aberto, espera-se que o Llama 3 também ganhe atenção do mercado.

A Meta confirmou finalmente o lançamento do Llama 3. Em um evento em Londres, a Meta forneceu alguns detalhes e o prazo de lançamento para seu avançado modelo de IA. Executivos da Meta disseram que em breve lançarão a próxima versão de seu modelo de linguagem grande de código aberto, conforme relatado pela Techcrunch.

Espera-se que a Meta lance primeiro uma versão pequena do Llama 3, e um modelo de código aberto completo será lançado depois disso, afirmou The Information. Mas por que uma versão menor em primeiro lugar? Acreditamos que a afirmação de The Information faz sentido, pois isso proporcionará uma oportunidade de criar algum hype sobre as capacidades do modelo completo.

O que sabemos sobre o Llama 3 e seu lançamento

O lançamento do Llama 3 desafiará o domínio do gigante de LLMs GPT 4, pois espera-se que seja o LLM mais avançado na categoria de código aberto e estará disponível em diferentes modelos, como o Llama 2. Nick Clegg, presidente de assuntos globais da Meta, disse no evento, 

“No próximo mês, na verdade menos e esperamos que em um período muito curto, esperamos começar a lançar nossa nova suíte de modelos de fundação de próxima geração, o Llama 3.”

A declaração de Clegg claramente sugere a disponibilidade de diferentes versões do Llama 3, pois ele acrescentou,

“Haverá vários modelos diferentes com diferentes capacidades e versatilidades [lançados] ao longo deste ano, começando realmente muito em breve.”

fonte: Techcrunch

Falando sobre a afirmação de The Information; parece legítima, não é? Então, agora o que sabemos sobre o Llama 3 é que ele virá em diferentes versões e tamanhos, desde modelos pequenos até muito grandes, totalmente capazes, variando desde modelos como Haiku, Claude e Gemini Nano até os behemoths como GPT 4. Não sabemos mais, mas com certeza sabemos que será de código aberto, como o Llama 2 e Multimodel, também, com habilidades para entender textos junto com visuais. 

Críticos comparando código aberto a modelos fechados

Llama é um modelo de código aberto, mas não está flutuando no ar. Sabemos que há um forte apoio da Meta e de seus recursos por trás dele, e a Meta quer aproveitar desenvolvedores e pesquisadores de terceiros. Mas, apesar de todo o favoritismo dos modelos de código aberto, alguns críticos ainda são céticos quanto à sua competência em comparação com modelos privados fechados como o GPT 4. Eles têm suas próprias razões para suas opiniões sobre o assunto. 

O argumento começa com os recursos para estabelecer conjuntos de dados gigantes para treinar modelos, alegando que modelos como o ChatGPT têm conjuntos de dados enormes estruturados com dados marcados por humanos. Claro, nenhuma máquina ainda pode igualar as capacidades humanas, mas estamos nos aproximando disso? Talvez sim ou talvez não nos próximos dois anos. Outra razão é a disponibilidade. Embora este seja um ponto válido, vimos na história da tecnologia que pequenas startups às vezes vencem grandes corporações em alguns recursos-chave com suas soluções inovadoras. Mas a realidade é que a OpenAI é o lar de engenheiros com salários que excedem um milhão de dólares.

Outro ponto que eles levantam é a estrutura da equipe, o argumento é que uma abordagem descentralizada de código aberto não pode igualar as conquistas das equipes centralizadas. A infraestrutura de nuvem pública também não está à altura das que a OpenAI e o Google ostentam, o que também dificulta que as equipes de código aberto façam melhorias incrementais em um ritmo rápido. Juntos, esses são motivos suficientes para ir contra os sistemas de código aberto. Mas, como sabemos, apesar do Llama ser de código aberto, há a Meta por trás dele, apoiando-o alocando recursos enormes. 

Meta investindo em GPUs

Em janeiro, Mark Zuckerberg disse que estão construindo uma infraestrutura de computação massiva com novas 350 mil GPUs H100, e se você incluir outras GPUs, quase 600 mil H100 estarão a bordo. Mark disse isso em um vídeo. Isso será muito mais poder de computação do que o da OpenAI, que ela usou para treinar o GPT 4. O investimento é de bilhões de dólares apenas para IA.

O Llama 3 alimentará o assistente de IA da Meta, e também será integrado a uma série de produtos em toda a linha de aplicativos da empresa. O Llama 3 vai desafiar o domínio do GPT 4? Olhando para o histórico de seu predecessor, o Llama 2 foi a espinha dorsal dos LLMs de código aberto mais avançados, como o Mistral da França e alguns outros, que foram construídos ajustando e otimizando-o.

Alguns deles até superaram o GPT 3.5 em desempenho, então podemos especular que o Llama 3, com suas capacidades avançadas, será usado para novos produtos de LLM que igualarão ou excederão o desempenho do GPT 4 com custos de treinamento compartilhados e reduzidos, tornando possível para mais pessoas participarem. 

A competição será muito difícil, com a comunidade de código aberto tentando inovar sobre o LLama 3 e apresentar soluções indígenas como antes, e a OpenAI também lançando o GPT 5 nos próximos meses. Estamos maravilhados com o tempo interessante que está por vir.

Não apenas leia notícias sobre criptomoedas. Entenda-as. Inscreva-se em nossa newsletter. É grátis.

Compartilhe este artigo

Aviso Legal. As informações fornecidas não constituem aconselhamento de investimento. Cryptopolitan.com não assume responsabilidade por quaisquer investimentos realizados com base nas informações fornecidas nesta página. Recomendamos fortemente a realização de pesquisa independente e/ou consulta com um profissional qualificado antes de tomar quaisquer decisões de investimento.

Aamir Sheikh

Aamir Sheikh

Aamir é um jornalista de tecnologia com quase seis anos de experiência nos setores de criptomoedas e tecnologia. Formou-se na MAJ University com um MBA em Finanças e Marketing. Atualmente trabalha na Cryptopolitan, onde relata os últimos desenvolvimentos nos mercados de criptomoedas e previsões de preços.

MAIS … NOTÍCIAS