
Gino News
quarta-feira, 23 de outubro de 2024
Zyphra Lança Zyda-2: Novo Dataset Promete Aumentar a Precisão em Modelos de Linguagem
A Zyphra Technologies anunciou o lançamento do Zyda-2, um novo dataset de pré-treinamento que contém 5 trilhões de tokens, visando ajudar empresas a treinar modelos de linguagem pequenos com alta precisão, permitindo a operação eficaz em dispositivos de borda e consumo.

Imagem gerada utilizando Dall-E 3
A Zyphra Technologies, especializada em sistemas de agentes multimodais, lançou Zyda-2, um dataset open que é cinco vezes maior que seu predecessor, o Zyda, e contém 5 trilhões de tokens. Esta nova versão se destaca por sua composição única, que combina as melhores qualidades de datasets existentes enquanto elimina suas fraquezas.
Com o Zyda-2, as organizações podem treinar modelos de linguagem que apresentam alta precisão, mesmo com orçamentos limitados de parâmetros. A empresa já testou seu modelo de linguagem pequeno, Zamba2, que demonstrou desempenho superior ao ser treinado com o novo dataset em comparação aos datasets open-source tradicionais. Este movimento segue o lançamento do Zyda, que visava a diversidade e qualidade na construção de modelos de linguagem competitivos.
Zyda-2 foi desenvolvido a partir de uma combinação de datasets open de alta qualidade e processado com a biblioteca Nvidia NeMo Curator, que possibilitou uma redução significativa nos custos e no tempo de processamento. Com um pipeline aprimorado, a Zyphra conseguiu criar um ensemble perfeito de datasets que melhora a performance dos modelos treinados.
Zyda-2 contém 5 trilhões de tokens.
O dataset foi otimizado para eliminar duplicatas e melhorar a qualidade.
Empresas podem utilizar Zyda-2 para treinar modelos de linguagem pequenos com alta precisão.
Zamba2, um modelo pequeno, teve desempenho superior quando treinado com Zyda-2.
Zyda-2 é acessível para download sob uma licença ODC-By.
A Zyphra acredita que a criação do Zyda-2 abrirá caminho para modelos pequenos de melhor qualidade, atendendo à demanda por eficiência em contextos de memória e latência. Os resultados de estudos de ablação indicam que a qualidade do modelo melhora substancialmente quando treinado com este novo dataset em comparação a outros datasets individuais.
- Impacto positivo na indústria de IA. - Facilidade de acesso ao novo dataset. - Possibilidade de avanços em modelos de linguagem. - Aumento na competitividade das empresas.
Com a disponibilização do Zyda-2, as empresas têm a oportunidade de impulsionar seus modelos de linguagem, beneficiando-se das inovações trazidas por essa nova abordagem. A busca por eficiência e qualidade se torna ainda mais palpável, contribuindo para o avanço da inteligência artificial em diversas aplicações.
O lançamento do Zyda-2 representa uma evolução significativa para o treinamento de modelos de linguagem, destacando a importância da qualidade e diversidade dos dados. Para quem deseja se aprofundar mais sobre o impacto da IA em suas operações, é recomendável acompanhar nossa newsletter e acessar conteúdos atualizados diariamente sobre o tema.
FONTES:
REDATOR

Gino AI
23 de outubro de 2024 às 10:42:10
PUBLICAÇÕES RELACIONADAS




