top of page

Gino News

quarta-feira, 23 de outubro de 2024

Stability AI Lança Modelos de Geração de Imagens Mais Poderosos até o Momento

Inteligência Artificial Tecnologia Inovação

A Stability AI apresentou, em 22 de outubro de 2024, o Stable Diffusion 3.5, seus modelos de geração de imagens mais avançados até agora, com variantes que atendem tanto a usuários comuns quanto a aplicações empresariais. A nova versão promete melhorias significativas em relação à anterior, que não atendeu às expectativas.

Create a vector-image depicting a futuristic scene unfolding in a 2D, linear perspective. The setting has a clear, textureless white backdrop. At the forefront is an artist of South Asian descent, working with a digital canvas that symbolizes a significant tool for creators. The digital canvas is vibrant with dynamic, computer-generated images that symbolize the wave of new technology brought about by the Stable Diffusion 3.5 AI model. The overall mood of the image should reinforce the theme of technological innovation. Note: Maintain a corporate and flat style throughout the composition.

Imagem gerada utilizando Dall-E 3

A Stability AI revelou seu mais recente lançamento, o Stable Diffusion 3.5, que representa um avanço considerável nos modelos de geração de imagens em código aberto. A série de modelos foi desenhada para atender a uma ampla gama de necessidades dos usuários, abrangendo desde entusiastas até empresas de grande porte.


O modelo principal, chamado Stable Diffusion 3.5 Large, apresenta 8 bilhões de parâmetros e suporta imagens em resolução de 1 megapixel, tornando-se o mais poderoso da família Stable Diffusion. Para facilitar a geração de imagens, a versão Large Turbo oferece qualidade semelhante com um tempo de processamento reduzido, gerando imagens em apenas quatro etapas.


Além disso, uma versão Medium está agendada para lançamento em 29 de outubro, com 2.5 bilhões de parâmetros, otimizada para hardware de consumo e capaz de gerar imagens em resoluções entre 0.25 e 2 megapixels. Os modelos mais recentes incluem inovações técnicas, como Query-Key Normalization, que melhora a estabilidade do treinamento e facilita o ajuste fino.


  1. Stable Diffusion 3.5 Large com 8 bilhões de parâmetros e resolução de 1 megapixel.

  2. Versão Large Turbo que gera imagens em apenas quatro etapas.

  3. Modelo Medium para lançamento com 2.5 bilhões de parâmetros.

  4. Implementação de Query-Key Normalization para melhor estabilidade.

  5. Licenciamento permissivo para uso não comercial.

  6. Compromisso com o desenvolvimento responsável da AI.


Os novos modelos estão disponíveis através de várias plataformas, incluindo Hugging Face, GitHub e a API da Stability AI. A empresa também anunciou uma licença comunitária bastante permissiva, permitindo uso gratuito para empresas com receitas anuais abaixo de 1 milhão de dólares.


- Avanço tecnológico na geração de imagens. - Maior acessibilidade para usuários e empresas. - Foco em desenvolvimento responsável e segurança. - Lançamento de novas versões planejadas.


Com esses lançamentos, a Stability AI reafirma seu compromisso com inovações na área de inteligência artificial e abre novas possibilidades para criadores, artistas e empresas na utilização de tecnologia avançada de geração de imagens.


A atualização dos modelos de geração de imagem da Stability AI não só fortalece sua posição no mercado, mas também destaca a importância da inovação responsável na inteligência artificial. Os leitores são incentivados a explorar essas novidades acessando as plataformas mencionadas e a se inscreverem em nossa newsletter para mais atualizações diárias sobre tecnologia e inteligência artificial.


FONTES:

    1. Stability AI

    2. Hugging Face

    3. GitHub

    4. Replicate

    5. ComfyUI

    REDATOR

    Gino AI

    23 de outubro de 2024 às 10:34:19

    PUBLICAÇÕES RELACIONADAS

    Create a 2D, linear and corporate-style vector image symbolizing a significant milestone in artificial intelligence technology. This image shows the Gemini 2.0 Flash, a model that integrates native image generation and text-based editing. The interface of Gemini 2.0 Flash is shown in use, placed against a plain, white, and texture-less background. In the image, you can see it generating images from text commands within a digital workspace. Additional elements in the image include symbols of artificial intelligence, like brain and circuit icons. Use vibrant colors to convey innovation and technology, and apply a futuristic style that aligns with the vision of advanced technology.

    Google Lança Gemini 2.0 Flash: Revolução na Geração de Imagens com IA

    Illustrate a 2D, linear perspective image in a corporate, flat and vector style. The image has a textureless, white background. In the foreground, focus on a central figure who symbolizes a leadership role in AI, but not specifically Stephen Peacock. He is explaining the application of AI in game development. Include a visual context of the game development environment and a logo symbolizing an international game development provider, but not specifically the Keywords Studios logo.

    Keywords Studios Lança Soluções de IA para Desenvolvimento de Jogos

    Create a 2D, vector-styled illustration with a white and untextured background, conveying corporate aesthetic. Depict the intersection of technology and entertainment, featuring elements of gaming and artificial intelligence. Incorporate graphic elements representing the evolution of games in the digital era, and artificial intelligence icons to symbolize technological integration in game development. Use bright, vibrant colors to convey emotion and innovation in the gaming industry. This image should not contain any identifiable figures or characters and should maintain a flat, linear perspective.

    Desafios para Netflix Games após saída do vice-presidente de IA generativa

    Generate a linear, 2D perspective image in a corporate, vector, and flat style visualization. The scene is set on a plain, texture-free white background. It features a presentation layout for a webinar titled 'Webinar about Digitizer ADQ35-WB' decided to take place on Tuesday, March 25, 2025, at 10 AM (Pacific) and 1 PM (Eastern). The central elements include an image of the advanced, impressively capable ADQ35-WB digitizer, which gives a unique opportunity for interested developers to learn about its applications and specifications, as well as visual depictions of performance charts which outline its capabilities. The Teledyne LeCroy logo is also incorporated within, strengthening the brand's recognition.

    Webinar Revela Potencial do Digitizer ADQ35-WB: Inscreva-se Já!

    Fique por dentro das últimas novidades em IA

    Obtenha diariamente um resumo com as últimas notícias, avanços e pesquisas relacionadas a inteligência artificial e tecnologia.

    Obrigado pelo envio!

    logo genai

    GenAi Br © 2024

    • LinkedIn
    bottom of page