Google lança ferramenta de IA que cria imagens a partir de outras imagens

- A Google lançou o Whisk, uma nova ferramenta de IA que gera imagens usando outras imagens como prompts, em vez de depender de descrições textuais.
- O Whisk foi apresentado como uma ferramenta que permite aos usuários combinar imagens para definir o assunto, estilo e cena. O Whisk até preenche automaticamente os prompts se o usuário não tiver visuais.
- Ele funciona com o modelo Imagen 3 da Google, que supostamente impulsiona a IA para entregar resultados mais rápidos e de maior qualidade, embora não seja perfeito.
A Google revelou o Whisk, uma nova ferramenta de IA que gera imagens usando outras imagens como prompts. Diferente das ferramentas mais antigas que dependem fortemente de descrições de texto longas e detalhadas, o Whisk supostamente permite que os usuários carreguem imagens para definir o assunto, a cena e o estilo que desejam gerar.
O ferramenta também suporta múltiplas imagens para cada um desses inputs, dando aos usuários flexibilidade significativa para experimentar. Se você não tiver uma imagem para começar, a Google tem um ícone de dado que preenche automaticamente os prompts com visuais.
No entanto, essas imagens de placeholder parecem ser geradas por IA também. Os usuários também podem adicionar um pouco de texto para ajustar a saída, mas a caixa de texto é opcional. O Whisk ainda produz resultados sem ele, de acordo com a empresa.
A ferramenta então gera uma imagem e o prompt de texto correspondente que foi usado em sua criação. Se você gostar do resultado, pode favoritar ou baixar. Se não, pode refiná-lo editando o prompt de texto subjacente ou gerando algo completamente novo.
O Imagen 3 impulsiona a IA Whisk da Google
A Google diz que o Whisk foi criado para “exploração visual rápida, não para edições perfeitas em pixels.” Portanto, embora seja flexível e divertido de usar, não entregará resultados impecáveis todas as vezes. A empresa admite que a ferramenta pode “errar o alvo”, razão pela qual permite edições rápidas para melhor precisão.
O Whisk roda no mais recente modelo de geração de imagens Imagen 3 da Google, que a empresa também anunciou junto com a ferramenta. O Imagen 3 impulsiona o Whisk para produzir seus resultados gerados por IA, e a tecnologia subjacente é dita melhorar a qualidade geral das saídas.
Junto com o Imagen 3, a Google também apresentou o Veo 2, seu modelo de geração de vídeo atualizado. O Veo 2 reportedly tem uma melhor compreensão da cinematografia e corrige problemas comuns, como características alucinadas — por exemplo, o erro clássico de IA de dedos extras.
O modelo está sendo lançado primeiro na plataforma VideoFX da Google, que ainda está em testes limitados através do Google Labs. A empresa diz que o Veo 2 eventualmente se expandirá para o YouTube Shorts e outros produtos da Google em algum momento de 2025.
Por enquanto, a empresa posiciona o Whisk como uma ferramenta de exploração, em vez de uma solução de edição profissional. Se ele se manterá competitivo contra concorrentes como o DALL-E da OpenAI ainda está por ver.
Não apenas leia notícias sobre criptomoedas. Entenda-as. Inscreva-se em nossa newsletter. É grátis.
Aviso Legal. As informações fornecidas não constituem aconselhamento de investimento. Cryptopolitan.com não assume responsabilidade por quaisquer investimentos realizados com base nas informações fornecidas nesta página. Recomendamos fortemente a realização de pesquisa independente e/ou consulta com um profissional qualificado antes de tomar quaisquer decisões de investimento.

Jai Hamid
Jai Hamid cobre criptomoedas, mercados de ações, tecnologia, economia global e eventos geopolíticos que afetam os mercados há 6 anos. Ela trabalhou com publicações focadas em blockchain, incluindo AMB Crypto, Coin Edition e CryptoTale, em análises de mercado, grandes empresas, regulamentação e tendências macroeconômicas. Formada na London School of Journalism, ela compartilhou insights sobre o mercado de criptomoedas três vezes em uma das principais redes de TV da África.
















