Tecnologia

Google relança ferramenta de geração de imagens AI como Imagen 3

O Gemini AI está recebendo um novo modelo de geração de imagens chamado Imagen 3, vários meses após o Google desativar seu antecessor devido a saídas controversas. O gigante das buscas anunciou em seu blog The Keyword ontem, dizendo: “O Imagen 3 traz capacidades avançadas de geração de imagens com salvaguardas embutidas e que aderem aos nossos princípios de design de produto.”

A funcionalidade de geração de imagens Imagen 2 no Gemini ganhou manchetes em fevereiro quando produziu retratos altamente imprecisos de sujeitos históricos. A empresa queria que sua ferramenta de geração de imagens por IA evitasse as armadilhas do viés e das representações de pessoas reais. No entanto, em um esforço para ser mais inclusiva, a ferramenta que criou foi para o outro extremo, onde teve algum viés contra pessoas de pele clara.

Esse problema se tornou viral com a postagem do usuário do X, End Wokeness, onde os resultados para “um retrato dos Pais Fundadores da América” mostravam um homem nativo americano, um homem asiático e dois homens de pele escura. Chegou ao ponto de o gerador de imagens fazer retratos grosseiramente imprecisos, onde pessoas de cor eram retratadas como soldados nazistas.

Novas tecnologias de IA devem lidar com esses problemas, especialmente porque esses programas não têm compreensão da história e ética humanas. Por causa disso, ferramentas de IA, como o Copilot Designer da Microsoft, podem produzir imagens inadvertidamente repreensíveis. O Google tentou corrigir isso garantindo que sua ferramenta de geração de imagens evitasse esses estereótipos e preconceitos culturais. No entanto, uma das consequências não intencionais é que a ferramenta Imagen 2 se tornou tão inclusiva a ponto de se tornar historicamente imprecisa e, às vezes, grosseiramente ofensiva. Devido a essa controvérsia, o Google teve que retirar o Imagen 2 três semanas após seu lançamento para corrigir o problema.

A empresa disse que relançaria a ferramenta de geração de imagens em algumas semanas, e finalmente o fez quase 20 semanas após a retirada. De acordo com a postagem no blog The Keyword, o Imagen 3 “não suporta a geração de indivíduos fotorrealistas e identificáveis, representações de menores ou cenas excessivamente sangrentas, violentas ou sexuais.” No entanto, reconhece que a ferramenta de IA generativa pode cometer erros, mas o Google diz que continuará melhorando-a através do feedback dos usuários.

O Imagen 3 começará a ser lançado para os usuários do Gemini nos próximos dias, com os usuários do Gemini Advanced, Business e Enterprise em inglês entre os primeiros a obter acesso. Com a ferramenta tendo recebido melhorias técnicas e melhores conjuntos de dados, além de ter passado por testes intensos e princípios claros de produto, esperamos obter resultados melhores, mais precisos e menos ofensivos.

Fonte: The Keyword

Shares:

Deixe um comentário

O seu endereço de e-mail não será publicado. Campos obrigatórios são marcados com *