O Gemini AI está recebendo um novo modelo de geração de imagens chamado Imagen 3, vários meses após o Google desativar seu antecessor devido a saídas controversas. O gigante das buscas anunciou em seu blog The Keyword ontem, dizendo: “O Imagen 3 traz capacidades avançadas de geração de imagens com salvaguardas embutidas e que aderem aos nossos princípios de design de produto.”
A funcionalidade de geração de imagens Imagen 2 no Gemini ganhou manchetes em fevereiro quando produziu retratos altamente imprecisos de sujeitos históricos. A empresa queria que sua ferramenta de geração de imagens por IA evitasse as armadilhas do viés e das representações de pessoas reais. No entanto, em um esforço para ser mais inclusiva, a ferramenta que criou foi para o outro extremo, onde teve algum viés contra pessoas de pele clara.
Esse problema se tornou viral com a postagem do usuário do X, End Wokeness, onde os resultados para “um retrato dos Pais Fundadores da América” mostravam um homem nativo americano, um homem asiático e dois homens de pele escura. Chegou ao ponto de o gerador de imagens fazer retratos grosseiramente imprecisos, onde pessoas de cor eram retratadas como soldados nazistas.
America’s Founding Fathers, Vikings, and the Pope according to Google AI: pic.twitter.com/lw4aIKLwkpFebruary 21, 2024
Novas tecnologias de IA devem lidar com esses problemas, especialmente porque esses programas não têm compreensão da história e ética humanas. Por causa disso, ferramentas de IA, como o Copilot Designer da Microsoft, podem produzir imagens inadvertidamente repreensíveis. O Google tentou corrigir isso garantindo que sua ferramenta de geração de imagens evitasse esses estereótipos e preconceitos culturais. No entanto, uma das consequências não intencionais é que a ferramenta Imagen 2 se tornou tão inclusiva a ponto de se tornar historicamente imprecisa e, às vezes, grosseiramente ofensiva. Devido a essa controvérsia, o Google teve que retirar o Imagen 2 três semanas após seu lançamento para corrigir o problema.
A empresa disse que relançaria a ferramenta de geração de imagens em algumas semanas, e finalmente o fez quase 20 semanas após a retirada. De acordo com a postagem no blog The Keyword, o Imagen 3 “não suporta a geração de indivíduos fotorrealistas e identificáveis, representações de menores ou cenas excessivamente sangrentas, violentas ou sexuais.” No entanto, reconhece que a ferramenta de IA generativa pode cometer erros, mas o Google diz que continuará melhorando-a através do feedback dos usuários.
O Imagen 3 começará a ser lançado para os usuários do Gemini nos próximos dias, com os usuários do Gemini Advanced, Business e Enterprise em inglês entre os primeiros a obter acesso. Com a ferramenta tendo recebido melhorias técnicas e melhores conjuntos de dados, além de ter passado por testes intensos e princípios claros de produto, esperamos obter resultados melhores, mais precisos e menos ofensivos.
Fonte: The Keyword


