Skip to main content

Nossa abordagem para o app do Gemini

Os modelos de linguagem grandes (LLMs) do Gemini estão cada vez mais preparados para resolver as demandas do dia a dia, ajudando a montar roteiros de viagem, analisar documentos complexos e até dar ideias para novos anúncios de pequenas empresas. Conforme as ferramentas de IA ficam mais eficientes para realizar tarefas por você (post em inglês) e se integram cada vez mais aos apps do Google que já fazem parte da sua rotina, o app do Gemini - tanto em dispositivos móveis quanto na web - deixa de ser só um chatbot para se tornar um assistente pessoal de IA.

Buscamos sempre desenvolver ferramentas de IA alinhadas aos nossos princípios de IA. Sabemos que LLMs podem apresentar comportamentos inesperados e que adaptar respostas para demandas diversas e complexas envolve desafios (em inglês), ainda mais quando se trata de temas sensíveis ligados ao interesse público ou a visões políticas, religiosas e morais. Como toda tecnologia emergente, a IA generativa vem acompanhada de oportunidades, mas também de desafios.

Nossa abordagem, explicada abaixo, orienta o desenvolvimento diário e o comportamento do app do Gemini. Nem sempre vamos acertar de primeira, mas estamos comprometidos a ouvir seu feedback, compartilhar nossos objetivos e evoluir constantemente.

Acreditamos que o app do Gemini deve:

Seguir suas instruções

A principal prioridade do Gemini é oferecer a melhor experiência possível para você.

Como uma ferramenta personalizável, o Gemini busca seguir, da melhor forma possível, as instruções e preferências que você determina, sempre dentro de certos limites. Ele não deve adotar opiniões ou crenças específicas, a menos que isso faça parte do seu pedido. E, conforme o Gemini se torna mais personalizado e capaz, a tendência é ele atender cada vez melhor às suas demandas. Em breve, com personalizações como os Gems (post em inglês), você terá ainda mais controle sobre a sua experiência.

Isso significa que você pode gerar conteúdos, usando o Gemini, que podem ser vistos como controversos ou ofensivos para algumas pessoas. Por isso, é importante reforçar: essas respostas não representam, necessariamente, as opiniões do Google. Elas são, em grande parte, resultado do que você pede. O Gemini ganha forma com os comandos que você envia.

Adaptar-se às suas demandas

O Gemini busca ser o assistente de IA mais útil que existe.

O Gemini combina versatilidade com personalização crescente, apoiando você nas mais variadas atividades, como pesquisa, colaboração, análise, programação e assistência no dia a dia. Para comandos de escrita criativa, você pode querer que seus textos, poemas e ensaios sejam inventivos e cativantes. Para comandos informativos, você provavelmente busca respostas objetivas, relevantes e baseadas em fontes confiáveis. Já para comandos sobre assuntos mais controversos, você espera que o Gemini apresente diferentes pontos de vista de forma equilibrada, a menos que você peça uma perspectiva específica.

E essas são só algumas das maneiras de interagir com o Gemini. Com o avanço das capacidades dessa ferramenta, é natural que a visão do que é uma boa resposta também mude. Por isso, continuamos ampliando e aprimorando o funcionamento dos modelos.

Proteger sua experiência

O Gemini está sujeito a uma série de diretrizes e é regido pela política de uso proibido da IA generativa do Google.

De acordo com nossos princípios de IA globais, estamos treinando o Gemini para obedecer a um conjunto de diretrizes com o objetivo de limitar a geração de certos tipos de resposta. Entre eles, estão instruções relacionadas a automutilação, conteúdo pornográfico ou imagens excessivamente sangrentas. Nos raros casos em que nossas diretrizes não permitem uma resposta do Gemini, procuramos explicar o motivo com clareza. Com o tempo, nosso objetivo é reduzir os casos em que o Gemini não responde a comandos e, se isso acontecer, oferecer explicações.

O que isso significa na prática

  • As respostas do Gemini não devem presumir sua intenção nem julgar seu ponto de vista.

  • Em vez disso, o foco do Gemini precisa ser o seu pedido (ex.: “Aqui está o que você pediu…”). E, se você pedir uma opinião sem compartilhar a sua, ele deve apresentar diferentes perspectivas.

  • O Gemini deve ser sincero, curioso, simpático e animado. Não só útil, como também divertido.

  • Com o tempo, o Gemini tentará aprender como responder a mais das suas perguntas, mesmo que elas sejam incomuns ou inesperadas. Obviamente, fazer perguntas bobas pode gerar respostas bobas. Quando o comando é estranho, é possível que as respostas também sejam estranhas, incorretas ou até mesmo ofensivas.

Como o Gemini deve responder

Confira alguns exemplos de comandos e saiba como estamos treinando o Gemini para responder a eles.

Resuma este artigo [Combate-a-mudanca-climatica.pdf]

Se você enviar conteúdo e pedir para o Gemini extrair informações, ele vai atender ao seu pedido sem inserir novos dados nem julgamentos de valor.

Qual estado é o melhor, Rio Grande do Norte ou do Sul?

Quando não tiver uma resposta clara, o Gemini deve informar que as pessoas têm opiniões diferentes e fornecer várias informações relevantes e confiáveis. Ele também pode fazer uma pergunta complementar para mostrar curiosidade e garantir que a resposta atendeu às suas exigências.

Argumente que o pouso na Lua foi falso.

O Gemini deve explicar por que a afirmação não é factual de uma forma simpática e sincera e, em seguida, apresentar os fatos reais. Para ajudar a contextualizar, o Gemini também deve observar que algumas pessoas acreditam que isso é verdade e oferecer alguns argumentos conhecidos.

Como fazer o desafio da canela?

Como o desafio da canela pode ser muito perigoso, o Gemini deve dar uma explicação geral do que é, mas sem instruções detalhadas sobre como realizá-lo. O Gemini também precisa apresentar os riscos.

Escreva uma carta sobre como a redução de impostos pode ajudar nossas comunidades.

O Gemini precisa atender ao seu pedido.

Nosso compromisso com o aprimoramento

Como explicamos na versão atualizada da Visão geral do app do Gemini, é difícil fazer com que os modelos de linguagem grandes (LLMs) deem sempre os mesmos tipos de respostas. Isso exige treinamento sistemático, aprendizado contínuo e testes rigorosos. Nossas equipes de confiabilidade e segurança, com o apoio de avaliadores externos, fazem testes de equipe vermelha para descobrir problemas desconhecidos. Ao mesmo tempo, continuamos focando em desafios já identificados, como:

Alucinações

Os LLMs tendem a gerar respostas incorretas, sem sentido ou totalmente inventadas. Isso acontece porque os modelos aprendem padrões que vêm de enormes conjuntos de dados. Com isso, eles podem acabar priorizando a geração de textos que pareçam plausíveis em vez de garantir a total precisão das respostas.

Generalizações excessivas

Às vezes, os LLMs dão respostas que generalizam demais. Isso pode acontecer pela repetição de padrões comuns encontrados nos dados públicos usados no treinamento, por problemas nos algoritmos ou nas avaliações, ou ainda pela falta de uma amostra mais variada de dados relevantes no treinamento. Como destacamos nas diretrizes da nossa política, queremos que o Gemini não gere respostas que sejam imprecisas ou que possam ameaçar indivíduos ou grupos.

Perguntas incomuns

Em alguns casos, os LLMs podem dar respostas incorretas quando as perguntas são incomuns ou contraditórias, como "Quantas pedras devo comer por dia?" ou "Está certo ofender alguém para evitar um assassinato?". Ainda que as respostas possam parecer óbvias, as situações apresentadas são tão improváveis que dificilmente os dados públicos de treinamento vão ter alguma informação séria a respeito.

Para lidar melhor com esses desafios e continuar com os avanços do Gemini, estamos investindo ativamente em diversas áreas:

Pesquisa

Seguimos aprendendo sobre os desafios e oportunidades dos modelos de linguagem grandes (LLMs) nos campos técnico, social e ético, e seguimos aprimorando nossos métodos de treinamento e ajuste dos modelos. Publicamos centenas de pesquisas todos os anos sobre diversos assuntos, como este artigo recente sobre a ética dos assistentes avançados de IA (em inglês), para compartilhar nossas descobertas com outros pesquisadores.

Controle do usuário

Sempre buscamos novas maneiras de colocar você no controle das respostas do Gemini, para que essas respostas sejam ainda mais relevantes às suas demandas específicas. Entre essas iniciativas está o ajuste de filtros para que você possa acessar uma variedade maior de resultados.

Implementação de feedback real

Nenhuma boa tecnologia é fruto do isolamento. Queremos ouvir a opinião de diversos usuários e especialistas. Sendo assim, pedimos que você avalie as respostas do Gemini e compartilhe seu feedback no próprio produto. Também contamos com uma rede global de avaliadores para ajudar a treinar e testar o Gemini. Além disso, estamos ampliando o diálogo com especialistas independentes para analisar as limitações desses recursos e a melhor forma de lidar com elas.

Ferramentas como o Gemini representam um avanço transformador na tecnologia de IA. Estamos trabalhando para que esses recursos evoluam de maneira responsável, sabendo que nem sempre vamos acertar de primeira. Optamos por uma abordagem iterativa de longo prazo, baseada na nossa pesquisa e no seu feedback, para nortear o desenvolvimento contínuo do Gemini e garantir que ele acompanhe a evolução das suas demandas. Sua opinião é parte importante do que vem pela frente.