O Gemini agrupa funções com lógicas bem distintas. Algumas operam por voz, outras rodam de forma autônoma em horários definidos, e algumas constroem aplicativos a partir de uma frase. O que segue é uma descrição funcional de cada recurso, com cenários concretos e informação de acesso por plano.

01 Gemini Live: voz que age durante a conversa

O Gemini Live é o modo de conversa contínua por voz. Diferente dos assistentes de voz convencionais, ele aceita interrupções no meio de uma resposta sem perder o contexto, e desde maio de 2026 passou a executar ações enquanto o usuário fala.

Caso de uso documentado: o usuário compartilha a tela do celular e pede ao Gemini que analise em tempo real o conteúdo exibido. Funciona para depurar um aplicativo, entender um documento ou comparar produtos em sites diferentes enquanto conversa por voz. O assistente também exibe mapas e cards climáticos durante a conversa, sem interromper o áudio.

Gratuito Android e iOS

02 Deep Research: relatório construído por um agente

O Deep Research executa pesquisa de forma autônoma: recebe um tema, consulta múltiplas fontes, sintetiza o material e entrega um relatório de várias páginas. O usuário não acompanha cada etapa da busca.

Desde maio de 2025, é possível incluir arquivos próprios como fonte adicional. Isso muda o escopo do recurso: um relatório interno pode ser combinado com dados externos para comparação com benchmarks do setor. O resultado pode ser exportado ao Google Docs, convertido em quiz, infográfico ou Audio Overview diretamente no Canvas.

Gratuito (limitado)AI Pro (expandido)

03 Canvas: de texto a protótipo em uma conversa

O Canvas é um painel lateral que o Gemini usa para gerar e revisar documentos, código e aplicativos separado do chat. O usuário pode solicitar alterações em um trecho específico sem regenerar o conteúdo inteiro.

No modo de programação assistida, um aplicativo funcional pode ser criado com poucos prompts. O aplicativo salva dados entre sessões, pode ser compartilhado com outros usuários e aceita atalho na tela inicial do celular. Relatórios do Deep Research podem ser convertidos diretamente em quizzes, infográficos, páginas web ou Audio Overviews dentro do Canvas.

Gratuito Todos os idiomas suportados

04 Gems: contexto persistente por especialidade

Os Gems são versões configuradas do Gemini que mantêm instruções, função e arquivos de referência entre sessões. O usuário define uma vez, e o Gem aplica o mesmo perfil em todas as conversas futuras, sem precisar repetir o contexto.

Um Gem criado para revisar textos jurídicos aplica formatação e vocabulário específico sempre que acionado. Gems também podem ser compartilhados com outras pessoas, o que os torna reutilizáveis em equipes. Gems predefinidos cobrem casos como planejamento de refeições, orientação profissional e elaboração de código.

Gratuito (Gems predefinidos)AI Pro (criação e compartilhamento)

LER  O Google segue os passos da Apple e lança uma IA que protege seus dados pessoais

05 Veo 3 e Gemini Omni: geração e edição de vídeo

O Veo 3 gera clipes de 8 segundos com áudio a partir de uma descrição em texto. O modelo gera diálogos de personagens, música de fundo e efeitos sonoros em uma única saída.

O Gemini Omni, lançado em maio de 2026, complementa o Veo 3 com foco em edição e remix: o usuário combina texto, fotos e vídeos existentes e pode criar um avatar de IA com aparência e voz personalizadas. O Gemini Omni está disponível para todos os assinantes de planos com IA; o Veo 3 exige AI Ultra.

Gemini Omni: AI Pro e acimaVeo 3: AI Ultra

06 Imagen 4: imagens com suporte real a tipografia

O Imagen 4 é o modelo de geração de imagem a partir de texto disponível no Gemini desde maio de 2025. O avanço mais relevante em relação ao Imagen 3 é o suporte aprimorado a texto dentro da imagem: pôsteres, convites, banners e capas com tipografia legível e posicionada conforme instrução.

Restrições documentadas pelo Google: não gera imagens fotorrealistas de pessoas identificáveis nem de menores de idade. A geração de imagens com pessoas está disponível a partir do plano AI Pro.

Gratuito (sem pessoas)AI Pro (com pessoas)

07 Workspace: Gemini embutido por aplicativo

O Gemini está integrado a seis produtos do Google Workspace com funções específicas em cada um.

Gmail: redigir e-mails, resumir conversas, identificar prioridades. Docs: criar documentos a partir de um briefing, revisar estilo e tom por instrução. Sheets: montar ou editar planilhas em linguagem natural, preencher colunas com base em padrões. Slides: gerar apresentações a partir de um resumo, sugerir layouts. Meet: transcrever reuniões em tempo real, gerar resumos com pontos de ação. Drive: buscar e resumir arquivos por tema ou conteúdo.

O painel lateral do Gemini aparece dentro de cada aplicativo. Usuários dos planos Google Workspace Business têm acesso sem configuração adicional.

Workspace Business e acima

08 Audio Overviews: documentos em formato de podcast

O Audio Overviews converte documentos, slides e relatórios em episódios narrados por dois apresentadores de IA com perspectivas diferentes sobre o mesmo material. Opera com a mesma tecnologia dos Resumos em Áudio do NotebookLM e está disponível em mais de 45 idiomas.

O recurso pode ser acionado diretamente no Canvas a partir de um relatório do Deep Research, transformando uma pesquisa densa em conteúdo navegável por áudio. Útil para consumir material durante atividades que não exigem leitura ativa.

Gratuito Via Canvas

09 Ações programadas: automações por linguagem natural

As ações programadas permitem que o Gemini execute tarefas em horários definidos, sem intervenção do usuário no momento da execução. O usuário instrui em linguagem natural: “todo dia às 8h, me manda um resumo dos e-mails não lidos”. O sistema executa de forma recorrente.

LER  Claude 4 vale a pena? Confira prós, contras e novidades

Casos documentados pelo Google: busca semanal por eventos musicais locais; transcrição de um conteúdo salvo na manhã seguinte ao registro; resumo diário de agenda e e-mails prioritários. O recurso usa extensões do Gmail, Agenda e Drive para coletar e processar as informações antes de entregar o resultado.

AI ProAI Ultra

10 Gemini Spark: agente autônomo no computador

O Gemini Spark opera de forma autônoma no macOS: organiza pastas, acessa arquivos locais, executa fluxos no Workspace e age em nome do usuário sem esperar instrução a cada etapa. É a diferença estrutural em relação às ações programadas, que operam apenas com dados do Workspace na nuvem.

Lançado em maio de 2026 para testadores e em junho de 2026 para assinantes do AI Ultra no macOS, o Spark está disponível no app nativo do Gemini para Mac (gemini.google/mac), em inglês, nos países com suporte. O acesso a partir do app web ou móvel para executar tarefas no Mac estava previsto para ser expandido nas notas da versão de junho de 2026.

AI Ultra • macOS • Inglês

Resumo de acesso por plano

PlanoO que inclui
GratuitoGemini Live, Canvas, Gems predefinidos, Audio Overviews, Deep Research com limites, Imagen 4 sem pessoas, integração básica com Workspace
Google AI ProModelo Pro, Deep Research expandido, janela de 1 milhão de tokens, Imagen 4 com pessoas, ações programadas, Gemini Omni
Google AI Ultra
(a partir de US$ 100/mês)
Veo 3, Gemini Spark, todos os modelos, 20 TB de armazenamento, YouTube Premium, acesso antecipado a lançamentos experimentais

O que esse conjunto revela sobre o produto

O Gemini atual tem uma estrutura de camadas mais clara do que parece. No plano gratuito estão disponíveis mais funções do que a maioria dos usuários descobre: Canvas, Audio Overviews, Gemini Live com compartilhamento de tela, Gems predefinidos e Deep Research com limites de uso. A maior parte das 10 funções deste artigo opera sem nenhuma assinatura.

As funções que mais se distanciam do chatbot convencional, como as ações programadas, o Veo 3 e o Gemini Spark, estão por trás dos planos pagos. O Spark representa a mudança estrutural mais clara do produto no momento: é a passagem de um assistente que responde perguntas para um agente que executa tarefas de forma autônoma no dispositivo, sem aguardar instrução a cada etapa.

Por enquanto, o Spark está restrito a assinantes do AI Ultra no macOS em inglês. A expansão para outros idiomas e plataformas não tem data confirmada nas notas de versão disponíveis até o momento desta publicação.

Para quem usa o Gemini apenas como caixa de texto, o plano gratuito já entrega mais do que aparenta. A diferença entre o que está disponível e o que o usuário comum acessa é, antes de qualquer assinatura, uma questão de configuração.

Deixe um comentário