Pular para o conteúdo
ENSAIO / IA

Google I/O Mostrou o Novo Tabuleiro da Guerra da IA

Resumo do que mudou em IA esta semana: Gemini 3.5 Flash, agente pessoal Gemini Spark, multimodal Omni, óculos inteligentes Samsung+Qualcomm, mais GPT-5.5-Cyber, Claude para Small Business e Microsoft Build na próxima semana. Filtrado pra quem constrói, não pra quem só observa.

Ontem (19/05) o Google I/O 2026 tomou as manchetes. Mas se você leu só os títulos, perdeu o que importa: a corrida saiu definitivamente da arena de "qual modelo é mais inteligente" e migrou pra "qual agente faz mais coisa por você". Esse é o post que eu queria ter recebido hoje cedo — só o que importa, filtrado por alguém que constrói com IA todo dia.

Lançamentos de IA do Google I/O 2026 com agentes, multimodalidade e óculos inteligentesLançamentos de IA do Google I/O 2026 com agentes, multimodalidade e óculos inteligentes

TL;DR do dia

  • Gemini 3.5 Flash ficou GA com preço agressivo ($1,50 / $9 por 1M tokens) e 4× mais rápido que rivais frontier.
  • Gemini Spark virou agente pessoal real — age via MCP em Gmail, Docs, Workspace e expande pra terceiros no verão.
  • Gemini Omni aceita imagem, áudio, vídeo e texto na entrada — e devolve vídeo editável grounded no mundo real.
  • Óculos inteligentes (Samsung + Qualcomm, design Gentle Monster e Warby Parker) chegam no outono.
  • Daily Brief automatizado: digest diário de Gmail + Calendar + Tasks pra assinantes pagos.
  • OpenAI, Anthropic e Microsoft já mexeram peças nas últimas duas semanas — vou conectar os pontos no fim.

1. Gemini 3.5 Flash — preço novo, jogo novo

O Flash 3.5 não é só "mais um modelo barato". A combinação que o Google entregou é a primeira vez que vejo inteligência de fronteira + agentic + multimodal num único SKU barato ao mesmo tempo:

  • 4× mais output tokens por segundo que outros frontier models (eles citam isso direto na keynote)
  • Supera Gemini 3.1 Pro em benchmarks de coding, agentic e multimodal
  • $1,50 input / $9 output por 1M tokens, com janela de 1M de contexto
  • Disponível agora geral, sem fila

Por que isso importa: o ponto de inflexão do custo. Quando inteligência boa fica abaixo de $10 por milhão de tokens, aplicações que antes não fechavam ROI passam a fechar. SaaS pequeno que rodava em GPT-4o por margem apertada agora consegue oferecer feature de IA como gratuita — e ainda lucra.

E o Gemini 3.5 Pro entra em testes agora, lançamento geral no mês que vem.

2. Gemini Spark — o agente que o Google estava devendo

Spark é o que a galera vinha pedindo desde o lançamento do Operator da OpenAI: um agente que faz coisas pelo Workspace inteiro.

Agente de IA Gemini Spark conectando Gmail, Docs, Calendar e apps via MCPAgente de IA Gemini Spark conectando Gmail, Docs, Calendar e apps via MCP

Algumas coisas concretas que ele faz hoje:

  • Lê seu Gmail, identifica reuniões pendentes e responde rascunhos com contexto cruzado
  • Cria documentos no Docs com base em conversas em outras aplicações
  • Conecta com ferramentas terceiras via MCP (Model Context Protocol) começando no verão — esse é o detalhe que diferencia: o agente sai do jardim murado

Disponível pra AI Ultra subscribers nos EUA na semana que vem. Brasil entra no segundo lote.

$ gemini-spark "agendar 1:1 com a equipe pra próxima terça,
  baseado nos OKRs do Q2 que estão no Doc 'planejamento-2026'"

Por que isso importa: o Google finalmente fechou o gap de "assistente passivo → agente proativo". Pra quem usa Workspace pra trabalhar, isso muda o jogo. Pra quem não usa, a pressão pra adotar acabou de subir.

3. Gemini Omni — multimodal nativo de verdade

Omni é a nova família de modelos que aceita imagem + áudio + vídeo + texto na entrada e devolve vídeo grounded no mundo real, editável.

Gemini Omni unindo imagem, áudio, vídeo e texto para gerar vídeo editável com IAGemini Omni unindo imagem, áudio, vídeo e texto para gerar vídeo editável com IA

Detalhes que valem destacar:

  • Saída em vídeo não é só "gerar vídeo" tipo Veo. É vídeo grounded em conhecimento factual, então pode ser usado pra explicar conceitos, simular cenários, criar storyboards executáveis
  • Edição pós-geração funciona via prompt textual (sem timeline tradicional)
  • Combina raciocínio do Gemini base com pipeline de criação

Por que isso importa: criadores de conteúdo, agências e edtechs que ainda mexiam com 3-4 ferramentas diferentes pra produzir um vídeo educativo agora têm um pipeline único. Custo de produção cai. Volume de output sobe. E a barreira pra concorrer com canais grandes vai cair drástico no segundo semestre.

4. Óculos inteligentes — Samsung + Qualcomm fabricam, design vem de Gentle Monster e Warby Parker

Hardware AR finalmente saindo do protótipo:

  • Áudio glasses chegam no outono de 2026 (não confirmaram mês exato)
  • Fabricação: Samsung + Qualcomm (combo importante — Qualcomm garante chip dedicado de IA on-device)
  • Design: Gentle Monster e Warby Parker (o Google está admitindo que estética é tudo nesse mercado)
  • Gemini roda parcialmente on-device pra latência baixa em conversação

Comparação inevitável com o Ray-Ban Meta: o Google está chegando 2 anos depois, mas com integração nativa ao Workspace + Spark, o que o Ray-Ban não tem.

5. Daily Brief — onde a IA invade o dia a dia silenciosamente

Daily Brief é um digest personalizado do seu dia que combina Gmail + Calendar + Tasks, gerado de manhã.

  • Já disponível hoje pra Google AI Plus, Pro e Ultra (US first)
  • Mostra reuniões, prioridades, blocos de tempo livre, threads importantes
  • Você pode pedir pro Spark agir em qualquer item do brief direto (é onde Spark + Brief se conectam)

Por que isso importa: isso é o "AI chega ao dia-a-dia sem você notar". Não é hype, não é demo. É o tipo de feature que você liga uma vez e não desliga mais. Newsletter de IA tradicional vai começar a perder espaço pra isso — e é exatamente por isso que estou criando o Pro com curadoria humana via WhatsApp/Telegram, no canal onde você realmente lê.

6. O contexto: o que OpenAI, Anthropic e Microsoft estão respondendo

Pra entender por que o Google empilhou tantas releases num único dia, vale olhar as 3 semanas anteriores:

OpenAI (11/05):

  • Lançou OpenAI Deployment Co. — empresa de consultoria pra ajudar grandes a deployar IA
  • Adquiriu Tomoro (consultoria aplicada de IA)
  • Liberou GPT-5.5-Cyber pra parceiros europeus (governos, autoridades cyber, instituições UE)

Anthropic (04 e 14/05):

  • Joint venture enterprise com Blackstone, Hellman & Friedman, Goldman Sachs
  • Claude for Small Business dentro do Claude Cowork
  • Curso gratuito "AI Fluency for Small Business" com PayPal
  • PwC anunciou deployment de Claude pra clientes enterprise
  • Parceria de US$ 200M com Gates Foundation (saúde, biossegurança, governança)

Microsoft Build 2026 (02-03/06, semana que vem):

  • Já confirmou foco em agentic workflows e produção
  • Vai expandir créditos pra startups + acesso a engenheiros de IA dedicados
  • Satya Nadella faz keynote

Padrão claro: as 4 big tech estão se posicionando em camadas diferentes. Google quer dominar o consumidor (Workspace + Glasses + Spark). OpenAI quer ser o "AWS de IA enterprise" (consultoria + APIs). Anthropic está focando em verticais reguladas (saúde, governo, finance) e SMB. Microsoft continua sendo a casa onde tudo isso vira workflow corporativo.

O que isso muda pra quem constrói

Três decisões práticas que eu reavaliei hoje cedo:

1. Custo de IA caiu de novo, mas a margem de diferenciação subiu. Se você está pagando $30 por 1M tokens pra ter "GPT-5 quality", vale testar Gemini 3.5 Flash pra os 80% das tarefas que não precisam disso. Os 20% que precisam, mantém em GPT-5 ou Claude Opus.

2. Agentes via MCP não são mais novidade — são commodity. Se seu produto ainda vende "automação inteligente" como diferencial, em 6 meses todo Workspace user vai ter Spark fazendo o mesmo de graça. Reposicione antes que o mercado faça por você.

3. Multimodal vídeo é a próxima onda de SaaS. Quem está construindo edtech, marketing tool ou agência usando Omni-style vai ter 12 meses de vantagem injusta. Acelera quem ainda está na fila do Veo.

E o Brasil nessa história?

Atraso de 1-2 lotes pra acesso (Spark, Omni, Daily Brief). Mas o Gemini 3.5 Flash já está disponível com mesma precificação aqui — então quem desenvolve produto pode integrar hoje. A diferença vai pesar mais em quem vende serviço de IA pra empresas: cliente já chega perguntando "isso aqui não dá pra fazer com o Spark de graça?".


Curtiu esse formato? Eu queria ter recebido isso hoje cedo no celular. É exatamente o que tô preparando no Pro — curadoria diária no WhatsApp ou Telegram, 1-2 mensagens por dia úteis, R$ 9,90/mês. Quem entra agora no pré-lançamento ganha o primeiro mês de cortesia.

Pra atualizações sem filtro, o feed ao vivo continua em /noticias.

DO CONHECIMENTO À APLICAÇÃO

A próxima ideia pode mudar a sua operação.

Vamos conectar o que você está aprendendo a um problema real do seu negócio ou ao serviço que você quer construir.