Ontem (19/05) o Google I/O 2026 tomou as manchetes. Mas se você leu só os títulos, perdeu o que importa: a corrida saiu definitivamente da arena de "qual modelo é mais inteligente" e migrou pra "qual agente faz mais coisa por você". Esse é o post que eu queria ter recebido hoje cedo — só o que importa, filtrado por alguém que constrói com IA todo dia.
Lançamentos de IA do Google I/O 2026 com agentes, multimodalidade e óculos inteligentes
TL;DR do dia
- Gemini 3.5 Flash ficou GA com preço agressivo ($1,50 / $9 por 1M tokens) e 4× mais rápido que rivais frontier.
- Gemini Spark virou agente pessoal real — age via MCP em Gmail, Docs, Workspace e expande pra terceiros no verão.
- Gemini Omni aceita imagem, áudio, vídeo e texto na entrada — e devolve vídeo editável grounded no mundo real.
- Óculos inteligentes (Samsung + Qualcomm, design Gentle Monster e Warby Parker) chegam no outono.
- Daily Brief automatizado: digest diário de Gmail + Calendar + Tasks pra assinantes pagos.
- OpenAI, Anthropic e Microsoft já mexeram peças nas últimas duas semanas — vou conectar os pontos no fim.
1. Gemini 3.5 Flash — preço novo, jogo novo
O Flash 3.5 não é só "mais um modelo barato". A combinação que o Google entregou é a primeira vez que vejo inteligência de fronteira + agentic + multimodal num único SKU barato ao mesmo tempo:
- 4× mais output tokens por segundo que outros frontier models (eles citam isso direto na keynote)
- Supera Gemini 3.1 Pro em benchmarks de coding, agentic e multimodal
- $1,50 input / $9 output por 1M tokens, com janela de 1M de contexto
- Disponível agora geral, sem fila
Por que isso importa: o ponto de inflexão do custo. Quando inteligência boa fica abaixo de $10 por milhão de tokens, aplicações que antes não fechavam ROI passam a fechar. SaaS pequeno que rodava em GPT-4o por margem apertada agora consegue oferecer feature de IA como gratuita — e ainda lucra.
E o Gemini 3.5 Pro entra em testes agora, lançamento geral no mês que vem.
2. Gemini Spark — o agente que o Google estava devendo
Spark é o que a galera vinha pedindo desde o lançamento do Operator da OpenAI: um agente que faz coisas pelo Workspace inteiro.
Agente de IA Gemini Spark conectando Gmail, Docs, Calendar e apps via MCP
Algumas coisas concretas que ele faz hoje:
- Lê seu Gmail, identifica reuniões pendentes e responde rascunhos com contexto cruzado
- Cria documentos no Docs com base em conversas em outras aplicações
- Conecta com ferramentas terceiras via MCP (Model Context Protocol) começando no verão — esse é o detalhe que diferencia: o agente sai do jardim murado
Disponível pra AI Ultra subscribers nos EUA na semana que vem. Brasil entra no segundo lote.
$ gemini-spark "agendar 1:1 com a equipe pra próxima terça,
baseado nos OKRs do Q2 que estão no Doc 'planejamento-2026'"
Por que isso importa: o Google finalmente fechou o gap de "assistente passivo → agente proativo". Pra quem usa Workspace pra trabalhar, isso muda o jogo. Pra quem não usa, a pressão pra adotar acabou de subir.
3. Gemini Omni — multimodal nativo de verdade
Omni é a nova família de modelos que aceita imagem + áudio + vídeo + texto na entrada e devolve vídeo grounded no mundo real, editável.
Gemini Omni unindo imagem, áudio, vídeo e texto para gerar vídeo editável com IA
Detalhes que valem destacar:
- Saída em vídeo não é só "gerar vídeo" tipo Veo. É vídeo grounded em conhecimento factual, então pode ser usado pra explicar conceitos, simular cenários, criar storyboards executáveis
- Edição pós-geração funciona via prompt textual (sem timeline tradicional)
- Combina raciocínio do Gemini base com pipeline de criação
Por que isso importa: criadores de conteúdo, agências e edtechs que ainda mexiam com 3-4 ferramentas diferentes pra produzir um vídeo educativo agora têm um pipeline único. Custo de produção cai. Volume de output sobe. E a barreira pra concorrer com canais grandes vai cair drástico no segundo semestre.
4. Óculos inteligentes — Samsung + Qualcomm fabricam, design vem de Gentle Monster e Warby Parker
Hardware AR finalmente saindo do protótipo:
- Áudio glasses chegam no outono de 2026 (não confirmaram mês exato)
- Fabricação: Samsung + Qualcomm (combo importante — Qualcomm garante chip dedicado de IA on-device)
- Design: Gentle Monster e Warby Parker (o Google está admitindo que estética é tudo nesse mercado)
- Gemini roda parcialmente on-device pra latência baixa em conversação
Comparação inevitável com o Ray-Ban Meta: o Google está chegando 2 anos depois, mas com integração nativa ao Workspace + Spark, o que o Ray-Ban não tem.
5. Daily Brief — onde a IA invade o dia a dia silenciosamente
Daily Brief é um digest personalizado do seu dia que combina Gmail + Calendar + Tasks, gerado de manhã.
- Já disponível hoje pra Google AI Plus, Pro e Ultra (US first)
- Mostra reuniões, prioridades, blocos de tempo livre, threads importantes
- Você pode pedir pro Spark agir em qualquer item do brief direto (é onde Spark + Brief se conectam)
Por que isso importa: isso é o "AI chega ao dia-a-dia sem você notar". Não é hype, não é demo. É o tipo de feature que você liga uma vez e não desliga mais. Newsletter de IA tradicional vai começar a perder espaço pra isso — e é exatamente por isso que estou criando o Pro com curadoria humana via WhatsApp/Telegram, no canal onde você realmente lê.
6. O contexto: o que OpenAI, Anthropic e Microsoft estão respondendo
Pra entender por que o Google empilhou tantas releases num único dia, vale olhar as 3 semanas anteriores:
OpenAI (11/05):
- Lançou OpenAI Deployment Co. — empresa de consultoria pra ajudar grandes a deployar IA
- Adquiriu Tomoro (consultoria aplicada de IA)
- Liberou GPT-5.5-Cyber pra parceiros europeus (governos, autoridades cyber, instituições UE)
Anthropic (04 e 14/05):
- Joint venture enterprise com Blackstone, Hellman & Friedman, Goldman Sachs
- Claude for Small Business dentro do Claude Cowork
- Curso gratuito "AI Fluency for Small Business" com PayPal
- PwC anunciou deployment de Claude pra clientes enterprise
- Parceria de US$ 200M com Gates Foundation (saúde, biossegurança, governança)
Microsoft Build 2026 (02-03/06, semana que vem):
- Já confirmou foco em agentic workflows e produção
- Vai expandir créditos pra startups + acesso a engenheiros de IA dedicados
- Satya Nadella faz keynote
Padrão claro: as 4 big tech estão se posicionando em camadas diferentes. Google quer dominar o consumidor (Workspace + Glasses + Spark). OpenAI quer ser o "AWS de IA enterprise" (consultoria + APIs). Anthropic está focando em verticais reguladas (saúde, governo, finance) e SMB. Microsoft continua sendo a casa onde tudo isso vira workflow corporativo.
O que isso muda pra quem constrói
Três decisões práticas que eu reavaliei hoje cedo:
1. Custo de IA caiu de novo, mas a margem de diferenciação subiu. Se você está pagando $30 por 1M tokens pra ter "GPT-5 quality", vale testar Gemini 3.5 Flash pra os 80% das tarefas que não precisam disso. Os 20% que precisam, mantém em GPT-5 ou Claude Opus.
2. Agentes via MCP não são mais novidade — são commodity. Se seu produto ainda vende "automação inteligente" como diferencial, em 6 meses todo Workspace user vai ter Spark fazendo o mesmo de graça. Reposicione antes que o mercado faça por você.
3. Multimodal vídeo é a próxima onda de SaaS. Quem está construindo edtech, marketing tool ou agência usando Omni-style vai ter 12 meses de vantagem injusta. Acelera quem ainda está na fila do Veo.
E o Brasil nessa história?
Atraso de 1-2 lotes pra acesso (Spark, Omni, Daily Brief). Mas o Gemini 3.5 Flash já está disponível com mesma precificação aqui — então quem desenvolve produto pode integrar hoje. A diferença vai pesar mais em quem vende serviço de IA pra empresas: cliente já chega perguntando "isso aqui não dá pra fazer com o Spark de graça?".
Curtiu esse formato? Eu queria ter recebido isso hoje cedo no celular. É exatamente o que tô preparando no Pro — curadoria diária no WhatsApp ou Telegram, 1-2 mensagens por dia úteis, R$ 9,90/mês. Quem entra agora no pré-lançamento ganha o primeiro mês de cortesia.
Pra atualizações sem filtro, o feed ao vivo continua em /noticias.