análise · 21 de novembro de 2025 · 9:50
Gemini 3 nos benchmarks e na prática com o Antigravity
O autor testa o Gemini 3 em benchmarks de codificação, com pontuações acima de GPT-5, Grok 4 e Sonnet 4.5, e mostra a IDE Antigravity da Google criando landing pages em segundos. Na análise de imagem, o Gemini 3 (no Perplexity) e o GPT-5 (no N8N, via e-mail) recebem o mesmo prompt, e o autor diz que o Gemini 3 gerou resposta de melhor qualidade.

O que muda na prática
01Pontuação no leaderboard de codificação
No leaderboard mostrado, o Gemini 3 fica entre 30 e 35% e o Deep Think em preview bate 45%, à frente de GPT-5 e Grok 4 (20%) e de Sonnet 4.5 (15%).
02Teste da vending machine
Em cinco execuções, o Gemini 3 gerou renda de $5.000, em primeiro lugar no scoreboard, seguido por Claude Sonnet; GPT-5 aparece mais abaixo.
03Google AI Studio com deploy
O estúdio tem integração com GitHub e deploy via Google Cloud, colocando a aplicação no ar em minutos.
04IDE Antigravity em ação
A partir de um prompt, a IDE cria o diretório, gera tarefas de planejamento, implementação e verificação, e importa as configurações do Visual Studio Code na instalação.
05Landing pages em segundos
Com um prompt de loja de roupas, o Antigravity gerou landing page com categorias, camisas, bermudas e calçados. Em outro teste, o autor pediu a página do curso de formação em IA e o resultado também veio rápido.
06Thinking no N8N e OpenRouter
No N8N, o Gemini 3 aparece disponível, mas a opção de thinking está fixa em high e não pode ser alterada pela interface. A mudança precisa ser feita via Python, JavaScript ou REST.
07Análise de imagem comparativa
Com o mesmo prompt, o Gemini 3 (no Perplexity) devolveu tabela de análise, gravidade, estimativa de dano e resumo técnico. O GPT-5 enviou por e-mail via N8N um relatório com arranhões, dano 6 de 10 e deformação no para-choque; em teste direto, devolveu cinco itens e um pequeno resumo. O autor diz que o Gemini gerou resposta de melhor qualidade.
Nas palavras dele
“Grock 4 e o GPT5 tá aqui embaixo, 20%”
ouvir em 0:00
“E aí você já faz o deploy e já coloca para rodar a aplicação em questões de minutos”
ouvir em 2:34
“O padrão, por enquanto, é high”
ouvir em 6:31
“o Gemini ficou bem superior nos testes”
ouvir em 9:50
Perguntas
O Gemini 3 superou quais modelos no benchmark de codificação?
No leaderboard mostrado, o Gemini 3 ficou entre 30 e 35% e o Deep Think em preview bateu 45%, acima de GPT-5 (20%), Grok 4 e Sonnet 4.5 (15%).
A IDE Antigravity importa configurações do Visual Studio Code?
Sim, segundo o autor, na instalação a IDE permite importar todas as configurações do Visual Studio Code.
Dá para mudar o thinking do Gemini 3 no N8N?
Pela interface não. O padrão é high e a alteração precisa ser feita via Python, JavaScript ou REST.
Como o autor comparou a análise de imagem entre Gemini 3 e GPT-5?
Ele usou o mesmo prompt nos dois. O Gemini 3 foi testado no Perplexity e o GPT-5 devolveu a análise por e-mail via N8N. Em um segundo teste direto, o GPT-5 devolveu cinco itens e um pequeno resumo.
Quer ir além do vídeo?
Continue por aqui
Este resumo foi escrito a partir da transcrição do vídeo. As citações são literais. Para o conteúdo completo, assista no YouTube.