Pular para o conteúdo
leonardobissoli.com
Todos os vídeos

análise · 21 de novembro de 2025 · 9:50

Gemini 3 nos benchmarks e na prática com o Antigravity

O autor testa o Gemini 3 em benchmarks de codificação, com pontuações acima de GPT-5, Grok 4 e Sonnet 4.5, e mostra a IDE Antigravity da Google criando landing pages em segundos. Na análise de imagem, o Gemini 3 (no Perplexity) e o GPT-5 (no N8N, via e-mail) recebem o mesmo prompt, e o autor diz que o Gemini 3 gerou resposta de melhor qualidade.

Gemini 3 nos benchmarks e na prática com o Antigravity

O que muda na prática

  1. 01Pontuação no leaderboard de codificação

    No leaderboard mostrado, o Gemini 3 fica entre 30 e 35% e o Deep Think em preview bate 45%, à frente de GPT-5 e Grok 4 (20%) e de Sonnet 4.5 (15%).

  2. 02Teste da vending machine

    Em cinco execuções, o Gemini 3 gerou renda de $5.000, em primeiro lugar no scoreboard, seguido por Claude Sonnet; GPT-5 aparece mais abaixo.

  3. 03Google AI Studio com deploy

    O estúdio tem integração com GitHub e deploy via Google Cloud, colocando a aplicação no ar em minutos.

  4. 04IDE Antigravity em ação

    A partir de um prompt, a IDE cria o diretório, gera tarefas de planejamento, implementação e verificação, e importa as configurações do Visual Studio Code na instalação.

  5. 05Landing pages em segundos

    Com um prompt de loja de roupas, o Antigravity gerou landing page com categorias, camisas, bermudas e calçados. Em outro teste, o autor pediu a página do curso de formação em IA e o resultado também veio rápido.

  6. 06Thinking no N8N e OpenRouter

    No N8N, o Gemini 3 aparece disponível, mas a opção de thinking está fixa em high e não pode ser alterada pela interface. A mudança precisa ser feita via Python, JavaScript ou REST.

  7. 07Análise de imagem comparativa

    Com o mesmo prompt, o Gemini 3 (no Perplexity) devolveu tabela de análise, gravidade, estimativa de dano e resumo técnico. O GPT-5 enviou por e-mail via N8N um relatório com arranhões, dano 6 de 10 e deformação no para-choque; em teste direto, devolveu cinco itens e um pequeno resumo. O autor diz que o Gemini gerou resposta de melhor qualidade.

Nas palavras dele

“Grock 4 e o GPT5 tá aqui embaixo, 20%”

ouvir em 0:00

“E aí você já faz o deploy e já coloca para rodar a aplicação em questões de minutos”

ouvir em 2:34

“O padrão, por enquanto, é high”

ouvir em 6:31

“o Gemini ficou bem superior nos testes”

ouvir em 9:50

Perguntas

O Gemini 3 superou quais modelos no benchmark de codificação?

No leaderboard mostrado, o Gemini 3 ficou entre 30 e 35% e o Deep Think em preview bateu 45%, acima de GPT-5 (20%), Grok 4 e Sonnet 4.5 (15%).

A IDE Antigravity importa configurações do Visual Studio Code?

Sim, segundo o autor, na instalação a IDE permite importar todas as configurações do Visual Studio Code.

Dá para mudar o thinking do Gemini 3 no N8N?

Pela interface não. O padrão é high e a alteração precisa ser feita via Python, JavaScript ou REST.

Como o autor comparou a análise de imagem entre Gemini 3 e GPT-5?

Ele usou o mesmo prompt nos dois. O Gemini 3 foi testado no Perplexity e o GPT-5 devolveu a análise por e-mail via N8N. Em um segundo teste direto, o GPT-5 devolveu cinco itens e um pequeno resumo.

Quer ir além do vídeo?

Continue por aqui

Este resumo foi escrito a partir da transcrição do vídeo. As citações são literais. Para o conteúdo completo, assista no YouTube.