Pular para o conteúdo
leonardobissoli.com
Todos os vídeos

tutorial · 07 de abril de 2026 · 14:01

Claude Code open source com Ollama: setup local

O vídeo mostra como rodar a versão open source do Claude Code usando Ollama com modelos locais para gastar zero tokens. O autor demonstra a configuração no projeto JVF, alternando entre o modelo local e uma API paga. A recomendação final é usar o setup local em projetos não críticos.

Claude Code open source com Ollama: setup local

O passo a passo

  1. 01Pré-requisitos e instalação do Ollama

    O setup local exige máquina com GPU e CPU à altura. O autor cita uma máquina com 32 GPUs e 14 CPUs. O fluxo é instalar o Ollama, rodar ollama serve, baixar um modelo (no vídeo, o de 1.5B) e instalar o Open Cloud via npm.

  2. 02Modelo configurado por variável de ambiente

    Na versão mostrada, o barraProvider da interface não funciona para escolher o modelo. A solução apontada é exportar as variáveis de ambiente com o modelo desejado antes de abrir o Open Cloud.

  3. 03Demo no projeto JVF

    O autor abre o Open Cloud dentro do JVF, o portal de automação de vídeos do YouTube. Ele pede ao modelo um overview do projeto e a arquitetura (FastAPI), e as respostas chegam direto pelo Ollama local.

  4. 04Modo IA conectado ao Ollama local

    No portal existe um modo IA nas trends do momento e nos vídeos recentes. O autor aponta esse modo para o Ollama local e usa o modelo de 1.5B para perguntar quais vídeos se adaptam ao nicho e montar tabelas por relevância.

  5. 05Troca entre Ollama local e API paga

    Quando o autor alterna do Ollama para a API paga Minimax M2.7, o sistema libera a RAM automaticamente. As requisições passam a ir contra o endpoint da API paga, e ele pede listas dos vídeos mais vistos do canal.

  6. 06Cuidados de segurança com a versão open source

    O autor reforça que o Open Cloud é um fork do código que vazou e recomenda não usar em projetos críticos. No JVF ele só expõe a API do YouTube e mantém o uso restrito a testes não sensíveis.

Nas palavras dele

“a gente utilizar o Claude Code mais o lama mais o Queen, que tem um modelo bem bacana que é rápido e é gratuito”

ouvir em 0:30

“você pode ir no Rin Face e verificar os top modelos, quais são os modelos melhores para desenvolvimento, para gráfico, essas coisas”

ouvir em 12:30

“tome cuidado, não utilize em projetos críticos. É um open source e você sabe que a internet é tipo um Medmax”

ouvir em 13:30

Perguntas

Como rodar o Claude Code open source localmente?

Instale o Ollama, suba o servidor com ollama serve, baixe um modelo e instale o Open Cloud via npm. O modelo é definido por variável de ambiente, porque o barraProvider da interface não funciona na versão usada.

Quais são os pré-requisitos de hardware?

É preciso de máquina com GPU e CPU suficientes. O autor cita uma máquina com 32 GPUs e 14 CPUs como exemplo do que ele usa para rodar o Ollama local.

Dá para usar em projetos críticos?

O autor recomenda não usar em projetos críticos, porque o Open Cloud é um fork do código que vazou. No projeto dele, só a API do YouTube fica exposta.

O modelo local substitui o Claude pago em tudo?

Não. O autor deixa o modelo pago para tarefas complexas e usa o Ollama local em projetinhos mais simples. Para se aproximar de Opus ou GPT em tarefas pesadas, a máquina local não dá conta.

Quer ir além do vídeo?

Continue por aqui

Este resumo foi escrito a partir da transcrição do vídeo. As citações são literais. Para o conteúdo completo, assista no YouTube.