tutorial · 07 de abril de 2026 · 14:01
Claude Code open source com Ollama: setup local
O vídeo mostra como rodar a versão open source do Claude Code usando Ollama com modelos locais para gastar zero tokens. O autor demonstra a configuração no projeto JVF, alternando entre o modelo local e uma API paga. A recomendação final é usar o setup local em projetos não críticos.

O passo a passo
01Pré-requisitos e instalação do Ollama
O setup local exige máquina com GPU e CPU à altura. O autor cita uma máquina com 32 GPUs e 14 CPUs. O fluxo é instalar o Ollama, rodar ollama serve, baixar um modelo (no vídeo, o de 1.5B) e instalar o Open Cloud via npm.
02Modelo configurado por variável de ambiente
Na versão mostrada, o barraProvider da interface não funciona para escolher o modelo. A solução apontada é exportar as variáveis de ambiente com o modelo desejado antes de abrir o Open Cloud.
03Demo no projeto JVF
O autor abre o Open Cloud dentro do JVF, o portal de automação de vídeos do YouTube. Ele pede ao modelo um overview do projeto e a arquitetura (FastAPI), e as respostas chegam direto pelo Ollama local.
04Modo IA conectado ao Ollama local
No portal existe um modo IA nas trends do momento e nos vídeos recentes. O autor aponta esse modo para o Ollama local e usa o modelo de 1.5B para perguntar quais vídeos se adaptam ao nicho e montar tabelas por relevância.
05Troca entre Ollama local e API paga
Quando o autor alterna do Ollama para a API paga Minimax M2.7, o sistema libera a RAM automaticamente. As requisições passam a ir contra o endpoint da API paga, e ele pede listas dos vídeos mais vistos do canal.
06Cuidados de segurança com a versão open source
O autor reforça que o Open Cloud é um fork do código que vazou e recomenda não usar em projetos críticos. No JVF ele só expõe a API do YouTube e mantém o uso restrito a testes não sensíveis.
Nas palavras dele
“a gente utilizar o Claude Code mais o lama mais o Queen, que tem um modelo bem bacana que é rápido e é gratuito”
ouvir em 0:30
“você pode ir no Rin Face e verificar os top modelos, quais são os modelos melhores para desenvolvimento, para gráfico, essas coisas”
ouvir em 12:30
“tome cuidado, não utilize em projetos críticos. É um open source e você sabe que a internet é tipo um Medmax”
ouvir em 13:30
Perguntas
Como rodar o Claude Code open source localmente?
Instale o Ollama, suba o servidor com ollama serve, baixe um modelo e instale o Open Cloud via npm. O modelo é definido por variável de ambiente, porque o barraProvider da interface não funciona na versão usada.
Quais são os pré-requisitos de hardware?
É preciso de máquina com GPU e CPU suficientes. O autor cita uma máquina com 32 GPUs e 14 CPUs como exemplo do que ele usa para rodar o Ollama local.
Dá para usar em projetos críticos?
O autor recomenda não usar em projetos críticos, porque o Open Cloud é um fork do código que vazou. No projeto dele, só a API do YouTube fica exposta.
O modelo local substitui o Claude pago em tudo?
Não. O autor deixa o modelo pago para tarefas complexas e usa o Ollama local em projetinhos mais simples. Para se aproximar de Opus ou GPT em tarefas pesadas, a máquina local não dá conta.
Quer ir além do vídeo?
Continue por aqui
Este resumo foi escrito a partir da transcrição do vídeo. As citações são literais. Para o conteúdo completo, assista no YouTube.