Como criar um Jarvis com IA: o assistente pessoal que roda na sua máquina

Para criar um Jarvis com IA, junte quatro peças: um canal para falar com ele (um bot próprio no Telegram), um modelo que responde (local no Ollama, com nuvem só quando precisa), uma memória que guarda o que você disse e um controle do que ele pode fazer e gastar. O openpcbot v3, projeto aberto do INEMA, funciona assim.

O que é um Jarvis de IA (e o que muda em relação a um chatbot)

Um "Jarvis" é um assistente pessoal que fica ligado o tempo todo, fala com você por um canal que você já usa, lembra do que você contou ontem e consegue fazer coisas por você: criar lembrete, ler a agenda, rodar uma tarefa no computador. Um chatbot comum só responde e esquece.

Por baixo, um Jarvis é um agente de IA com três coisas a mais: canal fixo, memória de longo prazo e rotina própria (tarefas agendadas, resumo diário, alertas). Se você ainda não montou nenhum agente, comece por como criar um agente de IA: intenção, limites e níveis de autonomia valem igual aqui.

As peças de um Jarvis, no exemplo do openpcbot v3

O openpcbot v3 é o assistente pessoal que o INEMA roda no dia a dia, com código aberto no GitHub. Ele fala por Telegram, terminal e HTTP, e cada mensagem passa pelas mesmas peças:

PeçaO que faz no openpcbot v3
CanalTelegram (bot próprio criado no BotFather), linha de comando e HTTP local
Roteadorum modelo pequeno e local (llama3.2) decide se a mensagem é conversa direta ou trabalho de agente
Modelo de conversaQwen (qwen3.8:27b) no Ollama, residente na memória, sem sair da máquina
Agentestrabalho com ferramenta (arquivo, terminal, web, agenda) vira um job na fila e roda com o Claude pelo CLI
Memóriabanco SQLite com busca por palavra e por vetor (bge-m3), mais um cofre de fatos que você aprova
Controle de gastostoda chamada de modelo passa por um único gateway que registra o uso e respeita um teto de orçamento

Como criar um Jarvis com IA: o passo a passo do openpcbot v3

O caminho abaixo é o do projeto real, na ordem em que o curso openpcbot v3: seu Jarvis local ensina (aberto, 4 trilhas e 48 tópicos). Ele pede Linux com systemd de usuário, Node 20 ou mais novo, o Ollama rodando como serviço e o CLI do Claude instalado.

Um aviso antes de começar: o v3 foi feito para rodar ao lado da versão anterior, o openpcbot v2, e o curso lista o .env do v2 como pré-requisito, porque é de lá que vêm as chaves compartilhadas e o chat permitido. Quem começa do zero precisa preparar isso também, ou partir de um caminho montado do zero, como o Intelecto ou o AgenteJAX (mais abaixo).

  1. Crie um bot só dele no BotFather do Telegram e guarde o token. Dois programas lendo o mesmo token recebem erro 409 e os dois bots ficam surdos.
  2. Instale as dependências (npm install), copie o .env.exemplo para .env e preencha o token do bot novo. As chaves compartilhadas e o chat permitido vêm do .env do openpcbot v2.
  3. Confira os modelos em config/ollama.yaml: um pequeno para rotear, um geral para conversar, um de embeddings para a memória.
  4. Rode npm run doctor: ele checa variáveis, Ollama, RAM, CLIs e serviço, e marca cada linha como ok, aviso ou erro.
  5. Instale o serviço com bash scripts/instalar-servico.sh: ele compila e sobe uma unit do systemd com teto de 2 GB de memória e reinício automático.
  6. Faça a primeira conversa: /versao, /health e /chatid no Telegram, ou npm run cli sem Telegram.

Como falar com o seu Jarvis no Telegram

No ar, quase tudo se faz por mensagem:

  • /tarefa add amanhã 9h revisar proposta: cria um lembrete; /tarefa lista mostra as pendentes.
  • /daily: resumo com tarefas, o que foi feito nas últimas 24 horas e estado da fila.
  • /memoria buscar, /memoria salvar e /memoria esquecer: consultar e corrigir o que ele lembra.
  • /usage: o uso de modelos no dia, na semana e no mês, por tier e por agente.
  • /parar tudo e /retomar: um interruptor que segura qualquer resposta ou agente até você liberar.

Como o Jarvis lembra de você

A memória é o que separa um Jarvis de um chatbot, e também onde é mais fácil errar. No openpcbot v3 ela funciona em quatro camadas. No contexto de cada resposta entram no máximo 600 tokens de memória, para o prompt não inchar.

  • Toda mensagem sua com mais de 20 caracteres vira uma memória, marcada como durável ("prefiro", "moro em", "sempre") ou passageira. Pergunta nunca vira fato.
  • Importância que decai: cada memória começa com peso 1,0, sobe 0,1 a cada uso e perde 0,5 % ao dia (durável) ou 2 % ao dia (passageira).
  • Consolidação às 4h da manhã, no modelo local: junta duplicatas, marca contradições (a informação antiga fica registrada, não é apagada) e gera até 3 resumos por chat.
  • Cofre curado: o bot propõe fatos para os arquivos MEMORY.md e USER.md, mas nada entra sem você aprovar com /memoria aprovar.

O que roda local e o que vai para a nuvem

Um assistente pessoal com IA local não precisa ser 100 % local. O openpcbot v3 roda na assinatura do Claude, no Codex e com várias chaves de API, e roda local com Ollama e Qwen. O desenho é: local por padrão, nuvem quando a tarefa pede, e só local quando o teto de orçamento é atingido.

Em volta dele há serviços locais que o Jarvis aciona, como o inemavox (transcrever, baixar, dublar e cortar vídeos) e o inemaimg. A parte local pede máquina: o modelo geral fixo na memória ocupa 17 GB de RAM, e na máquina do INEMA a RAM livre caiu de 57 para 35 GB quando ele ficou residente.

Onde rodaCom o quêQuando é usado
LocalOllama com Qwen (qwen3.8:27b)padrão para conversa, resumo, tradução e memória
Nuvem por chave de APIOpenRouter (Claude Haiku)raciocínio longo ou Ollama sem RAM livre
Assinatura, pelo CLIClaude (e Codex)trabalho de agente com ferramentas

Do Intelecto ao openpcbot v3: como o Nei construiu o próprio Jarvis

O openpcbot v3 não nasceu pronto. Conforme os primeiros Jarvis foram surgindo, o Nei Maldaner estudou esses sistemas e construiu o seu próprio, otimizado e enxuto. Começou pelo Intelecto e evoluiu para um Jarvis pessoal produtivo, que é o openpcbot. No caminho, criou sistemas paralelos para simplificar as próprias tarefas de criação de conteúdo e de testes. "Estamos sempre melhorando", resume.

Construir a própria base em vez de só instalar um sistema pronto é uma escolha. "Se pegar sistemas prontos será apenas um operador, fácil de ser substituído", diz o Nei. Por isso o caminho sugerido é o mesmo que ele fez:

  1. Aprender Jarvis do básico com o Intelecto: o INTELECTO Curso — Do Zero ao Expert em IA cobre fundamentos, identidade e canais, segurança, memória e integrações, e termina com um projeto final: o seu Jarvis. São 6 trilhas.
  2. Ver um Jarvis de produção por dentro: o curso do openpcbot v3 mostra o assistente que o INEMA usa todo dia, com fila, memória e controle de gastos.
  3. Ajustar ao seu dia a dia: trocar modelos, persona, agentes e skills até ele fazer só o que você precisa.

O que deu errado construindo o nosso Jarvis

O projeto registra cada falha real. Três mostram onde um Jarvis caseiro quebra:

  • Servidor aberto na rede sem senha. O HTTP subiu sem token e aberto na rede: qualquer aparelho do mesmo Wi-Fi poderia disparar um agente com permissões. A revisão pegou antes de virar incidente; agora ele escuta só na própria máquina.
  • Primeira conversa falhou por uma aspa. O tempo de permanência do modelo estava como texto "-1" no arquivo de configuração, e o Ollama só aceita -1 como número.
  • O botão de interromper não parava o agente. O comando de interrupção cancelava a resposta direta em andamento, mas não o agente rodando na fila, que é o caso comum. Corrigido na versão 3.2.2.

Limitações que o projeto admite

  • A memória guarda a frase inteira, não um fato extraído dela.
  • WhatsApp ainda não funciona no v3; Slack está desligado.
  • O modo steer não consegue mudar um agente que já está rodando: a mensagem nova só entra quando ele termina.
  • Voz no Telegram e ferramentas MCP no caminho local estão planejadas, não prontas.

Outros caminhos para montar um Jarvis no INEMA

O catálogo do INEMA tem 5 cursos com a tag Jarvis, incluindo o do openpcbot v3. Além do Intelecto, outros três caminhos:

Por onde começar o seu Jarvis

Para ver o projeto funcionando por dentro, o guia de uso do openpcbot v3 mostra a instalação e os comandos. Como criar um Jarvis com IA, no fim, é menos escolher o modelo e mais decidir o que ele pode lembrar, gastar e fazer sem te perguntar.

Cursos do INEMA sobre o tema

Aprenda junto com a comunidade

Para tirar dúvidas, ver projetos de outros alunos e acompanhar as novidades, a formação contínua do INEMA fica no INEMA.PRO, que inclui a comunidade INEMA.VIP.

Perguntas frequentes

Dá para criar um Jarvis com IA de graça?

Dá para rodar a conversa inteira no seu computador, com Ollama e um modelo aberto como o Qwen, sem pagar por chamada. O que pesa é a máquina: o modelo geral do openpcbot v3 ocupa 17 GB de RAM. Agentes com ferramentas usam a assinatura do Claude, o Codex ou chaves de API.

O Jarvis no Telegram lê minhas conversas?

Só os chats que você configura: no openpcbot v3 existem chats que ele responde e chats que ele só observa para alimentar a memória; o resto ele ignora.

Qual a diferença entre um Jarvis e o ChatGPT?

O ChatGPT é um chat em um site; o Jarvis é seu, fica ligado no seu computador, fala pelo seu Telegram, lembra de você entre conversas e executa tarefas com limites que você define.

Leia também