Novo nesse assunto? Você está no lugar certo. Este artigo pressupõe que você já usou algo como o ChatGPT antes, mas nunca construiu nada com IA você mesmo. Se uma palavra precisa de explicação, ela é explicada bem onde aparece.
As duas palavras que você vai ver em todo lugar
- Um modelo de IA é o "cérebro" de fato por trás de uma ferramenta como ChatGPT ou Claude — o que lê sua pergunta e gera uma resposta. Quando você conversa com o ChatGPT num navegador, está falando com um modelo através de uma interface amigável. Empresas diferentes (OpenAI, Anthropic, e outras) constroem seus próprios modelos, e os modelos diferem em quão bons são, quão rápidos são, e quanto custa usá-los.
- Uma API key é uma sequência de texto longa e privada que prova: "essa solicitação é permitida, e cobre dessa conta". Em vez de digitar numa janela de chat, um programa pode enviar uma pergunta direto a um modelo pela internet — a API key é como o provedor do modelo sabe quem está perguntando e de quem cobrar.
Por que alguém usaria duas ferramentas de IA diferentes de propósito
Se você usa uma ferramenta de chat de IA casualmente, provavelmente usa só uma. Mas quando a IA entra em trabalho repetitivo de verdade — revisar código, redigir documentos rotineiros, fazer pesquisa —, o volume de solicitações aumenta bastante, e um modelo cobrado por uso pode ficar caro rápido se toda solicitação for para o mais capaz (e mais caro).
A solução que algumas pessoas usam: enviar o trabalho grande, preciso, "isso realmente importa" para o melhor modelo disponível, e enviar o trabalho repetitivo, de alto volume, de menor risco para algo mais barato — às vezes até um modelo que roda de graça no seu próprio computador em vez de usar um serviço pago. Você ganha a qualidade onde ela conta e a economia em tudo mais.
O que "rodar um modelo no seu próprio computador" realmente significa
Isso soa mais exótico do que é. Alguns modelos de IA são publicados de forma aberta o suficiente para poderem ser baixados e rodados diretamente num computador comum, usando o próprio poder de processamento dele em vez de enviar a pergunta pela internet para os servidores de outra pessoa. É mais lento e um pouco menos capaz que os maiores modelos hospedados, mas não custa nada por uso depois de configurado — você está só usando a eletricidade do seu próprio computador, sem pagar ninguém por pergunta.
Um agente de IA baseado em terminal é um programa que conecta um modelo — hospedado ou local — aos arquivos reais do seu projeto, para que ele possa ler seu trabalho, fazer edições, e rodar comandos em seu nome, em vez de você copiar e colar texto entre uma janela de chat e outra.
O que isso não é
Uma observação honesta, porque prometer demais não ajuda ninguém: distribuir trabalho entre duas ferramentas de IA diferentes não é mágica, e não acontece automaticamente — uma pessoa decide, tarefa por tarefa, para qual enviar cada coisa, com base em quanto importa e quanto custa. E um modelo rodando localmente é de fato menos capaz que os maiores modelos hospedados para os problemas mais difíceis; a economia vem com uma troca real de qualidade para o trabalho de maior risco, que é exatamente por que esse trabalho fica no modelo melhor (e mais caro).
Pronto para a versão mais aprofundada?
Tudo acima é a versão em linguagem simples de um guia técnico real e detalhado para configurar exatamente esse tipo de fluxo com dois modelos. Se você quiser o detalhe de verdade — comandos exatos de configuração, tanto uma opção hospedada quanto uma totalmente local, e números reais de custo —, a versão completa está aqui: Cut AI API Costs with Hugging Face + Claude: Hybrid Setup Guide.
Se essa foi sua primeira vez pensando em modelos de IA e API keys dessa forma, agora você já sabe o suficiente para acompanhar aquele artigo — e o suficiente para entender por que alguém usaria mais de uma ferramenta de IA de propósito.