O vocabulário mínimo
Cinco conceitos. Sem eles, nenhuma comparação de preço faz sentido — e é aqui que quase todo mundo erra a conta.
Token: a unidade de medida
Modelos de IA não leem palavras, leem tokens — pedaços de palavra. Regra prática: 1 token ≈ 4 caracteres em inglês e um pouco menos em português (nossos acentos e palavras longas gastam mais). Na prática:
- 1.000 tokens ≈ 600 a 750 palavras ≈ uma página e meia de texto.
- Um e-mail médio: 300–500 tokens. Um contrato de 10 páginas: ~8.000 tokens. Uma planilha grande em CSV: 50.000+ tokens.
- Preço de API é sempre cotado por milhão de tokens (a sigla que você vai ver é /MTok).
Entrada e saída custam preços diferentes
Você paga duas vezes em cada chamada: pelo que envia (input) e pelo que o modelo escreve (output). Saída custa tipicamente 5 a 6 vezes mais que entrada. Por isso "me faça um resumo de 300 páginas" é barato e "me escreva 40 páginas" é caro.
O efeito bola de neve do contexto
Esta é a parte que ninguém conta. A cada nova mensagem de uma conversa, toda a conversa anterior é reenviada ao modelo. A décima mensagem de um papo não custa o mesmo que a primeira — custa a soma de tudo que veio antes. Uma conversa longa de trabalho pode chegar em 40.000–100.000 tokens de entrada por mensagem.
Por que isso importa para o seu bolso
Na assinatura, esse crescimento é invisível: você só sente quando bate no limite. Na API, ele aparece na fatura. É a diferença entre um plano de celular com franquia e uma conta medida em minutos.
Cache e lote: os dois descontos
- Cache de prompt — se você repete o mesmo bloco de contexto (um manual, um contrato, instruções fixas), o provedor guarda esse pedaço processado. A releitura custa 10% do preço de entrada, ou seja, 90% de desconto. Escrever no cache custa um pouco mais que o normal (1,25× a 2×), então só compensa com repetição.
- API de lote (batch) — se você aceita esperar (até algumas horas), sai por metade do preço. Ótimo para "classifique estes 4.000 comentários", péssimo para conversa.
Assinatura x API: dois modelos de negócio diferentes
| Assinatura (Plus / Pro) | API (por token) | |
|---|---|---|
| Como paga | Valor fixo mensal | Só o que consumir; zero uso, zero conta |
| Teto | Sim — janelas de horas e semanas | Não há teto de consumo, só limites técnicos por minuto |
| Para quem | Uma pessoa trabalhando | Software, automações, produtos |
| Interface | App pronto, arquivos, memória, agentes | Você (ou alguém) constrói |
| Risco | Bater no limite no pior momento | Fatura surpresa |
Assinatura de ChatGPT ou Claude não inclui créditos de API, e vice-versa. São contas separadas, faturas separadas.
ChatGPT Plus por dentro
US$ 20/mês, um usuário. O que a OpenAI publica sobre os limites — e o que eles significam na sua semana de trabalho.
| Recurso | Limite publicado (2026) | O que isso é na prática |
|---|---|---|
| Mensagens no modelo padrão | ~160 a cada 3 h | Ao estourar, o chat cai para o modelo mini até a janela reabrir |
| Modo raciocínio (Thinking) | até 3.000 / semana | ~100/dia de trabalho pesado; é a cota que realmente importa |
| Upload de arquivos | 80 a cada 3 h | Até 20 arquivos por mensagem; 512 MB e 2 M tokens por arquivo |
| Janela de contexto | 32K padrão · 256K no Thinking | Conversas muito longas "esquecem" o começo no modo padrão |
| Tarefas agendadas | 10 ativas | Rotinas recorrentes, mas consomem a mesma cota |
Também incluso: geração de imagem, pesquisa profunda (deep research), Projects, GPTs personalizados, Canvas, voz, e acesso ao Codex. A OpenAI avisa que os limites variam com a demanda do sistema — em horário de pico eles encolhem, e mudam de nome e número a cada lançamento de modelo. O aviso dentro do produto é sempre a fonte final.
Leitura honesta
160 mensagens a cada 3 horas é muito para uso humano — quase ninguém encosta nesse teto. O limite que gente que trabalha de verdade sente é o das 3.000 mensagens semanais de raciocínio, e ele só aperta se você usa o modo pesado o dia inteiro, todo dia.
Claude Pro por dentro
US$ 20/mês (ou US$ 17 no anual). A lógica de limite é diferente da OpenAI — e isso muda como você deve trabalhar.
Como o limite funciona
A Anthropic não publica um número fixo de mensagens. O sistema tem duas camadas:
- Sessão móvel de 5 horas — começa na sua primeira mensagem e reinicia 5 horas depois. É a camada que você sente no dia a dia.
- Teto semanal — introduzido em 2025 para conter uso 24/7, compartilhamento de conta e revenda. Foi desenhado para afetar uma minoria de contas muito pesadas.
Duas mudanças recentes importam: em 6 de maio de 2026 a Anthropic dobrou permanentemente os limites de 5 horas do Claude Code para planos pagos e removeu a redução em horário de pico para Pro e Max. O teto semanal ficou igual.
| O que vem no Pro | Detalhe |
|---|---|
| Chat com Opus, Sonnet e Haiku | Você escolhe o modelo; os mais caros consomem cota mais rápido |
| Projects | Pastas de conversa com contexto e instruções fixas |
| Claude Cowork | Disponível em todos os planos pagos, via app de desktop |
| Claude Code | Incluso na cota base (dobrada em maio/2026); compartilha o mesmo saldo do chat |
| Conectores, Skills, Artifacts | Integrações e documentos gerados dentro do app |
| Fable 5 | No Pro, por créditos pré-pagos; nos planos superiores entra dentro do limite semanal |
A regra de ouro do Pro
Cota agêntica queima muito mais rápido que cota de chat. Uma tarefa de Cowork que lê 40 arquivos consome, em minutos, o que 30 perguntas de chat consumiriam em um dia. Isso não é defeito — é o preço de o Claude estar fazendo o trabalho em vez de descrever o trabalho.
A tabela de preços da API
Valores em dólar por milhão de tokens, conforme publicado até 29 de julho de 2026. Preços de IA mudam com frequência — confirme antes de fechar orçamento.
Anthropic — Claude
| Modelo | Entrada /MTok | Saída /MTok | Uso típico |
|---|---|---|---|
| Claude Fable 5 | US$ 10,00 | US$ 50,00 | Topo de linha, tarefas mais difíceis |
| Claude Opus 5 | US$ 5,00 | US$ 25,00 | Raciocínio longo, análise densa, agentes |
| Claude Sonnet 5 intro | US$ 2,00 | US$ 10,00 | Preço promocional até 31/08/2026 — depois US$ 3 / US$ 15 |
| Claude Haiku 4.5 | US$ 1,00 | US$ 5,00 | Volume alto, classificação, respostas curtas |
Leitura de cache custa 10% da entrada; escrita de cache custa 1,25× (5 min) ou 2× (1 h). A API de lote corta 50% de entrada e saída.
OpenAI — GPT
| Modelo | Entrada /MTok | Saída /MTok | Observação |
|---|---|---|---|
| GPT-5.6 Sol | US$ 5,00 | US$ 30,00 | Topo da família lançada em 9/7/2026 |
| GPT-5.6 Terra | US$ 2,50 | US$ 15,00 | Faixa de trabalho do dia a dia |
| GPT-5.6 Luna | US$ 1,00 | US$ 6,00 | Volume alto e baixo custo |
| GPT-5.5 legado | US$ 5,00 | US$ 30,00 | É o motor por trás do Plus na prática |
| GPT-5.4 nano | US$ 0,20 | US$ 1,25 | O mais barato da casa |
| Variantes Pro | US$ 30,00 | US$ 180,00 | Raciocínio estendido; saída é o gargalo |
Atenção ao medidor de contexto longo: prompts muito grandes mudam de faixa e podem dobrar a entrada e somar 50% na saída na sessão inteira. Cache lê a 10%.
A conta: quanto custa 100% da cota
Aqui está a parte que você pediu. Vou mostrar o método antes do número, para você poder refazer a conta com as suas premissas.
O método em três passos
- Definir a "mensagem média". Quantos tokens entram e quantos saem em uma interação típica sua.
- Multiplicar pelo teto do plano. Quantas mensagens a cota permite em um mês.
- Aplicar o preço do modelo equivalente ao que a assinatura te dá.
Premissas usadas (transparência total)
| Tipo de mensagem | Entrada | Saída | Por quê |
|---|---|---|---|
| Conversa comum | 8.000 tk | 700 tk | Histórico acumulado + instruções + sua pergunta |
| Modo raciocínio | 15.000 tk | 3.000 tk | Contexto maior; o raciocínio interno é cobrado como saída |
| Tarefa agêntica (Cowork / Code) | 500.000 tk | 40.000 tk | Dezenas de leituras de arquivo, chamadas de ferramenta e reescritas |
ChatGPT Plus convertido em API (preço GPT-5.5 / 5.6 Sol: US$ 5 e US$ 30)
| Cenário | Volume mensal | Custo em API | Vezes os US$ 20 |
|---|---|---|---|
| Teto absoluto — 160 msgs a cada 3 h, 24 h por dia, mais 3.000 raciocínios/semana | 38.400 comuns + 12.900 pesadas | ≈ US$ 4.470 | ≈ 223× |
| Teto realista — cota semanal de raciocínio esgotada toda semana | 12.900 pesadas | ≈ US$ 2.130 | ≈ 106× |
| Profissional intenso — 30 msgs/dia, 1/3 no modo pesado | 600 comuns + 300 pesadas | ≈ US$ 86 | ≈ 4,3× |
| Uso leve — 10 msgs/dia, quase tudo comum | 300 mensagens | ≈ US$ 18 | ≈ 0,9× |
Claude Pro convertido em API
Aqui a conversão exige uma escolha: o Pro te dá acesso a Opus, que na API custa US$ 5 / US$ 25. Uso pesado de chat mais uso agêntico muda tudo.
| Cenário | Volume mensal | Sonnet 5 | Opus 5 |
|---|---|---|---|
| Chat pesado — teto semanal esgotado, ~1.200 msgs/semana | ≈ 5.200 mensagens | ≈ US$ 145 | ≈ US$ 364 |
| Cowork diário — 5 tarefas agênticas por dia útil | 110 tarefas | ≈ US$ 154 | ≈ US$ 385 |
| Uso agêntico intenso — Cowork + Code o dia inteiro, batendo no teto semanal | 400+ tarefas | ≈ US$ 560 | ≈ US$ 1.400 |
| Profissional comum — 25 msgs/dia + 1 tarefa Cowork | 750 msgs + 22 tarefas | ≈ US$ 52 | ≈ US$ 130 |
| Uso leve — 10 msgs/dia | 300 mensagens | ≈ US$ 8 | ≈ US$ 21 |
As três conclusões que valem a leitura
- O ponto de equilíbrio fica em torno de 10 mensagens de trabalho por dia. Abaixo disso, você paga US$ 20 por conveniência. Acima, a assinatura já se pagou.
- Quem usa modo raciocínio ou agente sai com 5× a 100× de valor. É onde o subsídio das assinaturas realmente está.
- Ninguém "esgota 100%" de verdade. Os tetos absolutos exigem uso ininterrupto 24 h. Trate o número de US$ 4.470 como o que ele é: o limite superior teórico, útil para entender a ordem de grandeza do subsídio, não como economia realizada.
O que a conta não captura
A API entrega coisas que a assinatura não entrega: rodar sem você presente, integrar num sistema, atender mil clientes, controlar retenção de dados. E a assinatura entrega coisas que a API não entrega: app pronto, memória, arquivos, agentes de desktop, busca, geração de imagem. Comparar o preço é útil; concluir que "a assinatura é 100× melhor" não é. São ferramentas para trabalhos diferentes.
O medidor
Mexa nos controles com o seu uso real. O ponteiro branco marca os US$ 20 da assinatura: tudo à direita dele é o que você estaria pagando a mais na API.
Calculadora de equivalência
Estimativa por token, sem descontos de lote. Contexto é o total reenviado a cada mensagem, não só o que você digita.
Escala logarítmica — cada marca é 10× a anterior. Sem isso, o cenário de US$ 4.000 esmagaria todos os outros na barra.
Claude Cowork
O produto que a Anthropic construiu depois de perceber que times de marketing e de dados — gente que não programa — estavam usando o Claude Code para organizar recibos e planejar viagens.
O que é, em uma frase
Um colega que recebe um objetivo, tem acesso a uma pasta do seu computador, e devolve o trabalho pronto — sem você acompanhar cada passo.
Tecnicamente: um agente que roda em um ambiente isolado na sua máquina, lê e escreve nos arquivos das pastas que você autorizar, executa scripts (e conserta os próprios erros) sem nunca te mostrar um terminal, e entrega arquivos finalizados. Está disponível em todos os planos pagos, dentro do app de desktop do Claude, com versões de web e celular em beta para você iniciar uma tarefa e acompanhar de longe.
A diferença que muda tudo
| Chat | Cowork | Claude Code | |
|---|---|---|---|
| Você entrega | Uma pergunta | Um resultado desejado | Uma tarefa de engenharia |
| Você faz | Pede, revisa, pede de novo, copia e cola | Descreve o "pronto" e revisa no fim | Idem, mas em código |
| Recebe | Texto na tela | Arquivos na sua pasta | Código no repositório |
| Precisa saber programar | Não | Não | Sim (ou quase) |
| Consumo de cota | Baixo | Alto | Alto |
Dez tarefas reais para quem não programa
- Fechamento financeiro do mês — pasta com PDFs de extrato, notas e recibos → planilha categorizada + resumo do que saiu do padrão.
- Prestação de contas — fotos de comprovantes no celular → tabela com data, fornecedor, valor, centro de custo.
- Proposta comercial — briefing do cliente + suas propostas antigas → documento novo no seu formato, com escopo e preço.
- Relatório a partir de fontes — 15 PDFs de pesquisa → relatório estruturado com o que é relevante e o que se contradiz.
- Extração de dados de contratos — 40 contratos → planilha com vigência, multa, reajuste, cláusula de rescisão.
- Limpeza de pastas — "Downloads" com 3.000 arquivos → renomeados, agrupados, duplicatas separadas para você aprovar.
- Análise de feedback — export de avaliações e tickets → três temas dominantes com citações que comprovam cada um.
- Preparação de reunião — atas antigas + e-mails → briefing de uma página com pendências por pessoa.
- Calendário de conteúdo — dados de venda → o que empurrar, o que promover, o que segurar nos próximos 30 dias.
- Padronização de documentos — 60 arquivos com formatação bagunçada → todos no mesmo template.
Como dar um briefing (e não um prompt)
Esse é o único hábito que separa quem acha o Cowork mágico de quem acha decepcionante. Pare de escrever como se fosse chat. Escreva como se estivesse passando uma tarefa para um assistente competente que nunca trabalhou na sua empresa.
Briefing fraco
"Organiza minhas notas fiscais aí."
Briefing forte
"Na pasta /financeiro/2026-07 tem PDF de nota e print de comprovante. Monte fechamento-julho.xlsx com data, fornecedor, CNPJ, valor, categoria e forma de pagamento. Categorias são as da aba 'plano de contas' do arquivo do mês passado. Se um valor estiver ilegível, deixe a célula em branco e liste o arquivo numa aba 'conferir' — não estime. No fim, me diga em 5 linhas o que fugiu do padrão em relação a junho."
Usando o Cowork para construir um negócio
Aqui vale uma ordem, porque a tentação é começar pelo logo e pelo Instagram — e é o passo que menos importa no primeiro mês.
- Descobrir a oferta. Junte tudo que você já produziu para clientes numa pasta e peça: "identifique os três serviços que aparecem em mais entregas, o tempo médio de cada um e o que os clientes mais elogiaram".
- Precificar com base em custo real. "Com base nas horas registradas nesta planilha e nestes custos fixos, calcule meu custo por hora e monte três faixas de preço com a margem que cada uma entrega." Peça o memorial de cálculo, não só o número.
- Materiais que se repetem. Um template de proposta, um contrato-base, um roteiro de primeira reunião, uma tabela de escopo. Gerados uma vez, reusados sempre.
- Operação. Checklist de onboarding de cliente, planilha de acompanhamento, modelo de relatório de entrega. O objetivo é você parar de reinventar cada projeto.
- Aquisição. Lista de 50 potenciais clientes pesquisados, com o motivo pelo qual cada um se encaixa e uma abordagem específica — não um texto genérico multiplicado por 50.
- Financeiro recorrente. Fechamento mensal, controle de inadimplência, projeção de caixa a 90 dias. Uma tarefa agendada, um arquivo por mês, você só lê o resumo.
Limites, riscos e boa higiene
- Permissão é por pasta. Crie uma pasta de trabalho dedicada e aponte o Cowork só para ela. Deixe o resto fora de alcance. Você pode revogar acesso a qualquer momento.
- Confira número por amostragem. Escolha três linhas do resultado e verifique contra a fonte. Sempre.
- Ele consome cota rápido. Uma tarefa longa pode gastar o equivalente a um dia de chat.
- Decisões consequentes continuam suas. O produto foi desenhado para supervisão humana: enviar, publicar, apagar e pagar são seus.
- Dado sensível de terceiro — CPF de cliente, prontuário, folha de pagamento — merece uma decisão consciente antes de entrar na pasta, não depois.
ChatGPT no seu trabalho, sem ser dev
A mudança não é aprender prompts espertos. É parar de usar como buscador e começar a usar como processo.
Os cinco modos de uso
| Modo | Você fornece | Exemplo de pedido |
|---|---|---|
| Rascunhar | Contexto e restrições | "Escreva a primeira versão deste comunicado para 40 funcionários, tom direto, 250 palavras." |
| Criticar | O seu trabalho pronto | "Este é meu orçamento. Aponte os três pontos onde um cliente vai pedir desconto e por quê." |
| Extrair | Documento longo | "Deste edital de 90 páginas, liste requisitos obrigatórios, prazos e documentos exigidos, em tabela." |
| Decidir | As opções e o critério | "Tenho estas duas propostas de fornecedor. Compare por custo total em 24 meses, risco e prazo." |
| Ensinar | Onde você travou | "Me explique PROCV como se eu nunca tivesse usado, com um exemplo com os meus nomes de coluna." |
A receita de pedido que funciona
Seis ingredientes. Falta de qualquer um deles é a causa de 90% das respostas ruins.
- Papel — "você é o analista financeiro de uma padaria com 12 funcionários".
- Contexto — o que a pessoa precisaria saber para não fazer besteira.
- Insumo — cole o texto, anexe o arquivo. Sem matéria-prima, sai genérico.
- Formato — tabela, e-mail, 5 bullets, 300 palavras. Diga.
- Critério — "priorize risco jurídico", "escreva para quem não é da área".
- Exemplo — um trecho de algo que você considera bom. Vale mais que três parágrafos de instrução.
Por área
| Se você trabalha com… | Comece por aqui |
|---|---|
| Administrativo | Atas de reunião viram lista de pendências com responsável e prazo; e-mails longos viram resumo de 3 linhas |
| Vendas | Pesquisa do cliente antes da reunião, tratamento das 5 objeções mais comuns, follow-up que não parece robô |
| Marketing | Um conteúdo vira oito formatos; briefing de campanha; análise do que o concorrente está prometendo |
| RH | Descrição de vaga, roteiro de entrevista com critérios de nota, feedback estruturado, comunicados internos |
| Financeiro | Categorização de despesa, explicação de variação mês a mês, roteiro de cobrança por perfil de cliente |
| Jurídico e contratos | Leitura de contrato em português claro, mapa de cláusulas de risco, comparação entre duas versões |
| Educação | Plano de aula, variações de exercício por nível, feedback individual em escala |
| Atendimento | Base de respostas padrão, ajuste de tom para cliente irritado, classificação de tickets por tema |
| Autônomo | Proposta, contrato-base, precificação, e o "trabalho em volta do trabalho" que consome sua semana |
Saindo do avulso: três recursos que automatizam o repetitivo
- Projects — uma pasta de conversas com arquivos e instruções fixas. Você para de reexplicar seu negócio toda vez.
- GPTs personalizados — um assistente com instruções e documentos seus, para uma tarefa que você repete. Ex.: "Revisor de proposta", "Triador de currículo".
- Tarefas agendadas — até 10 ativas, para rotinas ("toda segunda, 7h: resumo do setor"). Consomem a mesma cota do plano.
Os cinco erros que custam caro
- Aceitar a primeira resposta. A segunda versão, depois de uma crítica sua, é sempre melhor. Pergunte "o que está fraco aqui?".
- Pedir sem insumo. "Escreva um post sobre meu negócio" produz exatamente o que a pergunta merece.
- Dizer "melhore". Melhorar em qual direção? Mais curto? Mais técnico? Mais gentil?
- Confiar em número, data e citação sem conferir. Modelos erram com confiança. Cálculo e fonte se verificam.
- Colar dado sensível de terceiros sem pensar. Decida antes o que pode e o que não pode sair da sua casa.
Rotina semanal sugerida
- Segunda, 20 min — despejar a semana e transformar em plano com prioridades.
- Todo dia, no fim — jogar as anotações soltas e pedir a lista de pendências de amanhã.
- Uma vez por semana — pegar a tarefa chata que mais se repetiu e transformar em template ou GPT.
- Sexta, 15 min — pedir a crítica do trabalho da semana, não o elogio.
Qual assinar
Se o orçamento comporta um só, a decisão é sobre o formato do seu trabalho, não sobre qual modelo é "mais inteligente".
| Se o seu dia é… | Escolha | Por quê |
|---|---|---|
| Muito texto, pesquisa, imagem, voz, variedade de tarefas curtas | ChatGPT Plus | Ecossistema mais amplo e cotas generosas para volume |
| Arquivos, planilhas, documentos, tarefas longas que você quer delegar | Claude Pro | Cowork faz o trabalho e devolve arquivo, não texto para copiar |
| Análise densa de documentos longos e escrita cuidadosa | Claude Pro | Contexto grande e saída mais controlada |
| Geração de imagem e pesquisa web como parte do ofício | ChatGPT Plus | Recursos nativos e maduros |
| Você quer montar automação de verdade e tem quem programe | API | Sem teto, integrável, pago por uso |
Sobre assinar os dois (US$ 40/mês): faz sentido se você já bate no limite de um deles toda semana. Se ainda não bate, o segundo plano é um custo sem retorno — o dinheiro rende mais em uma hora sua estudando o primeiro.
Plano de 14 dias
Um roteiro curto para sair do "eu pago mas continuo fazendo tudo à mão".
Semana 1 — construir o hábito
- Dia 1: escolher uma tarefa chata e recorrente e cronometrar quanto ela leva hoje.
- Dia 2: fazer essa tarefa junto com a IA, usando a receita de seis ingredientes.
- Dia 3: refazer com um exemplo do seu padrão anexado. Comparar.
- Dia 4: criar um Project ou GPT dedicado a ela.
- Dia 5: cronometrar de novo. Anotar o ganho em minutos.
Semana 2 — delegar de verdade
- Dia 8: criar a pasta de trabalho dedicada e autorizar o Cowork só nela.
- Dia 9: primeira tarefa agêntica, pequena e verificável (renomear e organizar arquivos).
- Dia 10: uma tarefa de extração — contratos ou notas viram planilha.
- Dia 11: conferir três linhas contra a fonte e ajustar o briefing.
- Dia 12: escrever o briefing definitivo dessa tarefa e guardar como template.
- Dia 14: somar as horas economizadas e decidir, com número, se o plano se pagou.