A Anthropic lançou o Claude Opus 4.5 na segunda-feira, 24 de novembro, apresentado pela empresa como seu modelo premium e a peça final da família Claude 4.5. Quem quiser usar paga US$ 17 por mês no plano Pro e US$ 100 por mês no plano Max, e há contratos Enterprise para empresas. O foco anunciado é o trabalho de escritório: programação, produtividade e agentes autônomos, a faixa em que a companhia disputa espaço com OpenAI e Google.
Os valores são os divulgados em dólar. O material do lançamento não traz preço em reais, não detalha como fica a cobrança de impostos para o assinante brasileiro e não informa quanto custa o uso avulso, fora dos planos. Para quem vai decidir uma compra corporativa, essas três lacunas continuam abertas.
O que o resultado de 80,9% mede — e o que ele ainda não prova
O anúncio veio acompanhado de um placar. No SWE-bench Verified, teste que simula tarefas reais de engenharia de software, o Opus 4.5 marcou 80,9%. Na mesma comparação divulgada, o Gemini 3 Pro aparece com 76,2% e o GPT-5.1 Codex Max, com 77,9%.
“É o modelo mais inteligente para o que realmente importa no dia a dia”
A avaliação é de Alex Albert, líder de relações com desenvolvedores da Anthropic, em declaração ao Business Insider.
Vale entender o que esse tipo de nota significa. Um teste de referência aplica o mesmo conjunto de tarefas a vários sistemas e conta quantas cada um resolve. O número depende de quem aplicou, de quando aplicou, da versão exata de cada modelo testado e do preparo dado a cada um antes da prova. Duas equipes podem rodar o mesmo teste e chegar a percentuais diferentes.
O material divulgado não informa quem executou as medições dos concorrentes, em que data e sob quais condições. Enquanto isso não for aberto, o correto é ler os percentuais como números apresentados pela própria fabricante, e não como resultado de avaliação independente. A distância entre os três está em poucos pontos percentuais, faixa em que diferença de método costuma pesar tanto quanto diferença de tecnologia.
Conversas infinitas e parâmetro de esforço: o que muda no uso
Dois recursos foram apresentados como voltados ao uso corporativo. As Conversas Infinitas mantêm o contexto por períodos muito longos — o sistema não perde o fio do que já foi tratado, o que interessa a quem deixa tarefas rodando por horas ou monta fluxos de trabalho encadeados.
O Parâmetro de Esforço deixa a empresa escolher entre resposta mais rápida e análise mais profunda. Aqui vale corrigir um detalhe que se perde quando o dado é resumido: os 76% anunciados não são economia geral. Segundo a empresa, é no esforço médio que o Opus mantém o nível do Sonnet 4.5 usando 76% menos tokens.
Token é a unidade em que esses sistemas contam e cobram texto — cada palavra costuma valer um ou mais tokens. Gastar menos token para entregar o mesmo resultado significa conta menor no fim do mês para quem paga por volume de uso, e não necessariamente resposta melhor.
Integração com Excel e Chrome e os ganhos relatados no teste
O modelo passou a operar dentro do Excel e do Chrome, o que permite análises financeiras na própria planilha e execução de tarefas no navegador sem que a pessoa tenha de copiar informação de um lado para outro.
Clientes que participaram da fase beta relatam 20% mais precisão em modelos financeiros e 15% mais eficiência em tarefas antes feitas manualmente. São relatos de usuários em teste, não auditoria: não se informa quantas empresas participaram, de que setores, em que período nem como cada ganho foi medido.
A fatia do mercado corporativo, segundo a Menlo Ventures
O lançamento se apoia também em um dado de mercado. Levantamento da Menlo Ventures citado no anúncio aponta que a Anthropic saiu de 12% em 2023 para 32% em 2025 na fatia corporativa, enquanto a OpenAI recuou de 50% para 25% no mesmo intervalo. O material não explica como essa participação foi calculada nem quais empresas entraram na conta, o que impede comparar o levantamento com outros do mesmo tipo.
Criada por ex-executivos da OpenAI, a Anthropic é avaliada em US$ 350 bilhões. Amazon investiu US$ 8 bilhões na companhia e o Google, US$ 2 bilhões; ambas relatam ganhos bilionários não realizados. O termo tem sentido preciso: é valorização no papel, calculada enquanto a participação continua na mão de quem investiu. Só vira dinheiro quando a fatia é vendida.
GitHub Copilot: o que já vale e o que ainda depende de definição
O anúncio informa que o Opus 4.5 será o modelo padrão do GitHub Copilot durante a fase promocional. É um estágio declarado, não um regime permanente: não foram divulgados a data de início, a duração da promoção nem qual modelo fica valendo depois que ela terminar.
O que dá para verificar agora, sem esperar por nada:
- Já vale: o modelo está disponível nos planos Pro, por US$ 17 mensais, e Max, por US$ 100 mensais, além dos contratos Enterprise.
- Ainda sem resposta: quem aplicou os testes de desempenho, quando e em que condições.
- Ainda sem resposta: preço em reais, tratamento de impostos no Brasil e custo do uso avulso.
- Ainda sem resposta: quantas empresas testaram o modelo antes do lançamento e como chegaram aos ganhos de 20% e 15%.
- Ainda sem resposta: início e prazo da fase promocional no GitHub Copilot.
Para quem usa esses sistemas no trabalho, é por essa lista que a decisão passa. Preço e disponibilidade estão publicados e podem ser conferidos; desempenho comparado, ganho de produtividade e duração de promoção seguem apoiados em informação de quem vende, e mudam de peso conforme os detalhes forem — ou não forem — divulgados.
Direto Notícias Imparcial, Transparente e Direto!

