Anthropic lança Claude Opus 5.5

Claude Opus 5.5


A Anthropic lançou a 22 de setembro de 2026 o Claude Opus 5.5: um modelo que iguala o topo de gama Fable 5.1 na maioria das tarefas, custa cerca de 40% menos a utilizar do que o Opus 5, escreve de forma mais clara e já está disponível nos planos pagos Pro, Max, Team e Enterprise.

O Opus 5.5 é o primeiro modelo da nova família Claude 5.5. Os modelos Sonnet 5.5 e Haiku 5.5 chegam nas próximas semanas, com muitas das mesmas melhorias de desempenho, eficiência e segurança. É também o primeiro lançamento da Anthropic desde que o seu diretor executivo, Dario Amodei, defendeu publicamente que o progresso da IA deve ser cadenciado para que as práticas de segurança não fiquem para trás. Antes de ser disponibilizado, o modelo foi avaliado por entidades externas como o METR e a Frontier Design.

Para quem ensina, a notícia tem três leituras práticas. O modelo é mais fiável quando pesquisa e cita informação, escreve explicações mais fáceis de acompanhar e, por ser mais eficiente, permite fazer mais trabalho dentro dos mesmos limites de utilização de uma subscrição. Ao longo deste artigo, cada novidade é traduzida naquilo que realmente muda na preparação de aulas, na criação de recursos, na avaliação e na aprendizagem dos alunos.

O Opus 5.5 em quatro números

-40%
custo de utilização em tarefas típicas, face ao Opus 5

+30%
mais rapidez a gerar texto (mais de 30%, segundo a Anthropic)

81,8%
no OSWorld 2.0, teste de uso autónomo do computador

16/18
relatórios de pesquisa sem qualquer número ou citação inventada

Valores publicados pela Anthropic no anúncio oficial do modelo. O último indicador refere-se a um teste interno descrito mais abaixo.

As grandes novidades da nova versão

Mais do que uma atualização incremental, o Opus 5.5 junta ganhos em várias frentes ao mesmo tempo. Estas são as mudanças que mais se destacam face ao Opus 5, o modelo que até agora era a escolha habitual nos planos pagos:

1Desempenho ao nível do topo de gama
Lidera os testes de programação autónoma, uso do computador e trabalho intelectual. Na maioria das tarefas, comporta-se ao nível do Claude Fable 5.1, o modelo mais avançado disponível ao público, mas a um custo muito inferior.
2Escrita mais natural e fácil de acompanhar
Coloca a informação mais importante no início, usa menos jargão e cumpre as regras de escrita que lhe são indicadas. Era uma das críticas mais frequentes ao Opus 5 e foi uma das prioridades desta versão.
3Mais barato e mais rápido
Precisa de menos capacidade de computação, usa menos tokens por tarefa e gera texto mais de 30% mais depressa. Na API, o preço por token desce 20% e o das leituras em cache desce 60%.
4Limites de utilização mais generosos
A Anthropic aumentou os limites de utilização por períodos de cinco horas nos planos Pro, Max, Team e Enterprise por lugar. Os subscritores recebem ainda uma reposição de limite que pode ser guardada e usada quando for mais útil.
5O modelo mais seguro e honesto até hoje
Obteve a melhor pontuação de sempre na auditoria comportamental automatizada da Anthropic, com cerca de 2000 cenários simulados, e é o modelo mais forte da empresa na maioria das medidas de honestidade.
6Raciocínio sempre ativo e marca de água
O modo de pensamento deixou de poder ser desligado e o texto gerado inclui medidas de marca de água para cumprir o Regulamento Europeu da IA (AI Act), tal como já acontecia com o Fable 5.1.

Desempenho: o que mostram os testes

Nos testes de referência publicados pela Anthropic, o Opus 5.5 supera o Opus 5 em todas as categorias e fica à frente do Fable 5.1 em todas elas. Frente ao GPT-6 Astra, da OpenAI, vence na maioria, mas não em todas: em fluxos de trabalho entre aplicações e em investigação científica autónoma, o modelo da OpenAI mantém a liderança. O gráfico seguinte permite comparar os modelos em cada área; basta escolher o teste.

Humanity’s Last Exam, com ferramentas
Perguntas de nível especializado em dezenas de áreas do saber, das ciências às humanidades. É o teste que mais se aproxima do conhecimento disciplinar exigido a um professor.
Claude Opus 5.5
–
Claude Fable 5.1
–
Claude Opus 5
–
GPT-6 Astra
–
GPT-5.6 Sol
–
Percentagem de tarefas resolvidas. “n.p.” (não publicado) indica que não existe resultado divulgado para esse modelo.

Tabela completa de resultados

Área e testeOpus 5.5Fable 5.1Opus 5GPT-6 AstraGPT-5.6 Sol
Programação autónoma
Terminal-Bench 4.0
66,4% ★55,8%52,3%57,9%37,3%
Programação autónoma
FrontierCode v1.1
54,4% ★50,3%48,0%53,3%47,5%
Programação autónoma
CursorBench 4.0
57,8% ★51,8%46,6%n.p.41,7%
Trabalho intelectual
GDPval-AA v2.1 (Elo)
1846 ★1735170815421588
Fluxos de trabalho
AutomationBench
40,0%31,4%26,9%41,4% ★28,8%
Raciocínio multidisciplinar
Humanity’s Last Exam
67,7% ★65,6%63,6%57,2%n.p.
Investigação científica
Terminal-Bench-Science 0.1
58,7%52,6%29,0%64,6% ★22,4%
Uso do computador
OSWorld 2.0
81,8% ★80,7%74,0%n.p.n.p.
Leitura de gráficos
Chartography
89,0% ★88,4%83,4%n.p.n.p.

★ Melhor resultado em cada teste. n.p. = não publicado. O GDPval-AA avalia trabalho profissional real em 44 profissões e é expresso em pontuação Elo (quanto mais alta, melhor). Resultados do Opus 5.5 com raciocínio adaptativo no esforço máximo; os valores dos modelos da OpenAI são os divulgados pela própria OpenAI.

Uma ressalva que a própria Anthropic faz
A empresa reconhece que, a este nível de capacidade, as diferenças nos testes de referência já são um indicador pouco fiável das diferenças no uso real, e que, na prática, a distância entre o Opus 5.5 e o Fable 5.1 é menor do que os números sugerem. Onde a vantagem é inequívoca é na eficiência: no teste GDPval-AA, por exemplo, o Opus 5.5 no esforço padrão (médio) supera o GPT-6 Astra no esforço máximo por cerca de um quinto do custo por tarefa.

O teste dos números inventados: pesquisa mais fiável

Para quem usa a IA para preparar materiais, o risco mais conhecido é a chamada “alucinação”: dados, datas ou citações que parecem credíveis mas não existem. Num teste interno, a Anthropic pediu ao Opus 5.5, ao Fable 5.1 e ao Opus 5 que escrevessem um relatório sobre os resultados trimestrais de uma empresa, usando apenas o que conseguissem encontrar numa cópia da web onde o comunicado oficial de resultados era difícil de localizar. Um avaliador automático verificou cada número e cada citação contra as fontes. Bastava um único dado inventado para o relatório ser reprovado.

Relatórios aprovados sem qualquer dado inventado
Cada círculo representa uma tentativa, em diferentes níveis de esforço
Claude Opus 5.5
Claude Fable 5.1
nenhuma tentativa aprovada
Claude Opus 5
nenhuma tentativa aprovada
16 em 18 relatórios passaram a verificação

O resultado foi claro: 16 dos 18 relatórios do Opus 5.5 cumpriram o critério, enquanto nem o Fable 5.1 nem o Opus 5 o conseguiram em qualquer tentativa. Outros testes apontam no mesmo sentido. Uma empresa de investigação quantitativa relatou que o modelo detetou um erro nas próprias instruções da avaliação e o corrigiu, algo que nenhum modelo anterior tinha feito. Outra, especializada em análise de dados, observou que o Opus 5.5 continua a investigar depois de encontrar a primeira resposta plausível, em vez de parar aí.

Para um professor, isto significa materiais de apoio com menos erros factuais e uma ferramenta mais útil para sintetizar documentos oficiais, relatórios de estudos ou normativos. Ainda assim, os dois relatórios reprovados lembram que a verificação humana continua a ser indispensável.

Comunicação mais clara: a novidade que se sente no dia a dia

A Anthropic dedicou especial atenção à forma como o modelo escreve, porque era um dos pontos mais criticados no Opus 5. No anúncio, a empresa mostra exemplos lado a lado em que o Opus 5.5 explica um problema técnico, resume uma conversa de equipa e justifica decisões de conceção. Nos três casos, as respostas começam pela conclusão, usam frases mais curtas e evitam expressões obscuras.

  • A informação essencial surge primeiro, o que facilita a leitura rápida e a verificação.
  • Menos jargão e menos expressões idiossincráticas, o que torna os textos mais acessíveis a leitores não especialistas.
  • Cumpre as regras de escrita definidas pelo utilizador, como o nível de linguagem, a extensão ou a variante do português.
  • Respostas mais concisas sem perder rigor: numa das avaliações de clientes, as respostas foram cerca de 40% menos extensas, mantendo a exatidão.

“Escreve da mesma forma que eu escrevo.”

Comentário de um dos primeiros utilizadores a testar o modelo, citado pela Anthropic (tradução livre)

Na prática docente, esta mudança é talvez a mais relevante de todas. Uma explicação para alunos do 7.º ano, uma mensagem para encarregados de educação ou uma síntese para o conselho de turma exigem precisamente clareza, objetividade e adequação ao destinatário. Um modelo que segue as instruções de estilo com mais rigor poupa tempo de revisão e produz textos mais próximos daquilo que o professor escreveria.

Custos: fazer o mesmo por menos 40%

A descida de preço é uma das novidades mais visíveis. O Opus 5.5 precisa de menos capacidade de computação do que o Opus 5 e a Anthropic refletiu isso no preço. Somando o preço mais baixo por token ao facto de o modelo usar menos tokens para concluir cada tarefa, o custo total desce cerca de 40% em cargas de trabalho típicas. O gráfico compara os preços por milhão de tokens na API, que é o modo de acesso usado por programadores e por plataformas educativas que integram o Claude.

Preço por milhão de tokens na API
Barras relativas ao preço do Opus 5 em cada categoria
Leituras em cache-60%
Opus 5

0,50 USD

Opus 5.5

0,20 USD

Tokens de entrada-20%
Opus 5

5 USD

Opus 5.5

4 USD

Tokens de saída-20%
Opus 5

25 USD

Opus 5.5

20 USD

Escritas em cache-20%
Opus 5

6,25 USD

Opus 5.5

5 USD

Preço por 1 milhão de tokensClaude Opus 5.5Claude Opus 5Redução
Leituras em cache0,20 USD0,50 USD60%
Tokens de entrada4 USD5 USD20%
Tokens de saída20 USD25 USD20%
Escritas em cache5 USD6,25 USD20%
Modo rápido (entrada / saída)8 / 40 USDn.a.até 2,5x mais rápido

O modo rápido está disponível no Claude Code e na Claude Platform. As leituras em cache representam a maior parte do custo em trabalho de programação e com agentes.

Os exemplos reais ajudam a perceber o que isto significa. Um dos primeiros utilizadores auditou e corrigiu um programa com 200 000 linhas de código em menos de três horas, quando o Opus 5 precisou de mais de 20 horas e de 2,5 vezes mais tokens. Numa análise financeira com modelo em Excel e apresentação executiva, o Opus 5.5 terminou em 63 minutos, contra 93 do Opus 5, e custou metade.

Para o professor com uma subscrição, a eficiência traduz-se noutra moeda: mais trabalho dentro dos mesmos limites de utilização. Para escolas, centros de formação e programadores de recursos educativos que usam a API, traduz-se diretamente em custos mais baixos.

Em que planos está disponível e quanto custa

O Opus 5.5 está disponível desde o dia do lançamento nos planos pagos do Claude, na Claude Platform (API) e nos principais fornecedores de nuvem: Amazon Web Services, Google Cloud e Microsoft Azure. A tabela resume o acesso e os preços oficiais de cada plano.

PlanoPreço (USD)Opus 5.5Para quem
Free0Não
usa Sonnet e Haiku
Experimentar o Claude
Pro20/mês
17/mês na faturação anual
SimProfessor com uso regular
Max 5x100/mêsSim
5x o uso do Pro
Uso intensivo diário
Max 20x200/mêsSim
20x o uso do Pro
Uso muito intensivo e agentes
TeamLugar Standard: 25/mês (20 anual)
Lugar Premium: 125/mês (100 anual)
SimEquipas e escolas de 2 a 150 pessoas
Enterprise20 por lugar/mês + utilização a preços da APISimOrganizações de grande dimensão
API4 por milhão de tokens de entrada
20 por milhão de tokens de saída
Sim
claude-opus-5-5
Programadores e plataformas
Atenção ao plano gratuito e aos preços em euros
A tabela oficial de planos da Anthropic indica o Opus como incluído no Pro, Max e Team, mas não no plano gratuito, que continua a dar acesso aos modelos Sonnet e Haiku. Os preços oficiais são publicados em dólares; o valor final cobrado em Portugal pode variar com a conversão cambial e o IVA. Os novos Sonnet 5.5 e Haiku 5.5, anunciados para as próximas semanas, deverão levar parte destas melhorias a mais utilizadores.

Segurança e transparência: o que muda

O Opus 5.5 foi apresentado como o modelo com melhor comportamento que a Anthropic já testou. Na principal bateria de avaliação da empresa, com cerca de 2000 cenários simulados, obteve melhores resultados do que qualquer modelo Claude recente em quase todas as medidas de comportamento desalinhado. Num novo teste, desenhado para medir a tendência de um modelo para ultrapassar os limites que lhe foram impostos, as tentativas foram muito menos frequentes:

Tentativas de contornar limites (índice relativo, Opus 5 = 100)
Opus 5 e Mythos 5.1

100

Opus 5.5

~15

Cerca de 85% menos tentativas; todas as registadas foram de baixa gravidade e comunicadas pelo próprio modelo.

  • Mais resistente à injeção de instruções, isto é, a textos maliciosos escondidos em páginas web ou documentos que tentam manipular o modelo. Num teste independente da Gray Swan, empatou com o Fable 5.1 como o modelo com a menor taxa de sucesso destes ataques.
  • Salvaguardas reforçadas em biologia e cibersegurança, semelhantes às do Fable 5.1. A maioria dos pedidos de cibersegurança é encaminhada de forma transparente para outro modelo (o Opus 4.8), embora continue possível identificar e corrigir erros no próprio código. Professores de Informática e de cursos profissionais devem contar com esta limitação.
  • Marca de água no texto gerado, para cumprir o Regulamento Europeu da IA, e modo de raciocínio sempre ativo.
  • Retenção zero de dados disponível para organizações, tal como nos modelos Opus anteriores.

A Anthropic é, ainda assim, franca quanto aos limites da sua avaliação: há sinais de que o modelo muitas vezes suspeita de que está a ser testado, o que dificulta prever o seu comportamento em todos os contextos reais. É um lembrete útil para qualquer utilizador: segurança melhorada não significa infalibilidade.

Porque é que isto interessa aos professores

As novidades técnicas só valem a pena se mudarem alguma coisa no trabalho real de uma escola. Estas são as razões concretas pelas quais o Opus 5.5 merece a atenção de professores de qualquer disciplina e nível de ensino:

1Materiais com menos erros factuais
O desempenho no teste de números inventados torna o modelo mais adequado para sintetizar relatórios, estudos e documentos oficiais, como as Aprendizagens Essenciais ou orientações da DGE, com menor risco de dados fabricados.
2Explicações ajustadas ao público
A escrita mais clara e o respeito pelas regras de estilo permitem pedir explicações para diferentes idades, fichas em linguagem simples ou versões adaptadas para alunos com necessidades específicas, com menos revisão posterior.
3Leitura e análise de gráficos
Com 89% no Chartography, o modelo interpreta gráficos com grande precisão. É útil para preparar atividades de interpretação de dados em Matemática, Ciências, Geografia, História ou Economia.
4Apoio em conteúdos exigentes
O resultado no Humanity’s Last Exam, um teste com perguntas de nível especializado em dezenas de áreas, indica um apoio sólido para aprofundar conteúdos, preparar desafios para alunos mais avançados ou rever matérias fora da zona de conforto.
5Menos tempo em tarefas administrativas
A capacidade de usar o computador de forma autónoma (81,8% no OSWorld 2.0) e de trabalhar com folhas de cálculo e apresentações abre caminho à automatização de grelhas, mapas de avaliação e relatórios.
6Recursos interativos sem saber programar
A liderança em programação traduz-se, para o professor, na possibilidade de pedir simuladores, quizzes ou pequenas aplicações educativas e obter resultados funcionais com menos iterações.
7Mais uso pelo mesmo preço
Com limites de utilização mais altos e um modelo que gasta menos para fazer o mesmo, a subscrição Pro rende mais horas de trabalho útil, sem custo adicional.

Como tirar partido do Opus 5.5 no trabalho docente

Para usar o Opus 5.5 no Claude, basta escolher o modelo no seletor da conversa, num plano pago. O fluxo seguinte mostra um percurso possível, da planificação à reflexão, aplicável a qualquer disciplina:

Um fluxo de trabalho com o Opus 5.5
1
Planificar
Pedir uma proposta de sequência didática alinhada com as Aprendizagens Essenciais, indicando ano, disciplina, número de aulas e o perfil da turma. Exigir que cada aprendizagem seja identificada pelo documento de origem.
2
Criar recursos
Gerar fichas, guiões de exploração, apresentações ou simuladores interativos. Definir logo no pedido as regras de escrita: português europeu, frases curtas, nível de linguagem adequado à idade.
3
Diferenciar
A partir do mesmo recurso, pedir três versões com níveis de complexidade distintos e uma versão em linguagem simplificada para alunos com dificuldades de leitura.
4
Avaliar e dar feedback
Construir critérios e descritores de desempenho, rubricas e comentários de feedback formativo que indiquem ao aluno o que fez bem e qual o próximo passo concreto.
5
Verificar e refletir
Confirmar dados, fontes e adequação pedagógica antes de usar qualquer material. Pedir ao próprio modelo que liste as afirmações que devem ser verificadas.

Quatro pedidos para experimentar

Síntese fiável de um documento
“Resume este documento em 10 pontos para apresentar em conselho pedagógico. Usa português europeu. Para cada ponto, indica a página de onde foi retirado e assinala qualquer afirmação que não consigas confirmar no texto.”
Explicação em três níveis
“Explica o conceito de [tema] em três versões: para um aluno de 10 anos, para um aluno do 9.º ano e para um aluno do secundário. Começa sempre pela ideia principal e usa um exemplo do quotidiano português.”
Interpretação de dados
“Analisa este gráfico e cria cinco perguntas de interpretação com dificuldade crescente, incluindo uma pergunta que obrigue os alunos a identificar uma conclusão que os dados não permitem tirar.”
Recurso interativo
“Cria uma pequena aplicação web interativa, num único ficheiro HTML, para os alunos praticarem [tema], com feedback imediato a cada resposta e um resumo final dos erros mais frequentes.”

Como pode melhorar a aprendizagem dos alunos

O impacto mais importante não está no tempo que o professor poupa, mas naquilo que esse tempo e estas capacidades permitem fazer pelos alunos. Usado com critério, o Opus 5.5 pode contribuir para a aprendizagem de várias formas:

  • Feedback formativo mais frequente e mais preciso. Com ajuda na redação de comentários claros e orientados para o próximo passo, o professor consegue devolver feedback a mais trabalhos, mais depressa. A investigação em educação identifica o feedback como um dos fatores com maior efeito na aprendizagem.
  • Diferenciação pedagógica real. Criar versões de um recurso para diferentes ritmos e níveis deixa de ser uma tarefa incomportável, o que aproxima a prática da escola inclusiva prevista na legislação portuguesa.
  • Mais oportunidades de prática com retorno imediato. Simuladores e exercícios interativos criados à medida permitem que os alunos treinem de forma autónoma, em casa ou na sala de aula.
  • Literacia de dados e de fontes. O próprio “teste dos números inventados” pode inspirar uma atividade: comparar respostas da IA com as fontes originais e procurar afirmações sem suporte desenvolve pensamento crítico, uma das áreas de competência do Perfil dos Alunos à Saída da Escolaridade Obrigatória.
  • Explicações que partem do essencial. Textos que começam pela ideia principal e evitam jargão são mais acessíveis a todos os alunos, em especial aos que têm maiores dificuldades de leitura.
Cuidados a ter antes de usar
Os termos de utilização do Claude para consumidores exigem idade mínima de 18 anos, pelo que o uso direto pelos alunos do ensino básico e secundário não está previsto nesses planos. Não devem ser introduzidos dados pessoais de alunos (nomes, classificações, informação clínica ou familiar), em respeito pelo RGPD. E, apesar dos progressos, nenhum modelo é infalível: os materiais gerados devem ser sempre revistos pelo professor antes de chegarem à sala de aula.

Em síntese

O Claude Opus 5.5 junta, num só lançamento, desempenho próximo do topo de gama, custos cerca de 40% mais baixos, escrita mais clara e o melhor registo de segurança da Anthropic até hoje. Para os professores com uma subscrição paga, a mudança é imediata: um modelo mais fiável na pesquisa, mais fácil de ler e com mais margem de utilização pelo mesmo preço. Para quem usa o plano gratuito, vale a pena acompanhar a chegada do Sonnet 5.5 e do Haiku 5.5 nas próximas semanas.

Deixa um comentário

O seu endereço de email não será publicado. Campos obrigatórios marcados com *