Anthropic lança Claude Fable 5.1 com corte de até 45% em custo de cache
Novo modelo divide desenvolvedores entre o desconto no tráfego repetido e a dúvida sobre superar o Opus 5 em tarefas reais.
Edição: Anderson Gomes
· 4 min de leitura

A Anthropic lançou o Claude Fable 5.1 e o Claude Mythos 5.1, versões gêmeas de um modelo para programação avançada que prometem reduzir em até 45% o custo de tarefas com agentes autônomos. A empresa mantém os preços básicos de entrada e saída inalterados, mas cortou a cobrança de leitura de cache para um quarto do valor original. O anúncio atraiu 1.419 pontos e 1.395 comentários no Hacker News em poucas horas. A mudança atende quem roda fluxos longos de software e precisa controlar gastos com infraestrutura de inteligência artificial.
Desconto em cache agrada quem roda agentes longos
O debate técnico gira em torno do equilíbrio entre custo e precisão real no terminal. Desenvolvedores que operam agentes contínuos comemoraram o novo cálculo de tokens repetidos. Simonw resumiu o impacto prático dessa mudança de arquitetura financeira: "Um pequeno desconto se você usa cache: mesmos preços de entrada e saída, com leituras de cache a um quarto do custo. Isso deve impactar qualquer agente de execução longa, já que chamadas subsequentes se beneficiam de leituras em cache para transcrições anteriores." Para fluxos de trabalho típicos faturados por token, a Anthropic calcula economia média de 25%. Pookieinc destacou esse ponto ao citar os números oficiais: "'Para trabalhos altamente agênticos, a economia frequentemente será muito maior — até aproximadamente 45%.' Muito feliz em ver isso!" A conta fecha melhor para pipelines que reenviam contextos grandes a cada iteração. Menos gasto incentiva execuções mais profundas.
Por trás dessa estrutura de preços está a mesma base compartilhada entre duas variantes: o Claude Fable 5.1 tem disponibilidade geral, enquanto o Claude Mythos 5.1 opera sob programa restrito para segurança defensiva e ciências biológicas. A divisão existe porque filtros antigos barravam comandos legítimos de código. Nas métricas de cibersegurança, a Anthropic afirma que os novos mecanismos de proteção bloqueiam 60% menos falsos positivos do que a geração anterior. O modelo agora encontra vulnerabilidades de software sem criar ferramentas de ataque direto. Para empresas, a companhia prometeu o Enterprise Frontier Safeguards (EFS), que guarda os dados na nuvem do próprio cliente no quarto trimestre do ano e oferece política de retenção zero provisória até a entrega final.
Usuários questionam ganho técnico em relação ao Opus 5
Nem todo engenheiro vê motivo para migrar ou pagar valores elevados. Maxdo contestou a necessidade de adotar o lançamento quando alternativas mais baratas já resolvem problemas cotidianos: "Para ser sincero, com esse preço, nem tenho vontade de testar. Quais são os benefícios para um agente comum de programação? Eu mal tenho erros com o nível 4.8, como grok 4.6, gpt 5.6 sol/terra atrás de roteador. Por que preciso pagar tanto dinheiro por isso? Alguma razão?" A desconfiança aumenta quando o parâmetro de comparação é a própria linha da Anthropic. Eis expôs a dúvida prática de quem programa diariamente: "Não tenho certeza se o Fable vale a pena, pelo menos na versão 5 contra o Opus 5. O Opus supera o Fable em vários benchmarks e, custando o dobro, simplesmente não vi resultados visivelmente melhores em comparação ao Opus." Ele decidiu colocar o Fable 5.1 à prova em sua assinatura 20x Max em um problema travado há uma semana. O teste isolado busca tirar a prova real.
Os dois lados concordam em um ponto central da engenharia: agentes de software só justificam investimentos altos se o modelo não empacar em restrições desnecessárias. Quem abandonou versões anteriores aponta que travas automáticas arruinavam o fluxo de trabalho. Scronkfinkle relatou essa barreira de forma crua: "Alguém conseguiu realizar algo substancial com o Fable em primeiro lugar? Praticamente desisti de usá-lo porque as checagens de alinhamento eram tão sensíveis que quase sempre me jogavam de volta para o Opus." Mesmo nos benchmarks oficiais a disputa permanece acirrada. No Terminal-Bench-Science 0.1, a Anthropic mede o Claude Opus 5 em 29,0% e o Claude Fable 5 em 24,7%, com margem de erro entre 3,5 e 4,5 pontos percentuais. O leaderboard público marca 30,0% para Opus 5 e 21,4% para Fable 5 sob três tentativas por tarefa.
A decisão técnica depende agora do comportamento prático do Fable 5.1 nos modos de esforço Low, Medium e High no Claude Code, Claude Cowork e Claude.ai. Se a leitura barata de cache e a queda nos falsos positivos compensarem a diferença para o Opus 5, equipes de engenharia conseguirão manter agentes autônomos ativos por dias inteiros. Caso contrário, a fatura continuará direcionada a modelos consolidados que resolvem tarefas de ponta a ponta sem exigir iterações corretivas contínuas.
- Modelos e LLMs
- Hacker News
Nvidia separa até oito falantes em áudio com atraso de 0,32 segundo
Com pesos abertos em GGUF e Safetensors, o Nemotron 3 Diarization roda tanto em C++ local quanto em pipelines de transmissão ao vivo.
· 3 min de leitura

Oriveo reúne 15 provedores de IA em app aberto com chave própria
· 3 min de leitura

Jake Schincariol cria pacote com 11 rotinas para Claude gerenciar LinkedIn
· 3 min de leitura
OpenAI testa GPT-5.6 Sol e Codex para calibrar chip quântico no MIT
Pesquisa automatiza medições preliminares em processador de seis qubits, mas ainda depende de intervenção humana quando sinais físicos falham.
· 3 min de leitura