Modelos e LLMs

Simon Willison lança llm 0.32rc2 com novo modelo padrão

A versão troca o modelo padrão, corrige uma dependência e acessa endpoints compatíveis com OpenAI.

Reprodução · developers.openai.com

Simon Willison anunciou o llm 0.32rc2 em 30 de julho de 2026. A ferramenta acessa modelos de linguagem pela linha de comando e agora usa GPT-5.6 Luna como padrão para quem não escolheu outro modelo. A versão também cria um comando para testar endpoints compatíveis com OpenAI sem configurar um modelo antes. A mudança atende quem roda modelos locais ou alterna entre serviços.

GPT-5.6 Luna vira padrão, mas custa mais

O llm 0.32rc2 chega logo depois do RC1 e corrige um problema de dependência. O comunicado também lista dois recursos novos.

O primeiro troca o padrão anterior, GPT-4o mini, pelo GPT-5.6 Luna. Segundo o anúncio, Luna é mais recente e melhor, mas cobra mais: $0.20 por milhão de tokens de entrada e $1.20 por milhão de tokens de saída, contra $0.15 e $0.60 do 4o mini. O texto apresenta essa comparação, mas não traz benchmark para sustentá-la.

Quem preferir o modelo anterior pode executar llm models default gpt-4o-mini. A versão também permite escolher GPT-5 nano com llm models default gpt-5-nano, por $0.05 por milhão de tokens de entrada e $0.40 por milhão de tokens de saída. O custo cai. A escolha continua nas mãos do usuário.

A troca vale apenas para quem não definiu um modelo padrão próprio. O anúncio não informa mudanças para usuários que já configuraram essa preferência. Também não descreve outros critérios para selecionar o modelo.

Novo comando testa endpoints sem registrar chamadas

O comando llm openai endpoint roda prompts, chats e listagens de modelos contra endpoints compatíveis com OpenAI. Ele dispensa a configuração prévia de um modelo no llm. As chamadas feitas por esse caminho não entram nos registros da ferramenta.

Willison criou o recurso depois de sentir falta de uma ferramenta de linha de comando para testar endpoints que imitam a API OpenAI Chat Completions. O recurso mira servidores diferentes. O comunicado não cita uma lista de serviços compatíveis.

O exemplo oficial usa uvx --pre llm para enviar um prompt a um modelo local do LM Studio. O endpoint apontado é http://127.0.0.1:1234/v1, e o modelo usado é google/gemma-4-31b. O prompt pergunta a versão atual do llm e o horário, com ferramentas para obter essas respostas.

Esse exemplo demonstra uma execução local. Ele não mede qualidade, velocidade ou consumo de memória. O texto também não informa requisito de hardware, sistema operacional ou licença para usar o comando.

A disponibilidade anunciada se limita ao llm 0.32rc2, uma versão candidata ao lançamento. O comunicado não diz quando sairá uma versão final nem quais recursos ainda faltam. Também não apresenta números de uso, testes independentes ou comparação técnica entre os modelos.

A mudança conecta o llm a dois fluxos que o anúncio destaca: escolher modelos hospedados com preços diferentes e testar modelos locais por endpoints compatíveis com OpenAI. O site de Simon Willison lista o pacote como llm e também referencia o LM Studio. Fora isso, o comunicado não sustenta uma conclusão mais ampla sobre adoção no setor.

Fontes

Simon WillisonModelos e LLMs
Como fazemos: nossa equipe monitora diariamente os repositórios de código aberto em maior alta e produz esta cobertura com apoio de modelos de linguagem, sempre a partir de dados verificados na fonte primária — repositório, documentação oficial e ranking público. Os números de estrelas e a posição no ranking refletem o momento da coleta. Entenda o método.