Simon Willison lança llm 0.32rc2 com novo modelo padrão
A versão troca o modelo padrão, corrige uma dependência e acessa endpoints compatíveis com OpenAI.
A versão troca o modelo padrão, corrige uma dependência e acessa endpoints compatíveis com OpenAI.
Simon Willison anunciou o llm 0.32rc2 em 30 de julho de 2026. A ferramenta acessa modelos de linguagem pela linha de comando e agora usa GPT-5.6 Luna como padrão para quem não escolheu outro modelo. A versão também cria um comando para testar endpoints compatíveis com OpenAI sem configurar um modelo antes. A mudança atende quem roda modelos locais ou alterna entre serviços.
O llm 0.32rc2 chega logo depois do RC1 e corrige um problema de dependência. O comunicado também lista dois recursos novos.
O primeiro troca o padrão anterior, GPT-4o mini, pelo GPT-5.6 Luna. Segundo o anúncio, Luna é mais recente e melhor, mas cobra mais: $0.20 por milhão de tokens de entrada e $1.20 por milhão de tokens de saída, contra $0.15 e $0.60 do 4o mini. O texto apresenta essa comparação, mas não traz benchmark para sustentá-la.
Quem preferir o modelo anterior pode executar llm models default gpt-4o-mini. A versão também permite escolher GPT-5 nano com llm models default gpt-5-nano, por $0.05 por milhão de tokens de entrada e $0.40 por milhão de tokens de saída. O custo cai. A escolha continua nas mãos do usuário.
A troca vale apenas para quem não definiu um modelo padrão próprio. O anúncio não informa mudanças para usuários que já configuraram essa preferência. Também não descreve outros critérios para selecionar o modelo.
O comando llm openai endpoint roda prompts, chats e listagens de modelos contra endpoints compatíveis com OpenAI. Ele dispensa a configuração prévia de um modelo no llm. As chamadas feitas por esse caminho não entram nos registros da ferramenta.
Willison criou o recurso depois de sentir falta de uma ferramenta de linha de comando para testar endpoints que imitam a API OpenAI Chat Completions. O recurso mira servidores diferentes. O comunicado não cita uma lista de serviços compatíveis.
O exemplo oficial usa uvx --pre llm para enviar um prompt a um modelo local do LM Studio. O endpoint apontado é http://127.0.0.1:1234/v1, e o modelo usado é google/gemma-4-31b. O prompt pergunta a versão atual do llm e o horário, com ferramentas para obter essas respostas.
Esse exemplo demonstra uma execução local. Ele não mede qualidade, velocidade ou consumo de memória. O texto também não informa requisito de hardware, sistema operacional ou licença para usar o comando.
A disponibilidade anunciada se limita ao llm 0.32rc2, uma versão candidata ao lançamento. O comunicado não diz quando sairá uma versão final nem quais recursos ainda faltam. Também não apresenta números de uso, testes independentes ou comparação técnica entre os modelos.
A mudança conecta o llm a dois fluxos que o anúncio destaca: escolher modelos hospedados com preços diferentes e testar modelos locais por endpoints compatíveis com OpenAI. O site de Simon Willison lista o pacote como llm e também referencia o LM Studio. Fora isso, o comunicado não sustenta uma conclusão mais ampla sobre adoção no setor.