Simon Willison muda modelo padrão do llm na versão 0.32rc2
A atualização troca o GPT-4o mini pelo GPT-5.6 Luna e adiciona acesso direto a endpoints compatíveis com OpenAI.
A atualização troca o GPT-4o mini pelo GPT-5.6 Luna e adiciona acesso direto a endpoints compatíveis com OpenAI.
Simon Willison lançou o llm 0.32rc2 em 30th July 2026. A ferramenta de linha de comando agora usa o GPT-5.6 Luna como modelo padrão para quem não escolheu outro. A versão também permite testar prompts, conversas e listas de modelos em endpoints compatíveis com OpenAI sem configurar um modelo antes. A mudança atende quem usa a ferramenta para acessar modelos remotos ou serviços locais.
O GPT-5.6 Luna substitui o GPT-4o mini como padrão. O anúncio descreve Luna como um modelo mais recente e melhor, mas não apresenta benchmark para sustentar a comparação. O custo informado para Luna é de $0.20 por milhão de tokens de entrada e $1.20 por milhão de tokens de saída.
O GPT-4o mini custa $0.15 por milhão de tokens de entrada e $0.60 por milhão de tokens de saída. Quem preferir o modelo anterior pode executar llm models default gpt-4o-mini. O comando mantém a escolha explícita.
Também existe uma alternativa mais barata. O usuário pode definir o GPT-5 nano com llm models default gpt-5-nano, por $0.05 por milhão de tokens de entrada e $0.40 por milhão de tokens de saída. A versão só altera o padrão para quem ainda não havia definido um modelo próprio.
O release corrige ainda um problema de dependência. Simon Willison não informa qual pacote causava o erro nem em quais ambientes o problema aparecia. O texto apresenta a correção junto com os dois recursos novos, mas não mede o efeito da mudança.
O comando llm openai endpoint envia prompts, abre chats e lista modelos em endpoints arbitrários compatíveis com OpenAI. O usuário não precisa cadastrar antes um modelo no llm. Essas chamadas não entram nos registros da ferramenta, segundo o anúncio.
Simon Willison diz que criou o recurso após sentir falta de uma ferramenta de linha de comando clara para testar endpoints que imitam a API Chat Completions da OpenAI. A justificativa é uma declaração do autor, não um teste independente. O comunicado também não informa limites de compatibilidade entre implementações.
O anúncio mostra uma execução com o LM Studio e um modelo local. O exemplo usa uvx --pre llm openai endpoint http://127.0.0.1:1234/v1, aponta para google/gemma-4-31b e fornece as ferramentas llm_version e llm_time com a opção -T. O prompt pede a versão atual do llm e o horário.
A demonstração indica que o comando consegue chamar ferramentas durante a consulta. Ela não comprova suporte geral a qualquer servidor compatível com OpenAI. O texto também não publica o resultado completo da execução, apenas aponta para uma saída associada ao exemplo.
O recurso pode rodar sem uma instalação permanente do llm. Simon Willison fornece uma linha única com uvx --pre, mas o anúncio não detalha os requisitos do ambiente nem informa quais sistemas operacionais suportam o procedimento. A versão continua identificada como 0.32rc2, uma segunda release candidate, e o comunicado não anuncia a versão final.