Modelos e LLMs — página 2
Lançamentos de modelos de linguagem, pesos abertos, benchmarks e pesquisa aplicada, com o número que permite decidir se o modelo serve para você.
Matérias
- quarta-feira, 23 de setembro de 2026
Claude Opus 5.5 lidera ranking de inteligência, mas modo "max" divide desenvolvedores
O modelo mais recente da Anthropic tirou 58 pontos no Artificial Analysis Intelligence Index, colocando-se em primeiro lugar entre 212 modelos avaliados.
295pontos no Hacker News- terça-feira, 22 de setembro de 2026
Ferramenta de Simon Willison permite salvar chaves de APIs sem riscos de vazamento
---
Jev Ultrafast da Browser Use atrai 17 mil estrelas em apenas cinco dias
O agente web de código aberto executa tarefas no navegador em segundos usando modelos de linguagem pequenos e um espaço de ação dinâmico.
17.338estrelas no GitHub- segunda-feira, 17 de agosto de 2026
Qwen publica modelo de 2,4 trilhões e divide usuários locais
A arquitetura ativa 95 bilhões de parâmetros por vez, mas exige até 4,9 TB na versão BF16.
711pontos no Hacker NewsDeepSeek lança modelo V4-Pro com 66 arquivos de pesos
Versão melhora tarefas com agentes e chega sob licença MIT, com 25.006 downloads no mês.
Qwen lança modelo de visão com 27 bilhões de parâmetros
Modelo aberto entende imagens e vídeos, roda com pesos FP8 e já soma 495.646 downloads no mês.
27BparâmetrosOpenAI acelera GPT-5.6 Sol em até 14 vezes com nova API
Camada Ultrafast usa hardware da Cerebras e chega a 750 tokens por segundo, mas ainda está em prévia restrita.
OpenAI promete reduzir custo de agentes de IA com GPT-5.6
Guia apresenta modelos menores, novos controles de API e ganhos em testes próprios da empresa.
DeepSeek Harness chega ao Hacker News com 734 pontos e 309 comentários
A prévia modulariza agentes com plugins, mas ainda não mostra ganhos sobre outros harnesses.
734pontos no Hacker NewsGoogle põe Gemini 3.7 Flash no centro de uma disputa de preço
Modelo melhora benchmarks de código e agentes, mas enfrenta rivais mais baratos e dúvidas sobre custo por tarefa.
967pontos no Hacker NewsAnthropic divide técnicos ao marcar texto de Claude por palavras
A técnica troca caracteres invisíveis por escolhas de tokens detectáveis depois.
308pontos no Hacker NewsAlibaba lança modelo Qwen de 27B com visão e licença Apache 2
Modelo roda localmente em arquivo de 17 GB, mas o modo padrão gasta tempo demais raciocinando.
- terça-feira, 11 de agosto de 2026
Cactus põe modelo de 14 MB no centro do debate sobre IA de borda
Needle 2 roda em dispositivos baratos, mas o debate questiona sua competência fora de tarefas restritas.
426pontos no Hacker News- segunda-feira, 10 de agosto de 2026
Alibaba planeja cobrar receita de empresas que usam o Qwen
A regra deve atingir companhias maiores que vendem o modelo como serviço; a taxa ainda não foi definida.
Meta lança modelo multimodal de 30 bilhões para agentes locais
Muse Glimmer combina texto, imagens, ferramentas e recuperação de falhas em um modelo distribuído sob licença Apache 2.0.
30Bparâmetros- domingo, 9 de agosto de 2026
Simon Willison lança LLM 0.32 com rastros de raciocínio
Nova versão também conecta ferramentas de provedores, muda os registros SQLite e amplia a API Python.
Alibaba lança Qwen3.8-Max com 2.4 trilhões de parâmetros
DeepSeek reduz o preço por token, enquanto Alibaba aposta em um modelo esparso para baixar o custo de uso.
OpenAI amplia GPT-5.6 Luna grátis e ajusta Sol no ChatGPT
Usuários pagos ganham controle sobre o raciocínio; contas gratuitas terão mais acesso a chats de texto.