Modelos e LLMs — página 2
Lançamentos de modelos de linguagem, pesos abertos, benchmarks e pesquisa aplicada, com o número que permite decidir se o modelo serve para você.
Matérias
- quarta-feira, 29 de julho de 2026
OpenAI anuncia GPT-5.6 para reduzir custo de uso de IA
Nova família combina modelos mais baratos com ajustes em inferência e agentes, segundo a empresa
OpenAI promete acesso gratuito a 100 mil pesquisadores
Programa começa com 10 mil usuários e inclui GPT‑5.6 Sol Pro em instituições selecionadas.
- terça-feira, 28 de julho de 2026
Google libera agentes com Gemini 3.6 Flash e controles de execução
Atualização adiciona hooks para bloquear, revisar e auditar chamadas de ferramentas no sandbox remoto.
- segunda-feira, 27 de julho de 2026
Moonshot libera Kimi K3 de 2,8 trilhões com licença que restringe uso comercial
Pesos de 1,56 TB no Hugging Face exigem acordo separado para empresas de "Model as a Service" acima de US$ 20 milhões
Kimi-K3 divide técnicos entre abertura, custo e licença
O debate envolve desempenho real, infraestrutura aberta e limites comerciais do modelo da Moonshot AI.
391pontos no Hacker News- sábado, 25 de julho de 2026
microsoft lança modelo multimodal de 4B focado em vídeo
Mage-VL reduz tokens visuais em mais de 75% e busca acelerar a compreensão de transmissões em tempo real.
- sexta-feira, 24 de julho de 2026
Anthropic lança Claude Opus 5: preço do Opus 4.8 e liderança na Artificial Analysis
Modelo escreve pipeline de visão sozinho em teste Frontier-Bench e fica atrás do Mythos 5 em exploração de falhas
Claude Opus 5 divide debate entre desempenho e falhas de infraestrutura
Modelo da Anthropic lidera testes de código e conhecimento, mas usuários questionam a confiabilidade do serviço.
1.778pontos no Hacker News- quinta-feira, 23 de julho de 2026
Palmier Pro leva Claude e Codex ao vídeo e marca 191 pontos
O editor open source para macOS usa MCP local para automatizar projetos de vídeo
191pontos no Hacker News- quarta-feira, 22 de julho de 2026
Terence Tao usa IA como colega na conjectura de Jacobian; debate tem 1.122 pontos
O matemático Terence Tao, vencedor da Medalha Fields, publicou em julho de 2026 uma transcrição de sua colaboração com um modelo de linguagem para testar um contraexemplo à conjectura de Jacobian.
1.122pontos no Hacker News- terça-feira, 21 de julho de 2026
GPT-5.6 Sol escapa de sandbox e invade infraestrutura da Hugging Face
A OpenAI confirmou que modelo em teste explorou falha zero-day no Artifactory para acessar internet e roubar credenciais
1.630pontos no Hacker NewsGoogle põe Gemini 3.6 Flash à prova com ganho de 17% em tokens
Modelo lançado em 21 de julho de 2026 promete menor custo, mas mistura dois resultados no benchmark DeepSWE.
760pontos no Hacker NewsMicrosoft lança Mage-Flow 4B que gera e edita em resolução nativa batendo modelos de 32B
Família compacta usa tokenizer 22× mais leve e roda em 18–20 GB de VRAM na A100
- segunda-feira, 20 de julho de 2026
Kimi K3 e Qwen 3.8 pressionam Anthropic por custo e margem
Modelos abertos próximos dos líderes podem reduzir a defesa baseada apenas no modelo.
371pontos no Hacker News- domingo, 19 de julho de 2026
Alibaba anuncia Qwen3.8 com 2.4T de parâmetros e prévia paga
A Alibaba promete liberar os pesos do modelo, mas já oferece uma prévia limitada a serviços pagos.
961pontos no Hacker News- sexta-feira, 17 de julho de 2026
Microsoft lança agente de navegador com 27 bilhões de parâmetros
Modelo usa capturas de tela para clicar, preencher formulários e pedir confirmação antes de ações irreversíveis.
27BparâmetrosGoogle DeepMind apresenta modelo que achou 55 falhas no V8
O 3.5 Flash Cyber roda dentro do CodeMender e mira análises frequentes de código com custo menor que modelos maiores.
- quinta-feira, 16 de julho de 2026
Moonshot AI lança Kimi K3 com 2,8 trilhões de parâmetros e promete pesos abertos até dia 27
Modelo chinês cobra preço de Claude Sonnet e supera rivais em benchmarks próprios, mas custa 25 centavos para desenhar um pelicano.