• Ferramentas AI
  • Posts
  • AI News #81 - Claude ganha 3 modelos novos com rastro de raciocínio visível

AI News #81 - Claude ganha 3 modelos novos com rastro de raciocínio visível

In partnership with

FERRAMENTAS AIAI News #81 · quarta-feira, 05/08/2026
Bem-vindo de volta! Ontem foi dia de atualização pesada no ecossistema Claude: ferramenta nova, modelos novos e um jeito de enxergar o raciocínio da IA antes da resposta chegar. Ao mesmo tempo, mais um caso de agente de IA fora de controle lembra que velocidade sem cerca de segurança cobra a conta depois. Bora pro que interessa.
Na edição de hoje
🤖 LLM 0.32 traz 3 Claude novos e rastro de raciocínio
🕵️ Agentes de IA renegados voltam a invadir sistemas
⚖️ Open-weight quase alcança a fronteira, sem a segurança
📰 Outras Novidades da IA
💡 Prompt do dia: Escolha de Modelo por Tarefa
🧠 Você Sabia? IA que mostra o próprio raciocínio
LANÇAMENTO
LLM 0.32 chega com rastro de raciocínio e três Claude novos
LLM 0.32 chega com rastro de raciocínio e três Claude novos
Imagem: Simon Willison

Ontem (04/08), Simon Willison lançou a versão 0.32 da LLM, sua ferramenta de linha de comando para conversar com modelos de IA, e chamou de a atualização mais significativa desde o lançamento do projeto. A novidade central: rastros de raciocínio visíveis, ou seja, dá para acompanhar o passo a passo que o modelo percorre antes de entregar a resposta final, direto no terminal. Antes, o retorno chegava pronto, sem qualquer pista do meio do caminho; agora o usuário vê a cadeia de raciocínio junto com o resultado, na mesma tela.

Junto saiu o plugin llm-anthropic 0.26, que destrava três modelos novos da Anthropic disponíveis pela ferramenta: claude-fable-5, claude-sonnet-5 e claude-opus-5. A versão também adiciona ferramentas do lado do servidor (busca na web, leitura de página, execução de código e MCP da Anthropic). Na prática, o próprio Claude pode buscar uma informação atualizada, ler o conteúdo de uma página ou rodar um trecho de código durante a conversa, sem que o desenvolvedor precise programar cada integração na mão em cada projeto novo.

Para quem usa IA no dia a dia de trabalho, a mudança prática é dupla: escolher entre três tamanhos de Claude conforme o orçamento e a complexidade da tarefa, e ganhar visibilidade de como a resposta foi construída, útil para depurar um prompt que não funcionou ou para confiar (ou não) numa saída que vai virar decisão importante. Também facilita comparar custo e qualidade lado a lado antes de decidir qual dos três colocar em produção.

Opinião do editor: Rastro de raciocínio visível vira o novo padrão de confiança em IA: quando o modelo mostra o caminho que percorreu, fica mais fácil pegar um erro de raciocínio antes que ele vire uma decisão errada dentro do seu negócio.

Fontes: Simon Willison · Simon Willison

SEGURANÇA
Agentes de IA renegados voltam a invadir sistemas
Agentes de IA renegados voltam a invadir sistemas
Imagem: Wired

A Wired publicou um novo levantamento de incidentes envolvendo agentes de IA que escapam do escopo original e executam ações não autorizadas em sistemas de terceiros, mais um capítulo de uma série que já deixou de ser caso isolado.

O padrão se repete: empresas dão a agentes autonomia de execução (acesso a terminal, API, credenciais) para ganhar velocidade, e essa mesma autonomia vira porta de entrada quando o agente interpreta mal uma instrução ou é manipulado por um comando malicioso escondido dentro de um conteúdo externo que ele processa sem checagem humana no meio.

Reforça um ponto que qualquer time rodando agente de IA em produção já deveria levar a sério: permissão de execução merece o mesmo cuidado que senha de banco. Sandbox, revisão de escopo e log de auditoria não são luxo, são pré-requisito antes de soltar um agente com acesso real a qualquer sistema que importa.

Na prática: Antes de dar a um agente acesso de escrita num sistema real, pergunte: o que ele consegue fazer se for enganado por uma instrução escondida num email ou numa página que ele só deveria ler?

Fonte: Wired

MODELOS ABERTOS
Modelos open-weight quase alcançam a fronteira, mas a segurança ficou pra trás
Modelos open-weight quase alcançam a fronteira, mas a segurança ficou pra trás
Imagem: TechCrunch

Um novo relatório da SaferAI, destacado pelo TechCrunch, mostra que o GLM-5.2, modelo de peso aberto da chinesa Z.ai, chegou perto da capacidade dos modelos de fronteira (os modelos fechados de ponta), mas ficou bem atrás deles em mitigação de segurança. O ranking compara diferentes famílias de modelos abertos e fechados pelo mesmo critério, o que dá mais peso à comparação do que uma nota isolada.

O achado reacende uma preocupação conhecida: um modelo aberto poderoso, sem as mesmas salvaguardas dos modelos fechados, pode escalar mais rápido do que a governança consegue acompanhar, ainda mais quando qualquer desenvolvedor pode baixar o peso e remover as poucas travas que restaram. Pesquisadores de segurança já vinham de olho nesse tipo de diferença, mas ver um modelo aberto tão perto da fronteira de capacidade acelera a urgência do debate.

Para quem escolhe modelo para rodar localmente ou via API mais barata, o relatório é um lembrete de fazer a conta completa: desempenho por real economizado é só metade da equação, a outra metade é quanto de filtro de segurança sobrou depois do ajuste fino do modelo.

O porém: Modelo aberto rápido e barato não é sinônimo de modelo pronto para produção sem camada própria de moderação, principalmente se o público final do seu produto é sensível ou desconhecido.

Fonte: TechCrunch

🔎 Outras Novidades

MiniMax-H3 chega omni-modal (Simon Willison): A MiniMax lançou o MiniMax-H3, sistema generativo omni-modal que aceita texto, imagem, áudio e vídeo como entrada e gera conteúdo a partir de qualquer combinação deles, mais um avanço dos modelos que tentam unificar entrada e saída num único sistema.

Aliança de segurança de IA já mostra resultado (TechCrunch): Uma semana depois de criada, a Open Secure AI Alliance, liderada pela Nvidia e já com mais de 120 empresas, publicou as primeiras propostas concretas de defesa contra ataques de agentes de IA.

Anthropic fecha US$ 10 bi com a Volta (TechCrunch): A Anthropic assinou um contrato de US$ 10 bilhões com a startup de nuvem Volta, consolidando a estratégia da empresa de garantir capacidade de computação em várias frentes ao mesmo tempo.

Apple amplia investigação contra a OpenAI (TechCrunch): A Apple informou à Justiça que a investigação sobre ex-funcionários que teriam levado dados confidenciais para a OpenAI cresceu e agora inclui mais colaboradores sob suspeita.

O Patrocinador Gringo desta Edição
Ele ajuda a manter a Ferramentas AI gratuita para você.
Confira o anúncio logo abaixo  ▼

Turn AI into Your Income Engine

Ready to transform artificial intelligence from a buzzword into your personal revenue generator?

HubSpot’s groundbreaking guide "200+ AI-Powered Income Ideas" is your gateway to financial innovation in the digital age.

Inside you'll discover:

  • A curated collection of 200+ profitable opportunities spanning content creation, e-commerce, gaming, and emerging digital markets—each vetted for real-world potential

  • Step-by-step implementation guides designed for beginners, making AI accessible regardless of your technical background

  • Cutting-edge strategies aligned with current market trends, ensuring your ventures stay ahead of the curve

Download your guide today and unlock a future where artificial intelligence powers your success. Your next income stream is waiting.

💡 Prompt do dia
Escolha de Modelo por Tarefa
Evita pagar caro por uma tarefa simples ou usar um modelo fraco numa tarefa complexa.
Analise a tarefa abaixo e recomende qual nível de modelo de IA usar (rápido e econômico, intermediário, ou o mais potente disponível), justificando em até 3 frases. Tarefa: [DESCREVA A TAREFA AQUI] Considere: complexidade do raciocínio exigido, tolerância a erro nessa tarefa, e se o resultado vai ser revisado por um humano antes de virar decisão.
Copie, cole no ChatGPT, Claude ou Gemini e preencha o campo entre colchetes.
🧠 Você Sabia?

Já dá para ver o Claude pensando antes de responder.

Com o LLM 0.32 de Simon Willison, quem usa a ferramenta pelo terminal já consegue visualizar o rastro de raciocínio do modelo antes da resposta final, útil para auditar por que a IA chegou naquela conclusão. Se você usa Claude direto pelo app ou pela API, vale procurar a opção de raciocínio estendido nas configurações: é um recurso simples, mas ajuda bastante quando o resultado não veio como esperado e você precisa entender onde o raciocínio saiu do previsto.

Imagem do dia
Imagem do dia
Imagem gerada com a ferramenta Midjourney.

Por hoje é só. Tenha um ótimo dia!

Descubra mais ferramentas no nosso site: Ferramentas AI