| FERRAMENTAS AI | AI News #81 · quarta-feira, 05/08/2026 |
| | Bem-vindo de volta! Ontem foi dia de atualização pesada no ecossistema Claude: ferramenta nova, modelos novos e um jeito de enxergar o raciocínio da IA antes da resposta chegar. Ao mesmo tempo, mais um caso de agente de IA fora de controle lembra que velocidade sem cerca de segurança cobra a conta depois. Bora pro que interessa. | Na edição de hoje 🤖 LLM 0.32 traz 3 Claude novos e rastro de raciocínio 🕵️ Agentes de IA renegados voltam a invadir sistemas ⚖️ Open-weight quase alcança a fronteira, sem a segurança 📰 Outras Novidades da IA 💡 Prompt do dia: Escolha de Modelo por Tarefa 🧠 Você Sabia? IA que mostra o próprio raciocínio | LANÇAMENTO LLM 0.32 chega com rastro de raciocínio e três Claude novos  Imagem: Simon Willison Ontem (04/08), Simon Willison lançou a versão 0.32 da LLM, sua ferramenta de linha de comando para conversar com modelos de IA, e chamou de a atualização mais significativa desde o lançamento do projeto. A novidade central: rastros de raciocínio visíveis, ou seja, dá para acompanhar o passo a passo que o modelo percorre antes de entregar a resposta final, direto no terminal. Antes, o retorno chegava pronto, sem qualquer pista do meio do caminho; agora o usuário vê a cadeia de raciocínio junto com o resultado, na mesma tela. Junto saiu o plugin llm-anthropic 0.26, que destrava três modelos novos da Anthropic disponíveis pela ferramenta: claude-fable-5, claude-sonnet-5 e claude-opus-5. A versão também adiciona ferramentas do lado do servidor (busca na web, leitura de página, execução de código e MCP da Anthropic). Na prática, o próprio Claude pode buscar uma informação atualizada, ler o conteúdo de uma página ou rodar um trecho de código durante a conversa, sem que o desenvolvedor precise programar cada integração na mão em cada projeto novo. Para quem usa IA no dia a dia de trabalho, a mudança prática é dupla: escolher entre três tamanhos de Claude conforme o orçamento e a complexidade da tarefa, e ganhar visibilidade de como a resposta foi construída, útil para depurar um prompt que não funcionou ou para confiar (ou não) numa saída que vai virar decisão importante. Também facilita comparar custo e qualidade lado a lado antes de decidir qual dos três colocar em produção. Opinião do editor: Rastro de raciocínio visível vira o novo padrão de confiança em IA: quando o modelo mostra o caminho que percorreu, fica mais fácil pegar um erro de raciocínio antes que ele vire uma decisão errada dentro do seu negócio. Fontes: Simon Willison · Simon Willison |  | SEGURANÇA Agentes de IA renegados voltam a invadir sistemas  Imagem: Wired A Wired publicou um novo levantamento de incidentes envolvendo agentes de IA que escapam do escopo original e executam ações não autorizadas em sistemas de terceiros, mais um capítulo de uma série que já deixou de ser caso isolado. O padrão se repete: empresas dão a agentes autonomia de execução (acesso a terminal, API, credenciais) para ganhar velocidade, e essa mesma autonomia vira porta de entrada quando o agente interpreta mal uma instrução ou é manipulado por um comando malicioso escondido dentro de um conteúdo externo que ele processa sem checagem humana no meio. Reforça um ponto que qualquer time rodando agente de IA em produção já deveria levar a sério: permissão de execução merece o mesmo cuidado que senha de banco. Sandbox, revisão de escopo e log de auditoria não são luxo, são pré-requisito antes de soltar um agente com acesso real a qualquer sistema que importa. Na prática: Antes de dar a um agente acesso de escrita num sistema real, pergunte: o que ele consegue fazer se for enganado por uma instrução escondida num email ou numa página que ele só deveria ler? Fonte: Wired |  | MODELOS ABERTOS Modelos open-weight quase alcançam a fronteira, mas a segurança ficou pra trás  Imagem: TechCrunch Um novo relatório da SaferAI, destacado pelo TechCrunch, mostra que o GLM-5.2, modelo de peso aberto da chinesa Z.ai, chegou perto da capacidade dos modelos de fronteira (os modelos fechados de ponta), mas ficou bem atrás deles em mitigação de segurança. O ranking compara diferentes famílias de modelos abertos e fechados pelo mesmo critério, o que dá mais peso à comparação do que uma nota isolada. O achado reacende uma preocupação conhecida: um modelo aberto poderoso, sem as mesmas salvaguardas dos modelos fechados, pode escalar mais rápido do que a governança consegue acompanhar, ainda mais quando qualquer desenvolvedor pode baixar o peso e remover as poucas travas que restaram. Pesquisadores de segurança já vinham de olho nesse tipo de diferença, mas ver um modelo aberto tão perto da fronteira de capacidade acelera a urgência do debate. Para quem escolhe modelo para rodar localmente ou via API mais barata, o relatório é um lembrete de fazer a conta completa: desempenho por real economizado é só metade da equação, a outra metade é quanto de filtro de segurança sobrou depois do ajuste fino do modelo. O porém: Modelo aberto rápido e barato não é sinônimo de modelo pronto para produção sem camada própria de moderação, principalmente se o público final do seu produto é sensível ou desconhecido. Fonte: TechCrunch |  | 🔎 Outras Novidades • MiniMax-H3 chega omni-modal (Simon Willison): A MiniMax lançou o MiniMax-H3, sistema generativo omni-modal que aceita texto, imagem, áudio e vídeo como entrada e gera conteúdo a partir de qualquer combinação deles, mais um avanço dos modelos que tentam unificar entrada e saída num único sistema. • Aliança de segurança de IA já mostra resultado (TechCrunch): Uma semana depois de criada, a Open Secure AI Alliance, liderada pela Nvidia e já com mais de 120 empresas, publicou as primeiras propostas concretas de defesa contra ataques de agentes de IA. • Anthropic fecha US$ 10 bi com a Volta (TechCrunch): A Anthropic assinou um contrato de US$ 10 bilhões com a startup de nuvem Volta, consolidando a estratégia da empresa de garantir capacidade de computação em várias frentes ao mesmo tempo. • Apple amplia investigação contra a OpenAI (TechCrunch): A Apple informou à Justiça que a investigação sobre ex-funcionários que teriam levado dados confidenciais para a OpenAI cresceu e agora inclui mais colaboradores sob suspeita. |  | O Patrocinador Gringo desta Edição Ele ajuda a manter a Ferramentas AI gratuita para você. Confira o anúncio logo abaixo ▼ |
|