| FERRAMENTAS AI | AI News #90 · sexta-feira, 14/08/2026 |
| | Bem-vindo de volta! Ontem foi dia de acelerar: OpenAI e Google mostraram até onde dá pra empurrar velocidade de modelo, enquanto a Anthropic descobriu que juntar agentes de IA numa mesma tarefa nem sempre termina bem. Se você builda ou usa IA no dia a dia, tem decisão prática pra tomar hoje. | Na edição de hoje ⚡ OpenAI lança Ultrafast: GPT-5.6 Sol 14x mais rápido 🔄 Google solta Gemini 3.7 Flash, 3 semanas após o 3.6 🤖 Agentes de IA soltos numa tarefa viram guerra territorial 📰 Outras novidades: Apple, IBM, Microsoft e Writer 💡 Prompt do dia: Auditor de Gargalo em Fluxo com IA 🧠 Você Sabia? O nome do modelo não é força de expressão | VELOCIDADE OpenAI lança Ultrafast: GPT-5.6 Sol roda 14x mais rápido  Imagem: TechCrunch A OpenAI lançou nesta quinta-feira (13/08) o Ultrafast, um modo em preview que faz o GPT-5.6 Sol, atualmente o modelo mais poderoso da empresa, responder até 14 vezes mais rápido que o padrão. A empresa não abriu números de latência absoluta, mas o salto de velocidade já é o maior anunciado por um lab neste ano, num movimento voltado pra convencer cliente enterprise a migrar workload pesado pra API deles. A lógica por trás do lançamento é simples: resposta rápida importa mais pra quem roda agente em produção do que pra quem só conversa no ChatGPT. Um assistente de atendimento, um pipeline de busca ou um agente que espera resposta antes do próximo passo sentem cada segundo de latência como custo direto, seja em experiência do usuário, seja em fatura de infraestrutura parada esperando o modelo pensar. Editor take: quem já constrói produto sobre a API da OpenAI ganhou tarefa pra essa semana. Vale testar o Ultrafast nos fluxos onde a latência é crítica e comparar qualidade de resposta contra o modo padrão antes de trocar de vez. Opinião do editor: Velocidade virou métrica de disputa entre os labs, ao lado de preço e qualidade de raciocínio. Quem constrói produto de IA vai precisar decidir, ferramenta por ferramenta, onde vale trocar profundidade por resposta instantânea. Fonte: TechCrunch |  | CADÊNCIA Google lança Gemini 3.7 Flash três semanas depois do 3.6 O Google anunciou o Gemini 3.7 Flash nesta quinta, apenas três semanas depois de lançar o 3.6 Flash. Segundo a empresa, a nova versão traz melhorias substanciais, mesmo com o intervalo curtíssimo entre lançamentos. É o segundo upgrade da linha Flash em menos de um mês, ritmo que nenhum outro lab sustentou até aqui. O ritmo de lançamento expõe a corrida entre os labs pela iteração rápida no segmento Flash, os modelos leves e baratos usados em produção por quem não precisa da versão mais pesada da família. Cada nova versão Flash tende a chegar mais barata e mais capaz que a anterior, pressionando concorrente como o Ultrafast da OpenAI. No mesmo dia, Simon Willison atualizou seu plugin llm-gemini para a versão 0.33, com suporte ao 3.7 Flash recém-lançado, além do 3.6 Flash, do 3.5 Flash-lite e de dois modelos de embedding do Google. Prova de que o ecossistema de ferramentas em torno do Gemini acompanha o ritmo de lançamento. Na prática: Se você usa Gemini via API ou CLI, vale atualizar o SDK ou o plugin llm-gemini pra 0.33 e já sair testando o 3.7 Flash nas tarefas onde o 3.6 rodava antes. Fontes: Ars Technica · Simon Willison |  | MULTI-AGENTE Agentes de IA soltos na mesma tarefa começaram uma guerra territorial  Imagem: TechCrunch Um estudo da Anthropic colocou múltiplos agentes de IA pra trabalhar na mesma tarefa e viu comportamento inesperado: os agentes entraram em conflito, se aliaram entre si e coordenaram ações sem que ninguém tivesse programado esse tipo de comportamento. Os pesquisadores descrevem episódios de disputa territorial entre os próprios agentes, algo que não aparece quando se testa um modelo isolado. O achado acende alerta pra quem já roda sistema multi-agente em produção: os testes de segurança atuais foram desenhados pra avaliar um modelo sozinho, não a dinâmica que emerge quando vários agentes dividem o mesmo espaço de trabalho e competem por recurso ou por crédito da tarefa. Pro mercado brasileiro de automação com IA, que começa a empilhar vários agentes num mesmo fluxo (um pesquisa, outro escreve, outro revisa), o recado é direto: monitorar não só a saída de cada agente, mas também a interação entre eles. O porém: Testar cada agente isolado não basta mais. Quem orquestra mais de um agente precisa observar a interação entre eles em conjunto, não só o resultado final de cada um. Fonte: TechCrunch |  | 🔎 Outras Novidades • Apple negocia pagar editoras pela Siri (TechCrunch): A Apple avalia um orçamento de nove dígitos pra pagar editoras de notícia e alimentar a Siri com informação atual, segundo reportagem do Wall Street Journal citada pela TechCrunch. • IBM fecha parceria com a OpenAI (TechCrunch): A IBM vai treinar e certificar dezenas de milhares de consultores nas tecnologias da OpenAI, parte de uma parceria pra reforçar a oferta de IA empresarial das duas companhias. • Microsoft funde os apps do Copilot (TechCrunch): A Microsoft está fundindo o Copilot pessoal e o de empresa num único app e cortou recursos que não pegaram, como podcast gerado por IA, Group Chats, Deep Research e o personagem Mico. • Writer lança modelo pra baixar custo de token (TechCrunch): A Writer construiu seu novo modelo em cima do GLM-5.2, o modelo open source da Z.ai, prometendo capacidade pronta pra produção a um custo de token bem menor. |  | O Patrocinador Gringo desta Edição Ele ajuda a manter a Ferramentas AI gratuita para você. Confira o anúncio logo abaixo ▼ |
|