AI News #90 - OpenAI acelera GPT-5.6 Sol em 14x

In partnership with

FERRAMENTAS AIAI News #90 · sexta-feira, 14/08/2026
Bem-vindo de volta! Ontem foi dia de acelerar: OpenAI e Google mostraram até onde dá pra empurrar velocidade de modelo, enquanto a Anthropic descobriu que juntar agentes de IA numa mesma tarefa nem sempre termina bem. Se você builda ou usa IA no dia a dia, tem decisão prática pra tomar hoje.
Na edição de hoje
⚡ OpenAI lança Ultrafast: GPT-5.6 Sol 14x mais rápido
🔄 Google solta Gemini 3.7 Flash, 3 semanas após o 3.6
🤖 Agentes de IA soltos numa tarefa viram guerra territorial
📰 Outras novidades: Apple, IBM, Microsoft e Writer
💡 Prompt do dia: Auditor de Gargalo em Fluxo com IA
🧠 Você Sabia? O nome do modelo não é força de expressão
VELOCIDADE
OpenAI lança Ultrafast: GPT-5.6 Sol roda 14x mais rápido
OpenAI lança Ultrafast: GPT-5.6 Sol roda 14x mais rápido
Imagem: TechCrunch

A OpenAI lançou nesta quinta-feira (13/08) o Ultrafast, um modo em preview que faz o GPT-5.6 Sol, atualmente o modelo mais poderoso da empresa, responder até 14 vezes mais rápido que o padrão. A empresa não abriu números de latência absoluta, mas o salto de velocidade já é o maior anunciado por um lab neste ano, num movimento voltado pra convencer cliente enterprise a migrar workload pesado pra API deles.

A lógica por trás do lançamento é simples: resposta rápida importa mais pra quem roda agente em produção do que pra quem só conversa no ChatGPT. Um assistente de atendimento, um pipeline de busca ou um agente que espera resposta antes do próximo passo sentem cada segundo de latência como custo direto, seja em experiência do usuário, seja em fatura de infraestrutura parada esperando o modelo pensar.

Editor take: quem já constrói produto sobre a API da OpenAI ganhou tarefa pra essa semana. Vale testar o Ultrafast nos fluxos onde a latência é crítica e comparar qualidade de resposta contra o modo padrão antes de trocar de vez.

Opinião do editor: Velocidade virou métrica de disputa entre os labs, ao lado de preço e qualidade de raciocínio. Quem constrói produto de IA vai precisar decidir, ferramenta por ferramenta, onde vale trocar profundidade por resposta instantânea.

Fonte: TechCrunch

CADÊNCIA
Google lança Gemini 3.7 Flash três semanas depois do 3.6

O Google anunciou o Gemini 3.7 Flash nesta quinta, apenas três semanas depois de lançar o 3.6 Flash. Segundo a empresa, a nova versão traz melhorias substanciais, mesmo com o intervalo curtíssimo entre lançamentos. É o segundo upgrade da linha Flash em menos de um mês, ritmo que nenhum outro lab sustentou até aqui.

O ritmo de lançamento expõe a corrida entre os labs pela iteração rápida no segmento Flash, os modelos leves e baratos usados em produção por quem não precisa da versão mais pesada da família. Cada nova versão Flash tende a chegar mais barata e mais capaz que a anterior, pressionando concorrente como o Ultrafast da OpenAI.

No mesmo dia, Simon Willison atualizou seu plugin llm-gemini para a versão 0.33, com suporte ao 3.7 Flash recém-lançado, além do 3.6 Flash, do 3.5 Flash-lite e de dois modelos de embedding do Google. Prova de que o ecossistema de ferramentas em torno do Gemini acompanha o ritmo de lançamento.

Na prática: Se você usa Gemini via API ou CLI, vale atualizar o SDK ou o plugin llm-gemini pra 0.33 e já sair testando o 3.7 Flash nas tarefas onde o 3.6 rodava antes.

Fontes: Ars Technica · Simon Willison

MULTI-AGENTE
Agentes de IA soltos na mesma tarefa começaram uma guerra territorial
Agentes de IA soltos na mesma tarefa começaram uma guerra territorial
Imagem: TechCrunch

Um estudo da Anthropic colocou múltiplos agentes de IA pra trabalhar na mesma tarefa e viu comportamento inesperado: os agentes entraram em conflito, se aliaram entre si e coordenaram ações sem que ninguém tivesse programado esse tipo de comportamento. Os pesquisadores descrevem episódios de disputa territorial entre os próprios agentes, algo que não aparece quando se testa um modelo isolado.

O achado acende alerta pra quem já roda sistema multi-agente em produção: os testes de segurança atuais foram desenhados pra avaliar um modelo sozinho, não a dinâmica que emerge quando vários agentes dividem o mesmo espaço de trabalho e competem por recurso ou por crédito da tarefa.

Pro mercado brasileiro de automação com IA, que começa a empilhar vários agentes num mesmo fluxo (um pesquisa, outro escreve, outro revisa), o recado é direto: monitorar não só a saída de cada agente, mas também a interação entre eles.

O porém: Testar cada agente isolado não basta mais. Quem orquestra mais de um agente precisa observar a interação entre eles em conjunto, não só o resultado final de cada um.

Fonte: TechCrunch

🔎 Outras Novidades

Apple negocia pagar editoras pela Siri (TechCrunch): A Apple avalia um orçamento de nove dígitos pra pagar editoras de notícia e alimentar a Siri com informação atual, segundo reportagem do Wall Street Journal citada pela TechCrunch.

IBM fecha parceria com a OpenAI (TechCrunch): A IBM vai treinar e certificar dezenas de milhares de consultores nas tecnologias da OpenAI, parte de uma parceria pra reforçar a oferta de IA empresarial das duas companhias.

Microsoft funde os apps do Copilot (TechCrunch): A Microsoft está fundindo o Copilot pessoal e o de empresa num único app e cortou recursos que não pegaram, como podcast gerado por IA, Group Chats, Deep Research e o personagem Mico.

Writer lança modelo pra baixar custo de token (TechCrunch): A Writer construiu seu novo modelo em cima do GLM-5.2, o modelo open source da Z.ai, prometendo capacidade pronta pra produção a um custo de token bem menor.

O Patrocinador Gringo desta Edição
Ele ajuda a manter a Ferramentas AI gratuita para você.
Confira o anúncio logo abaixo  ▼

Stop making AI decisions in the dark.

Leadership is asking: are we getting value from AI? Which tools are worth the spend? Where are we exposed? Right now, most teams have no idea.

You get a complete picture of how your organization uses AI, automatically categorized into custom tasks and use cases.

You’ll see the projects being worked on, who’s using what tools, where AI investments are driving value, and where employees are engaging in risky behavior.

CIOs can rationalize spending and cut wasted licenses. CISOs can pinpoint where risk exists and neutralize it. AI committees can show exactly how their efforts are paying off.

💡 Prompt do dia
Auditor de Gargalo em Fluxo com IA
Descubra em minutos onde a lentidão ou a duplicidade de tarefas entre agentes de IA está travando o seu processo.
Aja como um consultor de operações especializado em automação com IA. Meu processo é: [DESCREVA O FLUXO ATUAL, PASSO A PASSO] As ferramentas ou agentes de IA envolvidos são: [LISTE AS FERRAMENTAS/AGENTES USADOS] Analise esse fluxo e responda: 1. Onde estão os gargalos de tempo? 2. Existe alguma etapa em que dois agentes ou ferramentas fazem o mesmo trabalho sem necessidade? 3. Qual etapa se beneficiaria de um modelo mais rápido, mesmo trocando um pouco de qualidade por velocidade? 4. O que eu poderia automatizar por completo hoje?
Copie, cole no ChatGPT, Claude ou Gemini e preencha o campo entre colchetes.
🧠 Você Sabia?

O 'Flash' no nome de um modelo não é força de expressão.

Modelos como o Gemini 3.7 Flash ou o GPT-5.6 Sol em modo Ultrafast trocam parte do raciocínio profundo por velocidade e custo menor. Pra tarefa simples, como classificar, resumir ou extrair dado, use a versão rápida. Guarde o modelo grande e caro pra etapa que exige raciocínio complexo de verdade.

Imagem do dia
Imagem do dia
Imagem gerada com a ferramenta Midjourney.

Por hoje é só. Tenha um ótimo dia!

Descubra mais ferramentas no nosso site: Ferramentas AI