1️⃣ Gemini 3.6 Flash cortou tokens e preço de saída O novo modelo custa 1,50 dólares por milhão de tokens de entrada e 7,50 dólares por milhão de saída. A Google diz que usa menos 17% de tokens de saída do que o 3.5 Flash.

💡 Porque importa O preço por token conta pouco se o agent precisar de mais passos. Aqui, a Google promete baixar as duas parcelas da conta.

☕ Conversa de café Os 17% sobrevivem aos vossos tools e prompts, ou só à folha da Google?


2️⃣ Microsoft vai comprar compute europeu à Mistral Um acordo de vários milhares de milhões de dólares prevê milhares de GPUs NVIDIA Vera Rubin na Europa. A capacidade da Mistral vai servir treino, inferência e serviços cloud da Microsoft.

💡 Porque importa Equipas reguladas ganham mais capacidade europeia e opções cloud, ligadas ou totalmente desligadas, sem mudar de stack.

☕ Conversa de café Quantas equipas vão testar o modo desligado antes de o vender como soberania?


3️⃣ Harness pôs evals de agents dentro do CI/CD O Agent DLC junta quality gates, deploy, tracing e controlos de runtime. O harness-evals, que mede correção, segurança e trajetória, ficou open-source.

💡 Porque importa Uma mudança de modelo ou prompt pode falhar o gate antes de chegar a produção. A trajetória do agent também passa a ser testável.

☕ Conversa de café Que score bloqueia o deploy quando o agent acerta pelo caminho errado?