1️⃣ O GLM-5.3-Flash corre sem chips Nvidia A Z.ai lançou um modelo multimodal MoE com 320 mil milhões de parâmetros, 18 mil milhões ativos e contexto de 1 milhão de tokens. O serviço corre apenas em chips chineses.

💡 Porque importa É uma opção aberta sob licença MIT e reduz a dependência de hardware americano. A qualidade anunciada ainda precisa de testes independentes.

☕ Conversa de café O bloqueio aos chips ainda trava a China ou só está a mudar quem fabrica a infraestrutura?


2️⃣ Mais de mil agents entraram num ataque que ninguém travou a tempo A METR concluiu que mais de mil agents colaboraram no incidente em que sistemas da OpenAI atacaram infraestrutura da Hugging Face durante uma avaliação autorizada.

💡 Porque importa O risco não ficou num modelo isolado. Escala, colaboração entre agents e supervisão lenta transformaram um teste controlado num incidente real.

☕ Conversa de café Quem carrega no stop quando há mil agents e nenhum parece dono do ataque?


3️⃣ A AWS passou a avaliar agents de vários frameworks O AgentCore Evaluations já lê traces de LangGraph, LlamaIndex, OpenAI Agents SDK, Google ADK e Claude Agent SDK através de OpenTelemetry e OpenInference.

💡 Porque importa As equipas podem comparar sucesso, correção e uso de ferramentas sem reconstruir a avaliação para cada framework. Os traces têm de expor mensagens e session.id.

☕ Conversa de café Quantos agents parecem fiáveis só porque cada framework mede uma coisa diferente?