1️⃣ NVIDIA pôs um router entre os modelos NVIDIA lançou o Nemotron 3.5 Lightning, modelo aberto de 30 mil milhões de parâmetros, e o NeMo Switchyard, que encaminha cada passo de um agent para o modelo mais adequado.

💡 Porque importa Tarefas simples podem ficar em modelos locais ou baratos; só as difíceis sobem de nível. Menos custo e sem reescrever a aplicação.

☕ Conversa de café Quem vai continuar a pagar um modelo frontier por cada chamada depois de pôr um router destes no meio?


2️⃣ OpenAI leva os modelos de cibersegurança para o Bedrock Daybreak Red e Daybreak Blue já estão disponíveis no Amazon Bedrock para clientes elegíveis. O Red trata investigação de vulnerabilidades; o Blue cobre defesa e resposta a incidentes.

💡 Porque importa Equipas podem manter código e dados dentro dos controlos AWS, mas o acesso é validado. É para defensores aprovados, não uma API aberta.

☕ Conversa de café Quem vai ter aprovação para usar o Red e tempo para explicar ao jurídico porque precisa dele?


3️⃣ A conta da IA está a passar do treino para a operação A Gartner prevê 42,3 mil milhões de dólares em IaaS optimizado para IA em 2026. A inferência deverá receber 23,3 mil milhões, acima dos 19 mil milhões do treino.

💡 Porque importa O custo passa a estar na utilização contínua de modelos em apps e agents: servir, responder depressa, escalar e controlar a factura.

☕ Conversa de café Se a inferência já ultrapassa o treino, quantos pilotos ainda estão a ser tratados como experiências baratas?