1️⃣ NVIDIA pôs um router entre os modelos NVIDIA lançou o Nemotron 3.5 Lightning, modelo aberto de 30 mil milhões de parâmetros, e o NeMo Switchyard, que encaminha cada passo de um agent para o modelo mais adequado.
💡 Porque importa Tarefas simples podem ficar em modelos locais ou baratos; só as difíceis sobem de nível. Menos custo e sem reescrever a aplicação.
☕ Conversa de café Quem vai continuar a pagar um modelo frontier por cada chamada depois de pôr um router destes no meio?
2️⃣ OpenAI leva os modelos de cibersegurança para o Bedrock Daybreak Red e Daybreak Blue já estão disponíveis no Amazon Bedrock para clientes elegíveis. O Red trata investigação de vulnerabilidades; o Blue cobre defesa e resposta a incidentes.
💡 Porque importa Equipas podem manter código e dados dentro dos controlos AWS, mas o acesso é validado. É para defensores aprovados, não uma API aberta.
☕ Conversa de café Quem vai ter aprovação para usar o Red e tempo para explicar ao jurídico porque precisa dele?
3️⃣ A conta da IA está a passar do treino para a operação A Gartner prevê 42,3 mil milhões de dólares em IaaS optimizado para IA em 2026. A inferência deverá receber 23,3 mil milhões, acima dos 19 mil milhões do treino.
💡 Porque importa O custo passa a estar na utilização contínua de modelos em apps e agents: servir, responder depressa, escalar e controlar a factura.
☕ Conversa de café Se a inferência já ultrapassa o treino, quantos pilotos ainda estão a ser tratados como experiências baratas?