1️⃣ Qwen trouxe o raciocínio aberto para um portátil O Qwen 3.8 27B tem pesos abertos, visão, licença Apache 2.0 e contexto nativo de 262 mil tokens. O esforço de raciocínio pode ser ajustado ou desligado.

💡 Porque importa Cabe em máquinas bem equipadas, mas o modo de raciocínio pode gastar tempo e contexto a mais. A configuração também precisa de teste.

☕ Conversa de café Quem vai reparar nos 22 mil tokens de raciocínio antes de culpar o portátil?


2️⃣ A NVIDIA fez um modelo pequeno para trabalho comprido O Nemotron 3.5 Lightning tem 30 mil milhões de parâmetros, mas ativa 3 mil milhões por token. Suporta até 1 milhão de tokens de contexto e corre localmente.

💡 Porque importa Foi desenhado para os passos repetidos de agents sempre ligados. Menos modelo por chamada pode baixar a espera sem trocar todo o sistema.

☕ Conversa de café Um milhão de tokens resolve o histórico, mas quem limpa as decisões erradas lá no meio?


3️⃣ Hazmat tirou as chaves de casa aos coding agents O Hazmat corre Codex, Claude Code, Cursor Agent e outros num utilizador separado. Só partilha o projeto autorizado e pode limitar ficheiros e rede.

💡 Porque importa Se o agent for enganado ou errar, as chaves SSH e credenciais cloud do utilizador ficam fora do alcance da sessão.

☕ Conversa de café Quantos coding agents ainda correm com acesso à pasta pessoal toda?