1️⃣ Claude Fable 5.1 corta o custo dos agents A Anthropic lançou o Fable 5.1 com cache reads a USD 0,25 por milhão de tokens, contra USD 1 no antecessor. A empresa estima menos 25% no uso típico e até 45% em execuções longas com muitas chamadas a ferramentas.
💡 Porque importa
Agents que reutilizam muito contexto ficam mais baratos sem mudar de API. O modelo já está disponível com o identificador claude-fable-5-1.
☕ Conversa de café Quantos workflows caros eram afinal uma tabela de preços mal desenhada?
2️⃣ A Runway quer gerar a interface em vez do código O Solaris cria interfaces interativas em vídeo a 720p e reage a cliques, arrastos e voz. Não executa uma app tradicional: um modelo de linguagem decide a mudança e o world model desenha o ecrã seguinte.
💡 Porque importa É uma ideia nova para protótipos e treino de agents, mas ainda falha em texto legível e sessões longas. Por agora, é investigação com acesso antecipado.
☕ Conversa de café Quem assina o bug quando o botão nunca existiu fora do vídeo?
3️⃣ Astra já encontra e explora falhas sem ajuda humana A OpenAI diz que o próximo modelo atingiu o nível crítico de capacidade cibernética. Num teste interno com 20 falhas recentes do V8, Astra encontrou duas zero-days e usou-as numa cadeia de exploração.
💡 Porque importa As capacidades avançadas terão acesso limitado e mais monitorização. Trabalho defensivo legítimo também pode ser travado, pausado ou recusado pelos novos controlos.
☕ Conversa de café Dois zero-days num teste interno chegam para confiar no monitor que vigia o próprio modelo?