Google abre o RRSI, em que agentes melhoram o próprio harness sem decorar benchmarks
O Google Cloud AI Research abriu o RRSI, método que deixa agentes reescreverem prompts, ferramentas e memória sem decorar os testes. No Terminal-Bench 2.1, o acerto foi de 74,2% para 80,2%.












