news.szt.link2026-08-28dois portais: scout público · sonho íntimo
jornal do implante cognitivo

news.szt.link

Scout público. Sonho da Máquina íntimo, tailor-made para Felipe.

Caderno público · Scout

Red team evolutivo para agentes

Ataca agentes com ferramentas e estado, não só texto inseguro; isso muda o modelo de defesa.


itens
10
vanguarda
5
interessante
5
data
08-28
01
vanguarda · score 9

Red team evolutivo para agentes

Ataca agentes com ferramentas e estado, não só texto inseguro; isso muda o modelo de defesa.

fonte: RedEvoAgent: Automatic Red-Teaming Agent with Experience-Driven Skill Evolution

fonte original
https://arxiv.org/abs/2608.27439v1
02
vanguarda · score 9

Persona separada da execução

Arquitetura rara para deixar agentes evoluírem sem perder auditoria e rastreabilidade.

fonte: Persona-Execution Separation: An Architecture Pattern for Evolving LLM Agents under Execution Audit

fonte original
https://arxiv.org/abs/2608.27427v1
03
vanguarda · score 9

Contexto vira privilégio root

Mostra como o harness pode transformar contexto comum em autoridade efetiva para o agente.

fonte: When Context Gets Root: Privilege Escalation in LLM Harnesses

fonte original
https://arxiv.org/abs/2608.27299v1
04
vanguarda · score 9

Fluxo seguro para agentes persistentes

Propõe controlar vazamento e autoridade em agentes que carregam estado entre páginas, documentos e ferramentas.

fonte: SPA: Securing Persistent LLM Agents Across Queries with Plan-First Information-Flow Control

fonte original
https://arxiv.org/abs/2608.27234v1
05
vanguarda · score 8

Publicidade entra no token

Leilão token a token transforma geração em mídia comprável e cria uma nova superfície de manipulação.

fonte: Token-Level Advertising

fonte original
https://arxiv.org/abs/2608.27382v1
06
interessante · score 8

Backdoors escapam por baixo sinal

Explora backdoors discretos que sobrevivem justamente por não parecerem eficazes nas métricas usuais.

fonte: Low-ASR Backdoors: Exploiting Attack Success Rate Reduction and Attacker-Defender Asymmetry

fonte original
https://arxiv.org/abs/2608.27288v1
07
interessante · score 8

Reasoning models entram em escala

Toca o gargalo real de paralelizar raciocínio em modelos pós-treinados com RLVR.

fonte: Performance Foundations of Parallel & Distributed Reasoning Language Models

fonte original
https://arxiv.org/abs/2608.27046v1
08
interessante · score 7

Skills persistentes para agentes

Sinal forte para agentes que acumulam procedimentos reutilizáveis a partir de uso real.

fonte: WikiSkill: Compiling Agent Experience into Persistent Knowledge for Skill Evolution

fonte original
https://arxiv.org/abs/2608.27454v1
09
interessante · score 7

Scanners de modelo sob teste

Útil para supply chain de modelos locais, especialmente pesos baixados de fontes abertas.

fonte: Beyond F1: Evaluating Coverage and Failure Recovery in AI Model Security Scanners

fonte original
https://arxiv.org/abs/2608.27424v1
10
interessante · score 7

Políticas legíveis para agentes

Testa se políticas escritas por usuários reduzem overreach em agentes que atuam sobre dados e serviços.

fonte: Do User-Authored Permission Policies Improve Protection Against AI Agent Overreach?

fonte original
https://arxiv.org/abs/2608.27443v1