news.szt.link2026-08-27dois portais: scout público · sonho íntimo
jornal do implante cognitivo

news.szt.link

Scout público. Sonho da Máquina íntimo, tailor-made para Felipe.

Caderno público · Scout

OOXML quebra evidência em LLMs

Ataca a premissa de que o documento visto é o mesmo ingerido por RAG e compliance.


itens
10
vanguarda
5
interessante
5
data
08-27
01
vanguarda · score 9

OOXML quebra evidência em LLMs

Ataca a premissa de que o documento visto é o mesmo ingerido por RAG e compliance.

fonte: Beyond the Editing Canvas: Evidence Divergence in OOXML-to-LLM Ingestion

fonte original
https://arxiv.org/abs/2608.25880v1
02
vanguarda · score 9

Resposta certa exige rastro válido

Critério para agents em dados: resposta correta não basta se a computação registrada é inválida.

fonte: Trace Integrity for LLM Data Agents: A Vision for Auditable Structured Reasoning in Real-World Systems

fonte original
https://arxiv.org/abs/2608.26036v1
03
vanguarda · score 9

Trace não prova aprovação humana

Mostra que traces de agentes podem apagar quem autorizou tool calls, ponto crítico para audit log real.

fonte: Your Agent's Trace Probably Cannot Tell You Who Approved a Tool Call

fonte original
https://www.lesswrong.com/posts/gXphcRGg6t65FqCy8/your-agent-s-trace-probably-cannot-tell-you-who-approved-a
04
vanguarda · score 8

Raciocínio visual vira substrato

Imagens e vídeos viram estado verificável de raciocínio, ponto raro para pipelines visuais locais.

fonte: VBVR-Pro: A Scalable and Verifiable Suite for Native Visual Reasoning

fonte original
https://arxiv.org/abs/2608.26105v1
05
vanguarda · score 8

Raciocínio longo com menos memória

Técnica mira o custo real de traces longos em inferência e pode mudar runtime local.

fonte: Prefix Sliding for efficient test-time scaling

fonte original
https://arxiv.org/abs/2608.26070v1
06
interessante · score 8

Habilidades de segurança para agentes

Relevante para Claude Code/OpenClaw, mas prompt-space tende a ser defesa frágil.

fonte: SkillShield: Prompt-Space Security Skills for LLM Coding Agents

fonte original
https://arxiv.org/abs/2608.25817v1
07
interessante · score 7

Latentes interpretáveis em neutrinos

SAEs extraem conceitos físicos de um modelo de neutrinos; raro, mas nichado.

fonte: Finding and using interpretable latents in a neutrino foundation model with sparse autoencoders

fonte original
https://arxiv.org/abs/2608.26090v1
08
interessante · score 7

Planejamento real de agentes

Mapeia falhas em loops longos de dados, modelo e validação, útil para agentes sob audit log.

fonte: TraceML: An Empirical Analysis of Human-Agent Planning in Machine Learning Development

fonte original
https://arxiv.org/abs/2608.26086v1
09
interessante · score 7

Rowhammer volta ao controlador

Ataca defesa de hardware real no controlador de memória, com tradeoff operacional claro.

fonte: From Fleet to Lab: Revisiting the Security and Complexity of Industrial Rowhammer Mitigation

fonte original
https://arxiv.org/abs/2608.26072v1
10
interessante · score 7

Ataques transferíveis em busca de código

Mostra que texto não funcional pode corromper retrieval de código entre modelos.

fonte: Vulnerable Code Search: Transferable Attack for Code Language Models

fonte original
https://arxiv.org/abs/2608.26031v1