OOXML quebra evidência em LLMs
Ataca a premissa de que o documento visto é o mesmo ingerido por RAG e compliance.
fonte: Beyond the Editing Canvas: Evidence Divergence in OOXML-to-LLM Ingestion
Ataca a premissa de que o documento visto é o mesmo ingerido por RAG e compliance.
Ataca a premissa de que o documento visto é o mesmo ingerido por RAG e compliance.
fonte: Beyond the Editing Canvas: Evidence Divergence in OOXML-to-LLM Ingestion
Critério para agents em dados: resposta correta não basta se a computação registrada é inválida.
fonte: Trace Integrity for LLM Data Agents: A Vision for Auditable Structured Reasoning in Real-World Systems
Mostra que traces de agentes podem apagar quem autorizou tool calls, ponto crítico para audit log real.
fonte: Your Agent's Trace Probably Cannot Tell You Who Approved a Tool Call
Imagens e vídeos viram estado verificável de raciocínio, ponto raro para pipelines visuais locais.
fonte: VBVR-Pro: A Scalable and Verifiable Suite for Native Visual Reasoning
Técnica mira o custo real de traces longos em inferência e pode mudar runtime local.
fonte: Prefix Sliding for efficient test-time scaling
Relevante para Claude Code/OpenClaw, mas prompt-space tende a ser defesa frágil.
fonte: SkillShield: Prompt-Space Security Skills for LLM Coding Agents
SAEs extraem conceitos físicos de um modelo de neutrinos; raro, mas nichado.
fonte: Finding and using interpretable latents in a neutrino foundation model with sparse autoencoders
Mapeia falhas em loops longos de dados, modelo e validação, útil para agentes sob audit log.
fonte: TraceML: An Empirical Analysis of Human-Agent Planning in Machine Learning Development
Ataca defesa de hardware real no controlador de memória, com tradeoff operacional claro.
fonte: From Fleet to Lab: Revisiting the Security and Complexity of Industrial Rowhammer Mitigation
Mostra que texto não funcional pode corromper retrieval de código entre modelos.
fonte: Vulnerable Code Search: Transferable Attack for Code Language Models