news.szt.link2026-08-07two portals: public scout · private dream
journal of the cognitive implant

news.szt.link

Public Scout. Private Machine Dream, tailor-made for Felipe.

Caderno público · Scout

Governança por orçamento computacional

Transforma autorização de agentes em controle de recursos, com encaixe direto em guardrails reais.


itens
10
vanguarda
5
interessante
5
data
08-07
01
vanguarda · score 9

Governança por orçamento computacional

Transforma autorização de agentes em controle de recursos, com encaixe direto em guardrails reais.

source: Resourced Authority A Mechanism-Design Model for Participatory Governance of Deployed AI Agents

original source
https://arxiv.org/abs/2608.06353v1
02
vanguarda · score 9

Chaves físicas para agentes MCP

Mira o ponto certo: agentes que assinam ações precisam de chaves fora do alcance do processo.

source: Hardware Keystores for AI Agent Signing Workflows: A Zero-Trust MCP Enforcement Architecture

original source
https://arxiv.org/abs/2608.06130v1
03
vanguarda · score 9

Tool calling vira código

Pode mudar a arquitetura prática de agentes que compõem, encadeiam e auditam ferramentas.

source: The Bitter Lesson of Tool Calling

original source
https://arxiv.org/abs/2608.06370v1
04
vanguarda · score 9

Modelos reconhecem seus usuários

Claude Code e scaffolds podem expor identidade ao contexto e alterar o comportamento do modelo.

source: User awareness in frontier models

original source
https://www.lesswrong.com/posts/kfunjXeaRTpkT5RAF/user-awareness-in-frontier-models
05
vanguarda · score 9

Agentes entram no ataque

Relato sugere nova superfície ofensiva em workflows autônomos, com impacto direto em guardrails e auditoria.

source: OpenAI Reveals How AI Agents Secretly Coordinated Before Hugging Face Hack

original source
https://decrypt.co/375058/openai-ai-agents-secretly-coordinated-hugging-face-hack
06
interessante · score 8

Avaliação de agentes sem desperdício

Anytime stopping reduz custo de comparação entre agentes e combina com budget guardrails.

source: AV-AIVAT: 74x Cheaper Agent Evaluation with Certified Anytime-Valid Stopping in Imperfect-Information Games

original source
https://arxiv.org/abs/2608.06362v1
07
interessante · score 8

B300 ganha relato de campo

Operação real em 16 B300 traz triagem e falhas, não só benchmark limpo.

source: Operating Multi-Node Full Fine-Tuning on NVIDIA B300: A Field Report on Telemetry-Based Triage, Negative Results, and Operational Hardening

original source
https://arxiv.org/abs/2608.05944v1
08
interessante · score 8

Anatomia operacional do vLLM

Boa peça para entender a mecânica real de throughput em inferência LLM.

source: Inside vLLM: Anatomy of a High-Throughput LLM Inference System (2025)

original source
https://www.aleksagordic.com/blog/vllm
09
interessante · score 7

Contexto falso sob controle

Boa pista para RAG e agentes com fontes externas, onde contexto falso pode contaminar respostas.

source: Learning When to Trust via Selective Context Preference Optimization

original source
https://arxiv.org/abs/2608.06377v1
10
interessante · score 7

Pontes formais para protocolos seguros

Conecta Tamarin e ProVerif para comparar provas de protocolos com rigor formal.

source: A Sound Translation from Tamarin to ProVerif: Enabling Comparative Analysis

original source
https://arxiv.org/abs/2608.06315v1

English edition. Editorial fields are translated when an English version exists; original source titles may remain in their source language.