Weekly · Mondays
AI Security Desk
Updated 2026-08-24
Independent research and technical analysis on AI system security, autonomous agent guardrails, prompt injection defenses, and runtime privilege boundaries.
Evaluation Frameworks
Evaluating Excessive Agency and Tool-Use Guardrails in Multimodal Agent Workflows
A rigorous assessment of excessive agency risks in multimodal LLM agent deployments, examining action space partitioning, least-privilege toolsets, and deterministic boundary verification.
Technical Analysis
Indirect Prompt Injection Defenses in Autonomous Agent Architectures: A Systematic Evaluation of Dual-Model Sandboxing and Runtime Privilege Boundaries
Technical analysis of indirect prompt injection defense mechanisms in multi-agent workflows, evaluating dual-model sandboxing and deterministic privilege boundaries.