Ir al contenido

AgentSight - Observabilidad eBPF para Agentes de IA

AgentSight - Observabilidad eBPF para Agentes de IA

AgentSight aplica eBPF a un problema que el mundo de herramientas de IA ha ignorado en gran medida: saber qué hizo realmente un agente autónomo en tu sistema. El rastreo a nivel de aplicación muestra prompts, llamadas a herramientas y conteos de tokens, pero solo ve lo que el framework del agente eligió reportar. AgentSight en cambio observa a nivel del kernel — syscalls, acceso a archivos, ejecución de procesos, conexiones de red — con cero instrumentación del agente en sí. Cuando un agente de codificación se ejecuta, ves los efectos del sistema reales, no la versión narrada.

Requisitos

RequisitoNota
Kernel Linux con soporte eBPF/BTF (5.x+)Versiones modernas
Privilegios root o CAP_BPFAcceso al kernel
Proceso del agente en el mismo hostObservación local

Instalación

MétodoComando
Desde sourcegit clone https://github.com/agent-sight/agentsight && make
Binariodescargar desde GitHub Releases
Dockerejecutar con privilegios y /sys/kernel montado
Verificaragentsight --version

Uso básico

ComandoDescripción
sudo agentsight trace --pid <pid>Rastrear un proceso de agente en ejecución
sudo agentsight trace -- claude-codeLanzar y rastrear un comando
sudo agentsight trace --comm pythonRastrear por nombre de proceso
--output trace.jsonEscribir eventos estructurados
--follow-childrenIncluir subprocesos generados

Qué captura

CategoríaEventos
Procesoexec, fork, exit — qué ejecutó el agente
Sistema de archivosopen, read, write, unlink — qué tocó
Redconnect, send, recv — hacia dónde se conectó
Credencialessetuid, cambios de capability
Árbol de subprocesosComandos generados por el agente

Como el rastreo ocurre en el kernel, un agente no puede omitir o tergiversar estos eventos — una diferencia significativa respecto al logging a nivel de framework.

Por qué a nivel de kernel para agentes

PreguntaRastreo a nivel de appAgentSight
¿Qué archivos modificó?Solo si la herramienta lo reportóCada escritura, siempre
¿Llamó a un host inesperado?Solo llamadas instrumentadasTodas las conexiones
¿Qué ejecutó realmente el shell tool?La cadena del comandoEl árbol de procesos completo
¿Superó su alcance previsto?Difícil de probarObservable

Filtrado

FlagEfecto
--filter-path /home/user/projectSolo eventos bajo una ruta
--exclude-path /tmpIgnorar rutas ruidosas
--net-onlySolo eventos de red
--exec-onlySolo ejecuciones de procesos
--min-duration 10msDescartar eventos triviales
# ¿Qué hizo el agente fuera de su directorio de trabajo?
sudo agentsight trace --pid $(pgrep -n agent) --exclude-path /workspace

Correlacionar con semántica del agente

EnfoqueCómo
TimestampsAlinear eventos de kernel con spans de rastreo del agente
Marcadores de sesiónEmitir un marcador al inicio/fin de la tarea
ExportaciónAlimentar JSON a tu stack de observabilidad
OpenTelemetryCorrelacionar con spans a nivel de app por ventana de tiempo

Emparejar AgentSight con rastreo a nivel de app (p.ej. Arize Phoenix o Langfuse) te da tanto la intención como el efecto.

Casos de uso de seguridad

UsoDetalle
Verificación de alcanceProbar que un agente se mantuvo dentro de su sandbox
Revisión de incidenteReconstruir exactamente qué hizo un agente problemático
Impacto de inyección de promptVer qué acciones siguieron a una instrucción inyectada
Evidencia de cumplimientoRegistro auditable del acceso del agente al sistema

AgentSight vs herramientas relacionadas

AspectoAgentSightTracee/FalcoLangfuse/Phoenix
CapaKernel (eBPF)Kernel (eBPF)Aplicación
EnfoqueComportamiento del agente de IASeguridad general del runtimeSpans/tokens/prompts
InstrumentaciónNinguna requeridaNinguna requeridaSDK requerido
Mejor paraQué hizo realmente un agenteDetección de amenazas del hostCalidad del razonamiento del agente

Construido sobre la misma base eBPF que Tracee y Falco, pero enfocado en el comportamiento del agente.

Recursos