DEV Community

Cover image for vision-injection-guard v0.1.0: detectar texto inyectado en imágenes antes de la VLM
Fenix
Fenix

Posted on

vision-injection-guard v0.1.0: detectar texto inyectado en imágenes antes de la VLM

vision-injection-guard v0.1.0: detectar texto inyectado en imágenes antes de la VLM

Sensor determinista y CPU-only que detecta texto inyectado visualmente en imágenes antes de que lleguen a un modelo de visión (VLM). Forma parte del ecosistema agent-shield-runtime. 21 tests.

El problema

Las VLMs leen el texto que aparece dentro de las imágenes. Eso convierte a cualquier imagen externa en un vector de prompt injection: el atacante incrusta instrucciones en la imagen y el modelo las obedece sin que el pipeline de texto las vea. Los filtros de prompt injection clásicos operan sobre texto, no sobre píxeles.

La solución

Pipeline determinista, sin modelo de visión:

  1. Extracción OCR con Tesseract (CPU-only).
  2. Normalización de unicode, homoglifos y espaciado adversarial.
  3. Integración con los detectores de prompt injection existentes de scope-lib/adi-shield.
  4. Salida estándar de sensor: veredicto, score y texto extraído.

Uso básico

from vision_injection_guard import process_image

result = process_image("path/to/image.png")
print(result)
# {"verdict": "allow", "score": 0.0, "extracted_text": "...", "normalized_text": "..."}
Enter fullscreen mode Exit fullscreen mode
pip install vision-injection-guard
Enter fullscreen mode Exit fullscreen mode

Links

¿Tu agente ve imágenes sin saber qué texto llevan dentro?

Top comments (0)