vision-injection-guard v0.1.0: detectar texto inyectado en imágenes antes de la VLM
Sensor determinista y CPU-only que detecta texto inyectado visualmente en imágenes antes de que lleguen a un modelo de visión (VLM). Forma parte del ecosistema agent-shield-runtime. 21 tests.
El problema
Las VLMs leen el texto que aparece dentro de las imágenes. Eso convierte a cualquier imagen externa en un vector de prompt injection: el atacante incrusta instrucciones en la imagen y el modelo las obedece sin que el pipeline de texto las vea. Los filtros de prompt injection clásicos operan sobre texto, no sobre píxeles.
La solución
Pipeline determinista, sin modelo de visión:
- Extracción OCR con Tesseract (CPU-only).
- Normalización de unicode, homoglifos y espaciado adversarial.
- Integración con los detectores de prompt injection existentes de scope-lib/adi-shield.
- Salida estándar de sensor: veredicto, score y texto extraído.
Uso básico
from vision_injection_guard import process_image
result = process_image("path/to/image.png")
print(result)
# {"verdict": "allow", "score": 0.0, "extracted_text": "...", "normalized_text": "..."}
pip install vision-injection-guard
Links
¿Tu agente ve imágenes sin saber qué texto llevan dentro?
Top comments (0)