arxiv-watcher v0.1.0: monitor local de arXiv con watchlists por palabras clave
Monitor local de papers de arXiv: fetch desde la API pública, filtrado por categorías y palabras clave, deduplicación con SQLite y notificación cuando aparece un paper relevante. Diseñado para funcionar como job de cron.
El problema
Seguir la literatura de arXiv a mano es inviable: miles de papers al día, y los que importan se hunden entre el resto. Los monitores online guardan tus queries en un tercero. Un watcher local mantiene tus watchlists en tu máquina y no depende de ningún servicio.
La solución
- Watchlists: múltiples watchlists con categorías arXiv + palabras clave + exclusiones.
- Almacén SQLite: registra papers ya vistos para evitar duplicados, con estadísticas por watchlist.
- Rate limiting: respeta las guías de la API de arXiv (3s entre requests).
- Deduplicación: fetch multi-categoría sin resultados repetidos.
- Relevance scoring: ordena los matches por ratio de acierto de palabras clave.
- CLI: run, init, list, stats, cron.
- Integración Hermes: pensado para jobs de cron del agente.
Uso básico
git clone https://github.com/amurlaniakea/arxiv-watcher.git
cd arxiv-watcher
python3 -m venv .venv && .venv/bin/pip install -e ".[dev]"
.venv/bin/arxiv-watcher init # crea config por defecto
.venv/bin/arxiv-watcher run # primera descarga
.venv/bin/arxiv-watcher run --dry-run # sin guardar en BD
.venv/bin/arxiv-watcher stats # estadísticas por watchlist
Links
¿Tu vigilancia de literatura depende de que un servicio tercero te avise, o corre en tu máquina?
Top comments (0)