gcloud-lab/apps/base/customer1/news_bot/scraper-cronjob.yaml
sirius0xdev 93ce67a108
fix(news_bot): clean URLs + switch scraper to GHCR registry
- De-duplicate URLs in scrapy-urls configmap
- Switch CronJob image from siriussec/newsscraper:0.5.4 to ghcr.io/sirius0xdev/newsscraper:latest
- imagePullPolicy already set to Always

Co-authored-by: Sirius Devops <sirius@siriusdevops.com>
2026-05-27 23:07:57 -04:00

49 lines
1.2 KiB
YAML

apiVersion: batch/v1
kind: CronJob
metadata:
name: news-scraper
namespace: customer1
spec:
schedule: "50 * * * *"
jobTemplate:
spec:
template:
spec:
containers:
- name: news-scraper
image: ghcr.io/sirius0xdev/newsscraper:latest
imagePullPolicy: "Always"
resources:
requests:
memory: "1Gi"
cpu: "500m"
limits:
memory: "2Gi"
cpu: "1000m"
envFrom:
- configMapRef:
name: scrapy-config
env:
- name: DB_PASSWORD
valueFrom:
secretKeyRef:
name: news-app-password
key: password
volumeMounts:
- name: url-storage
mountPath: /app/urls.txt
subPath: urls.txt
- mountPath: /dev/shm
name: dshm
volumes:
- name: url-storage
configMap:
name: scrapy-urls
- name: dshm
emptyDir:
medium: Memory
restartPolicy: OnFailure