#!/usr/bin/env python3
"""Engendre, pour chaque ayant droit, sa playlist .xspf et sa page .html.
Les deux portent EXACTEMENT les memes URL : la signature ne depend que du
chemin et du secret, jamais du document qui la transporte.
Idempotent : relance-le autant que tu veux, il reecrit les memes URL. C est
voulu — une URL stable, c est VLC qui retrouve la reprise de lecture et
l historique, tous deux indexes par URL.
Configuration : /etc/li/li.env (ou le fichier nomme par LI_CONF), que les
variables d environnement surchargent. Voir li.env.example.
"""
import base64
import hashlib
import html
import json
import os
import shlex
import sys
import time
from pathlib import Path
from urllib.parse import quote
from xml.sax.saxutils import escape
# Ces deux prefixes sont ceux du vhost nginx/li.conf : les changer ici impose
# de les changer la-bas.
PREFIXE = "/library"
PLAYLISTS = "/playlists"
VIDEOS_DEFAUT = ".mkv .mp4 .m4v .avi .mov .webm .mpg .mpeg .ts"
# ----------------------------------------------------------- configuration
def lis_env(chemin: Path) -> dict:
"""Lit un fichier « CLE=valeur » compatible sh — celui que li-user source."""
valeurs = {}
if not chemin.exists():
return valeurs
for ligne in chemin.read_text(encoding="utf-8").splitlines():
ligne = ligne.strip()
if not ligne or ligne.startswith("#") or "=" not in ligne:
continue
cle, valeur = ligne.split("=", 1)
mots = shlex.split(valeur, comments=True)
valeurs[cle.strip()] = " ".join(mots)
return valeurs
class Config:
def __init__(self, env: dict):
base = env.get("LI_BASE_URL", "").rstrip("/")
if not base:
raise SystemExit("LI_BASE_URL n est pas defini (voir li.env.example).")
self.base = base
self.racine = Path(env.get("LI_LIBRARY", "/srv/media/library"))
donnees = Path(env.get("LI_DATA", "/srv/appdata/li"))
self.ayants = donnees / "users.json"
self.sortie = donnees / "playlists"
# La revocation, c est la table des ayants droit — pas l expiration.
# Une expiration courte obligerait a resigner regulierement, donc a
# changer les URL, donc a faire perdre a VLC la reprise de lecture de
# chaque film. D ou 2038 par defaut.
self.expire = int(env.get("LI_EXPIRES", "2145916800"))
self.titre = env.get("LI_TITLE", "Bibliothèque")
self.videos = {e.lower() for e in env.get("LI_VIDEO_EXT", VIDEOS_DEFAUT).split()}
# Repertoires de premier niveau dont le contenu ne figure QUE dans la
# page HTML, jamais dans la playlist — et dont TOUS les fichiers sont
# pris, quelle que soit leur extension.
#
# Une playlist VLC n a rien a faire d un .iso ou d un .exe : elle ne
# saurait pas les lire, et les mettre dedans donnerait une liste ou un
# titre sur deux echoue a l ouverture. La page HTML, elle, ne fait que
# proposer des telechargements — tout y a sa place.
#
# Le vhost nginx/li.conf force « Content-Disposition: attachment » sur
# ces memes chemins. Les deux doivent rester d accord.
self.html_seulement = set(env.get("LI_HTML_ONLY", "software").split())
def charge_config() -> Config:
env = lis_env(Path(os.environ.get("LI_CONF", "/etc/li/li.env")))
env.update({k: v for k, v in os.environ.items() if k.startswith("LI_")})
return Config(env)
# --------------------------------------------------------------- signature
def signe(chemin: str, expire: int, secret: str) -> str:
"""md5(expiration + chemin + secret), en base64url sans remplissage.
C est exactement ce que calcule « secure_link_md5 » de nginx. Le secret
est en FIN de chaine : c est l ordre de la documentation nginx, et le seul
qui ne prete pas le flanc a une extension de longueur.
"""
brut = f"{expire}{chemin}{secret}".encode("utf-8")
return base64.urlsafe_b64encode(hashlib.md5(brut).digest()).decode().rstrip("=")
def url(cfg: Config, chemin: str, nom: str, secret: str) -> str:
# On signe le chemin DECODE — c est ce que nginx met dans $uri — et on
# n encode qu ici, pour l ecriture. Inverser les deux donne un 403 sur
# tout titre contenant une espace ou un accent.
return (f"{cfg.base}{quote(chemin)}"
f"?u={quote(nom)}&e={cfg.expire}&s={signe(chemin, cfg.expire, secret)}")
def url_media(cfg: Config, fichier: Path, nom: str, secret: str) -> str:
return url(cfg, f"{PREFIXE}/{fichier.relative_to(cfg.racine).as_posix()}", nom, secret)
# ------------------------------------------------------------------ outils
def taille_lisible(octets: int) -> str:
for unite, seuil in (("To", 1 << 40), ("Go", 1 << 30), ("Mo", 1 << 20)):
if octets >= seuil:
return f"{octets / seuil:.1f} {unite}".replace(".", ",")
return f"{octets // 1024} ko"
def html_seulement(cfg: Config, chemin: Path) -> bool:
parties = chemin.relative_to(cfg.racine).parts
return len(parties) > 1 and parties[0] in cfg.html_seulement
def collecte(cfg: Config):
"""(medias, autres) — les premiers vont partout, les seconds en HTML seul."""
medias, autres = [], []
for f in cfg.racine.rglob("*"):
if not f.is_file():
continue
# Fichiers ET repertoires caches : .@__thumb, .Trash-1000 et consorts.
if any(p.startswith(".") for p in f.relative_to(cfg.racine).parts):
continue
if html_seulement(cfg, f):
autres.append(f)
elif f.suffix.lower() in cfg.videos:
medias.append(f)
ordre = lambda p: p.relative_to(cfg.racine).as_posix().lower()
return sorted(medias, key=ordre), sorted(autres, key=ordre)
def arbre(cfg: Config, fichiers):
"""Reconstruit l arborescence : {dossier: sous-arbre}, fichiers a plat."""
racine = {"dossiers": {}, "fichiers": []}
for f in fichiers:
parties = f.relative_to(cfg.racine).parts
noeud = racine
for dossier in parties[:-1]:
noeud = noeud["dossiers"].setdefault(
dossier, {"dossiers": {}, "fichiers": []})
noeud["fichiers"].append(f)
return racine
def compte(noeud):
"""(nombre de fichiers, octets) d un noeud et de toute sa descendance."""
n = len(noeud["fichiers"])
o = sum(f.stat().st_size for f in noeud["fichiers"])
for sous in noeud["dossiers"].values():
sn, so = compte(sous)
n += sn
o += so
return n, o
# -------------------------------------------------------------------- XSPF
def xspf(cfg: Config, fichiers, nom, secret, horodatage):
pistes = []
for f in fichiers:
rel = f.relative_to(cfg.racine)
pistes.append(
" ")
return ('\n'
'{html.escape(dossier)}'
f'
'
f'