Introduce core library model
This commit is contained in:
+11
-19
@@ -2,6 +2,7 @@ from pathlib import Path
|
|||||||
import argparse
|
import argparse
|
||||||
|
|
||||||
from serato_doctor.crate_parser import parse_crates
|
from serato_doctor.crate_parser import parse_crates
|
||||||
|
from serato_doctor.models.library import Library
|
||||||
from serato_doctor.scanner import scan_audio
|
from serato_doctor.scanner import scan_audio
|
||||||
from serato_doctor.report import write_csv, write_missing_report
|
from serato_doctor.report import write_csv, write_missing_report
|
||||||
|
|
||||||
@@ -19,27 +20,18 @@ def main():
|
|||||||
out = Path(args.out)
|
out = Path(args.out)
|
||||||
report = Path(args.report)
|
report = Path(args.report)
|
||||||
|
|
||||||
refs = parse_crates(serato / "Subcrates")
|
library = Library.build(
|
||||||
disk = scan_audio(music)
|
references=parse_crates(serato / "Subcrates"),
|
||||||
|
tracks=scan_audio(music),
|
||||||
|
)
|
||||||
|
results = library.reconcile_by_filename()
|
||||||
|
missing_count = sum(1 for result in results if not result.exists_by_filename)
|
||||||
|
|
||||||
disk_names = {t.filename for t in disk}
|
write_csv(results, out)
|
||||||
|
write_missing_report(results, report)
|
||||||
|
|
||||||
rows = []
|
print(f"Crate references: {len(library.references)}")
|
||||||
for ref in refs:
|
print(f"Disk tracks: {len(library.tracks)}")
|
||||||
rows.append({
|
|
||||||
"crate": str(ref.source),
|
|
||||||
"serato_path": str(ref.path),
|
|
||||||
"filename": ref.filename,
|
|
||||||
"exists_by_filename": ref.filename in disk_names,
|
|
||||||
})
|
|
||||||
|
|
||||||
missing_count = sum(1 for r in rows if not r["exists_by_filename"])
|
|
||||||
|
|
||||||
write_csv(rows, out)
|
|
||||||
write_missing_report(rows, report)
|
|
||||||
|
|
||||||
print(f"Crate references: {len(refs)}")
|
|
||||||
print(f"Disk tracks: {len(disk)}")
|
|
||||||
print(f"Missing by filename: {missing_count}")
|
print(f"Missing by filename: {missing_count}")
|
||||||
print(f"CSV: {out}")
|
print(f"CSV: {out}")
|
||||||
print(f"Report: {report}")
|
print(f"Report: {report}")
|
||||||
|
|||||||
@@ -1,6 +1,7 @@
|
|||||||
from pathlib import Path
|
from pathlib import Path
|
||||||
|
|
||||||
from serato_doctor.models import TrackReference
|
from serato_doctor.models.crate import Crate
|
||||||
|
from serato_doctor.models.reference import TrackReference
|
||||||
|
|
||||||
|
|
||||||
def read_crate_text(crate_path: Path) -> str:
|
def read_crate_text(crate_path: Path) -> str:
|
||||||
@@ -20,7 +21,7 @@ def clean_path(raw: str) -> str:
|
|||||||
return raw.strip()
|
return raw.strip()
|
||||||
|
|
||||||
|
|
||||||
def parse_crate(crate_path: Path) -> list[TrackReference]:
|
def load_crate(crate_path: Path) -> Crate:
|
||||||
text = read_crate_text(crate_path)
|
text = read_crate_text(crate_path)
|
||||||
refs = []
|
refs = []
|
||||||
|
|
||||||
@@ -48,7 +49,13 @@ def parse_crate(crate_path: Path) -> list[TrackReference]:
|
|||||||
)
|
)
|
||||||
)
|
)
|
||||||
|
|
||||||
return refs
|
return Crate(path=crate_path, references=tuple(refs))
|
||||||
|
|
||||||
|
|
||||||
|
def parse_crate(crate_path: Path) -> list[TrackReference]:
|
||||||
|
"""Parse references from one crate, preserving the prototype API."""
|
||||||
|
|
||||||
|
return list(load_crate(crate_path).references)
|
||||||
|
|
||||||
|
|
||||||
def parse_crates(root: Path) -> list[TrackReference]:
|
def parse_crates(root: Path) -> list[TrackReference]:
|
||||||
|
|||||||
@@ -0,0 +1,6 @@
|
|||||||
|
from serato_doctor.models.crate import Crate
|
||||||
|
from serato_doctor.models.library import Library
|
||||||
|
from serato_doctor.models.reference import ReferenceResult, TrackReference
|
||||||
|
from serato_doctor.models.track import DiskTrack
|
||||||
|
|
||||||
|
__all__ = ["Crate", "DiskTrack", "Library", "ReferenceResult", "TrackReference"]
|
||||||
@@ -0,0 +1,13 @@
|
|||||||
|
from dataclasses import dataclass
|
||||||
|
from pathlib import Path
|
||||||
|
from typing import Tuple
|
||||||
|
|
||||||
|
from serato_doctor.models.reference import TrackReference
|
||||||
|
|
||||||
|
|
||||||
|
@dataclass(frozen=True)
|
||||||
|
class Crate:
|
||||||
|
"""A Serato crate and the track references parsed from it."""
|
||||||
|
|
||||||
|
path: Path
|
||||||
|
references: Tuple[TrackReference, ...]
|
||||||
@@ -0,0 +1,31 @@
|
|||||||
|
from dataclasses import dataclass
|
||||||
|
from typing import Iterable, Tuple
|
||||||
|
|
||||||
|
from serato_doctor.models.reference import ReferenceResult, TrackReference
|
||||||
|
from serato_doctor.models.track import DiskTrack
|
||||||
|
|
||||||
|
|
||||||
|
@dataclass(frozen=True)
|
||||||
|
class Library:
|
||||||
|
"""The read-only view of crate references and audio found on disk."""
|
||||||
|
|
||||||
|
references: Tuple[TrackReference, ...]
|
||||||
|
tracks: Tuple[DiskTrack, ...]
|
||||||
|
|
||||||
|
@classmethod
|
||||||
|
def build(
|
||||||
|
cls,
|
||||||
|
references: Iterable[TrackReference],
|
||||||
|
tracks: Iterable[DiskTrack],
|
||||||
|
) -> "Library":
|
||||||
|
return cls(tuple(references), tuple(tracks))
|
||||||
|
|
||||||
|
def reconcile_by_filename(self) -> Tuple[ReferenceResult, ...]:
|
||||||
|
disk_names = {track.filename for track in self.tracks}
|
||||||
|
return tuple(
|
||||||
|
ReferenceResult(
|
||||||
|
reference=reference,
|
||||||
|
exists_by_filename=reference.filename in disk_names,
|
||||||
|
)
|
||||||
|
for reference in self.references
|
||||||
|
)
|
||||||
@@ -0,0 +1,27 @@
|
|||||||
|
from dataclasses import dataclass
|
||||||
|
from pathlib import Path
|
||||||
|
|
||||||
|
|
||||||
|
@dataclass(frozen=True)
|
||||||
|
class TrackReference:
|
||||||
|
"""A track path referenced by a Serato crate."""
|
||||||
|
|
||||||
|
source: Path
|
||||||
|
path: Path
|
||||||
|
filename: str
|
||||||
|
|
||||||
|
|
||||||
|
@dataclass(frozen=True)
|
||||||
|
class ReferenceResult:
|
||||||
|
"""The filename-level reconciliation result for a crate reference."""
|
||||||
|
|
||||||
|
reference: TrackReference
|
||||||
|
exists_by_filename: bool
|
||||||
|
|
||||||
|
def as_row(self) -> dict:
|
||||||
|
return {
|
||||||
|
"crate": str(self.reference.source),
|
||||||
|
"serato_path": str(self.reference.path),
|
||||||
|
"filename": self.reference.filename,
|
||||||
|
"exists_by_filename": self.exists_by_filename,
|
||||||
|
}
|
||||||
@@ -2,15 +2,10 @@ from dataclasses import dataclass
|
|||||||
from pathlib import Path
|
from pathlib import Path
|
||||||
|
|
||||||
|
|
||||||
@dataclass(frozen=True)
|
|
||||||
class TrackReference:
|
|
||||||
source: Path
|
|
||||||
path: Path
|
|
||||||
filename: str
|
|
||||||
|
|
||||||
|
|
||||||
@dataclass(frozen=True)
|
@dataclass(frozen=True)
|
||||||
class DiskTrack:
|
class DiskTrack:
|
||||||
|
"""An audio file discovered on disk."""
|
||||||
|
|
||||||
path: Path
|
path: Path
|
||||||
filename: str
|
filename: str
|
||||||
size: int
|
size: int
|
||||||
@@ -1,9 +1,13 @@
|
|||||||
from collections import Counter, defaultdict
|
from collections import Counter, defaultdict
|
||||||
from pathlib import Path
|
from pathlib import Path
|
||||||
|
from typing import Iterable
|
||||||
import csv
|
import csv
|
||||||
|
|
||||||
|
from serato_doctor.models.reference import ReferenceResult
|
||||||
|
|
||||||
def write_missing_report(rows: list[dict], out: Path) -> None:
|
|
||||||
|
def write_missing_report(results: Iterable[ReferenceResult], out: Path) -> None:
|
||||||
|
rows = [result.as_row() for result in results]
|
||||||
missing = [r for r in rows if not r["exists_by_filename"]]
|
missing = [r for r in rows if not r["exists_by_filename"]]
|
||||||
|
|
||||||
crate_counts = Counter(r["crate"] for r in missing)
|
crate_counts = Counter(r["crate"] for r in missing)
|
||||||
@@ -32,7 +36,8 @@ def write_missing_report(rows: list[dict], out: Path) -> None:
|
|||||||
f.write(f"- {name}\n")
|
f.write(f"- {name}\n")
|
||||||
|
|
||||||
|
|
||||||
def write_csv(rows: list[dict], out: Path) -> None:
|
def write_csv(results: Iterable[ReferenceResult], out: Path) -> None:
|
||||||
|
rows = [result.as_row() for result in results]
|
||||||
with out.open("w", newline="", encoding="utf-8") as f:
|
with out.open("w", newline="", encoding="utf-8") as f:
|
||||||
writer = csv.DictWriter(
|
writer = csv.DictWriter(
|
||||||
f,
|
f,
|
||||||
|
|||||||
@@ -1,6 +1,6 @@
|
|||||||
from pathlib import Path
|
from pathlib import Path
|
||||||
|
|
||||||
from serato_doctor.models import DiskTrack
|
from serato_doctor.models.track import DiskTrack
|
||||||
|
|
||||||
AUDIO_SUFFIXES = {".mp3", ".m4a", ".wav", ".aif", ".aiff", ".flac"}
|
AUDIO_SUFFIXES = {".mp3", ".m4a", ".wav", ".aif", ".aiff", ".flac"}
|
||||||
|
|
||||||
|
|||||||
Reference in New Issue
Block a user