Script • Python drift og automatisering

Innholdslengde audit for JSON

Innholdslengde audit for JSON er et praktisk Python-eksempel for WEBoracle med fast ZIP-nedlasting og tilhørende forklaring.

import json
from pathlib import Path
from html.parser import HTMLParser

class TextExtractor(HTMLParser):
    def __init__(self):
        super().__init__()
        self.parts = []
    def handle_data(self, data):
      
Weboracle
19.07.20260 visningerPython

Innholdslengde audit for JSON er et praktisk Python-eksempel for WEBoracle med fast ZIP-nedlasting og tilhørende forklaring.

Innholdslengde audit for JSON

Innholdslengde audit for JSON er et praktisk Python-eksempel for WEBoracle med fast ZIP-nedlasting og tilhørende forklaring.

Hva scriptet gjør

Scriptet er laget som et praktisk eksempel for WEBoracle-biblioteket. Det viser en avgrenset løsning som kan kopieres, testes lokalt og bygges videre på.

Når det passer

Bruk eksempelet når du trenger en liten, tydelig startfil og ønsker å se hvordan struktur, kommentarer og testpunkter kan settes opp før produksjon.

Før bruk

  • Les forklaring og user manual i ZIP-pakken.
  • Tilpass stier, navn og tekst til ditt prosjekt.
  • Test i et lukket testmiljø før publisering.

Kode

import json
from pathlib import Path
from html.parser import HTMLParser

class TextExtractor(HTMLParser):
    def __init__(self):
        super().__init__()
        self.parts = []
    def handle_data(self, data):
        self.parts.append(data)

def visible_length(html_text: str) -> int:
    parser = TextExtractor()
    parser.feed(html_text or "")
    return len(" ".join(parser.parts).strip())

data = json.loads(Path("content.json").read_text(encoding="utf-8"))
for section in ("articles", "tutorials", "scripts"):
    for row in data.get(section, []):
        length = visible_length(row.get("body", ""))
        print(section, row.get("slug"), length)