Skip to content

Folders and files

NameName
Last commit message
Last commit date

Latest commit

 

History

17 Commits
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 

HDRI-Analyseplattform

License CI Issues DOI

English Version · 🌐 handwerk-index.de

HDRI ist ein Messinstrument, das regelmäßig prüft, wie sich Handwerksunternehmen in Deutschland online präsentieren — mit automatisierten Website-Audits und einem transparenten Scoring-Modell. Es hilft Handwerkskammern, Ministerien und Forschungseinrichtungen zu erkennen, wo digitale Unterstützung am dringendsten gebraucht wird.

Ein Turborepo-Monorepo zum Sammeln, Analysieren und Veröffentlichen des Handwerk Digital Readiness Index (HDRI) — eine longitudinale, signalbasierte Bewertung der Online-Präsenz von Handwerksunternehmen.

Was dieses Projekt leistet

Die Plattform besteht aus drei Ebenen:

  1. Fabrik (apps/hdri/factory) — Erfasst Website-Kataloge aus öffentlichen Verzeichnissen (Handwerkskammer, IHK, Branchenbörsen), prüft Erreichbarkeit, crawlt Startseiten und führt Lighthouse- sowie axe-Audits durch.
  2. Observatorium (apps/hdri/observatory) — Ordnet Rohsignale einer Ontologie zu, bewertet sie mit einem konfigurierbaren Codebook und erstellt datenschutzsichere Data Marts.
  3. Dashboard (apps/hdri/dashboard) — Eine statische Astro-Website, die die bewerteten, anonymisierten Daten für die Öffentlichkeit visualisiert.

Ingenieure und Analysten können die Pipelines lokal ausführen, Zwischenspeicher von SQLite-Datenbanken prüfen und das Dashboard nach jeder Bewertungs- oder Codebook-Änderung neu aufbauen.

Methodik (Überblick)

  • HDRI verwendet Signale aus öffentlichen Unternehmenswebsites (Erreichbarkeit, Performance, Barrierefreiheit, Inhalt).
  • Jedes Signal wird einer Ontologie zugeordnet (z. B. Erreichbarkeit, Rechtskonformität, Barrierefreiheit).
  • Ein transparentes Codebook weist jedem Signal Gewichte und Schwellenwerte zu.
  • Scores werden pro Unternehmen berechnet und nach Region oder Kohorte aggregiert.
  • Im öffentlichen Dashboard werden keine personenbezogenen Daten oder einzelnen Unternehmensnamen veröffentlicht.

Die vollständige Bewertungslogik und Gewichtung finden sich im packages/hdri-codebook.

Arbeitsbereich-Layout

apps/
  factory/
    0-harvest-source/       Katalog-Erfassung
    1-register-businesses/  Domänen-Deduplizierung & Asset-ID-Prägung
    2-check-liveness/       HTTP/HTTPS-Erreichbarkeitsprüfungen
    3-extract-profile/      Startseiten-Crawling & Signalextraktion
    4-audit-lighthouse/     Lighthouse-Leistungsaudits
    5-audit-axe/            axe-Barrierefreiheitsaudits
    a-contract-ontology/    Signierte Beobachtungen für das Observatorium bündeln
  observatory/      Longitudinale Bewertung & Kohortenanalyse
  dashboard/           Öffentliches Astro-Dashboard

packages/
  business-core/            SQLite-Schemas & Geschäftseinheiten
  business-crawler/         Gemeinsame Crawling-Hilfsmittel
  hdri-codebook/            YAML-Codebook-Parser & Bewertungsengine
  factory-core/        Fabrikspezifische gemeinsame Logik
  observatory-core/         Ontologie, Beobachtungen, Asset-IDs, Validierung
  observatory-crypto/       Signier- & Hashing-Hilfsmittel
  observatory-emit/         Bündel-Emissionshilfsmittel
  observatory-vault/        Sichere Speicherabstraktionen
  pipeline-ai/              LLM-Prompt-Runner & Antwortprotokollierung
  pipeline-core/            Pipeline-Engine-Kern (Schritte, Phasen, Orchestrierung)
  pipeline-node/            Node.js-Laufzeitadapter
  pipeline-steps/           Wiederverwendbare Schritt-Basisklassen
  rate-limit/               Ratenbegrenzung, Concurrency Gates & Retry
  utils/                    Allgemeine Hilfsmittel

Voraussetzungen

Installation

pnpm install

Schnellstart

  1. Gemeinsame Pakete bauen, bevor eine Pipeline ausgeführt wird:

    pnpm turbo run build --filter=@syrokomskyi/pipeline-core --filter=@syrokomskyi/pipeline-node --filter=@syrokomskyi/pipeline-steps --filter=@syrokomskyi/observatory-core --filter=@syrokomskyi/hdri-codebook
  2. Eine Fabrik-Pipeline ausführen (Beispiel: Quellkataloge erfassen):

    pnpm turbo run start --filter=@syrokomskyi/catalog-harvest
  3. Das Observatorium ausführen, nachdem die Factory-Schritte abgeschlossen sind:

    pnpm --filter @syrokomskyi/observatory start
  4. Das Dashboard bauen:

    pnpm --filter @syrokomskyi/dashboard run build

Die einzelnen README-Dateien unten verlinkt enthalten die detaillierte Konfiguration jeder App.

App-Handbücher

Nützliche Befehle

# Alles auf Typen prüfen
pnpm turbo run typecheck

# Alles bauen
pnpm turbo run build

# Eine bestimmte App ausführen
pnpm turbo run start --filter=@syrokomskyi/observatory

# Den Aufgabengraphen visualisieren
pnpm turbo graph --dot > turbo.dot

Pipeline-Konventionen

Jede App in apps/* folgt demselben Laufzeit-Layout:

  • .input/ — Manuell bereitgestellte Konfiguration (brief.md, Katalogdateien usw.)
  • .output/ — Generierte Artefakte und SQLite-Datenbanken
  • run/ — Quellcode, Gogols und Orchestrierung

Pipelines sind auf schnelles Fehlschlagen ausgelegt: Wenn ein nachgelagerter Schritt keine gültigen Upstream-Daten hat, pausiert die Laufzeit, gibt einen Diagnoseleitfaden aus und erstellt kein leeres Schrittverzeichnis.

Umgebungsvariablen werden aus der App-lokalen .env-Datei geladen, wenn die App startet.

Turborepo-Referenzen

Kontakt und institutionelle Nutzung

Institutionen (z. B. Handwerkskammern, Ministerien, Forschungseinrichtungen), die HDRI als Pilot validieren, die Methodik prüfen oder Module mitentwickeln möchten, sind eingeladen, Kontakt aufzunehmen — über GitHub-Issues oder direkt an den Project Lead.

Siehe CONTACT.md für Kooperationswege und Antwortzeiten.

Öffentliche Mission

Der Handwerk Digital Readiness Index (HDRI) wird als öffentliches Gut entwickelt.

Scope und Fokus:

  • Zielgruppe: Handwerksunternehmen in Deutschland (über eine Million Betriebe, ca. fünf Millionen Beschäftigte).
  • Zweck: Benchmarking der digitalen Präsenz, Identifizierung regionaler Lücken in der Digitalbereitschaft und Fortschrittsverfolgung über die Zeit.
  • Anwendung: Evidenzbasierte Politikberatung und gezielte Unterstützung der Digitalisierung.

Der deutsche Handwerkssektor bildet das Rückgrat der regionalen Wirtschaft des Landes. Dennoch bleibt die digitale Präsenz der meisten Handwerksunternehmen untererforscht, fragmentiert und schwer skalierbar zu bewerten. Der HDRI wurde geschaffen, um das zu ändern.

Diese Plattform ist bewusst offen: Jede Pipeline, jede Bewertungsregel und jedes Codebook-Gewicht sind versioniert und nachvollziehbar. Aggregierte, anonymisierte Quartalsdaten werden auf handwerk-index.de veröffentlicht. Jeder Forscher, jede Handelskammer, jedes Ministerium und jeder Civic Technologist können prüfen, wie der Index konstruiert ist, seine Annahmen in Frage stellen, seine Methodik erweitern oder seine Analyse auf neuen Daten neu ausführen. Undurchsichtigkeit hat in einem Werkzeug, das der öffentlichen Politikberatung dienen soll, keinen Platz.

Für wen das ist

  • Handwerkskammern und Kreishandwerkerschaften — Nutzen HDRI-Daten, um Mitgliederunternehmen zu benchmarken, unterversorgte Regionen zu identifizieren und digitale Förderprogramme zu priorisieren.
  • Bundes- und Landesministerien (BMWK, Landeswirtschaftsministerien) — Nutzen den longitudinalen Datensatz, um die Wirkung von Digitalisierungsförderung zu verfolgen und evidenzbasierte Fortschrittsberichte zu erstellen.
  • Forschungseinrichtungen (ZEW, Fraunhofer IAO, Universitätsabteilungen) — Bauen auf anonymisierten Kohortendaten und dem offenen Codebook für vergleichende oder sektorspezifische Studien auf.
  • Civic Technologists und Journalisten — Erkunden das öffentliche Dashboard und die zugrunde liegenden Daten, um über regionale Disparitäten in der digitalen Bereitschaft zu berichten.

Was „offen" hier bedeutet

Der Quellcode, die Pipeline-Logik, die Bewertungsengine und alle nicht-personenbezogenen abgeleiteten Daten werden unter der Apache License 2.0 veröffentlicht. Sie dürfen sie frei nutzen, ändern und verteilen — für Forschung, Politikarbeit oder kommerzielle Anwendungen. Drei leichtgewichtige Verpflichtungen gelten: Beibehaltung der vorhandenen Urheberrechts- und Lizenzvermerke, Kennzeichnung geänderter Dateien und Beilegung des Lizenztexts bei Weiterverteilung. Kein Copyleft, keine Quellenoffenlegungspflicht, keine Registrierung. Patentrechte werden allen Nutzern ausdrücklich unter denselben Bedingungen eingeräumt.

Keine Registrierung, kein API-Schlüssel, keine Gebühr. Forke es, passe es an, deploye es.

Wie man mitwirken kann

Beiträge auf allen Ebenen sind willkommen — von der Korrektur eines Codebook-Gewichts bis zur Integration einer neuen Datenquelle oder der Übersetzung des Dashboards ins Deutsche. Siehe CONTRIBUTING.md für die vollständigen Richtlinien.

  • Code oder Methodik — lesen Sie CONTRIBUTING.md, dann öffnen Sie ein Issue oder Pull Request
  • Partnerschaft oder Presse — siehe CONTACT.md für Kooperationswege und Antwortzeiten
  • Einfach ein Gespräch beginnen — eröffnen Sie ein GitHub Issue

Dieses Projekt wird von einem unabhängigen Entwickler mit Sitz in Backnang, Baden-Württemberg, Deutschland, gepflegt. Kontakt: CONTACT.md · github.com/syrokomskyi

Changelog