← Zur Karte

Organisationstyp · Wissenschaft und Forschung

Digitale Forschungsinfrastruktur (NFDI & HPC)

Welche Daten bei dieser Organisationsform entstehen — und wie offen sie sein könnten. 2 Aktivitäten, 69 Datentypen.

  • 88,4 % sofort publizierbar
  • 10,1 % nach Aufbereitung
  • 1,4 % nur Metadaten

Auf der interaktiven Karte öffnen →

NFDI-Datendienste & Fachkonsortien

37 Datentypen

NFDI-Konsortien-Metadaten

Verzeichnis aller 26 NFDI-Konsortien mit Fachgebiet, beteiligten Institutionen, Fördervolumen (DFG) und geplanten bzw. implementierten Datendiensten.

Sofort publizierbar — NFDI-Konsortien sind in GEPRIS dokumentiert. Konsortien publizieren eigene Steckbriefe und Jahresberichte offen.

Wissenschaft/TechnikFinanzdatenIndividuell / MikrodatenCC0 / Public DomainJSONCSV

Verwendung in 5 Prozessen
  • Forschungsinfrastrukturplanung NFDI ist die wichtigste Infrastrukturinvestition der deutschen Wissenschaft im Bereich Forschungsdaten.
  • Systemkoordination Übergreifende Koordination durch NFDI-Direktorat erfordert transparente Metadaten zu allen Konsortien.
  • Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu NFDI-Konsortien-Metadaten gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
  • Maschinenlesbare API-Bereitstellung Bereitstellung der Daten aus NFDI-Konsortien-Metadaten über strukturierte APIs für automatisierte Drittnutzung und Integration.
  • API-first-Bereitstellung Maschinenlesbare REST-API mit OpenAPI-Spezifikation für den programmatischen Zugriff auf die Datensätze aus NFDI-Konsortien-Metadaten.

NFDI-Nutzungsstatistiken

Zugriffszahlen auf NFDI-Datendienste nach Konsortium, Fachgebiet und Nutzerinstitution — Indikator für Akzeptanz und gesellschaftlichen Nutzen der Infrastrukturinvestition.

Sofort publizierbar — Aggregierte Nutzungsstatistiken sind nicht schutzbedürftig und werden in NFDI-Jahresberichten publiziert.

Wissenschaft/TechnikPersonenbezogene DatenIndividuell / MikrodatenCC0 / Public DomainCSVExcel (XLSX)

Verwendung in 5 Prozessen
  • Evaluation Nutzungsstatistiken sind Kerndaten für die Erfolgsevaluation der DFG-Förderung im NFDI-Programm.
  • Community Building Nutzerzahlen informieren Strategieentscheidungen für Outreach- und Community-Aktivitäten der Konsortien.
  • Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu NFDI-Nutzungsstatistiken auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
  • Metadaten-Anreicherung und Katalogisierung Systematische Ergänzung beschreibender Metadaten zu NFDI-Nutzungsstatistiken für verbesserte Auffindbarkeit und Nachnutzbarkeit in Datenportalen.
  • Metadaten-Standardisierung DDI Dokumentation der Erhebungsmetadaten aus NFDI-Nutzungsstatistiken im DDI-Codebook-Standard für Wiederverwendbarkeit in Forschungsinfrastrukturen.

Ontologien und Terminologiedienste

Fachspezifische Ontologien, Thesauri und kontrollierte Vokabulare, die im Rahmen von NFDI-Projekten entwickelt werden — z.B. EMMO (Materialwissenschaften), NFDI4Chem-Ontologie.

Sofort publizierbar — Wissenschaftliche Ontologien werden als Open Data entwickelt und auf OBO Foundry, EBI OLS oder BioPortal registriert.

Wissenschaft/TechnikMetadatenIndividuell / MikrodatenCC0 / Public DomainXMLJSON

Verwendung in 5 Prozessen
  • Interoperabilität Gemeinsame Ontologien ermöglichen semantische Interoperabilität zwischen Forschungsdaten verschiedener Disziplinen und Institutionen.
  • FAIR-Prinzipien Standardisierte Terminologien sind Grundvoraussetzung für das I (Interoperable) in FAIR-Forschungsdaten.
  • Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu Ontologien und Terminologiedienste gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
  • Open-Access-Dissemination Veröffentlichung der Ergebnisse aus Ontologien und Terminologiedienste über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
  • FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus Ontologien und Terminologiedienste nach FAIR-Prinzipien.

PID-Vergabestatistik Deutschland

Anzahl vergebener persistenter Identifier für Forschungsdaten (DOI über DataCite), Personen (ORCID) und Institutionen (ROR) in Deutschland — jährliche Wachstumsraten und Sektorverteilung.

Sofort publizierbar — DataCite, ORCID und ROR stellen vollständige Metadaten ihrer Registrierungen als Open Data bereit.

Wissenschaft/TechnikPersonenbezogene DatenIndividuell / MikrodatenCC0 / Public DomainCSVJSON

Verwendung in 5 Prozessen
  • FAIR-Infrastruktur PID-Durchdringung ist ein Schlüsselindikator für den Fortschritt der FAIR-Datentransformation.
  • Strategieplanung Wachstumsraten nach Institution und Fach informieren Prioritäten für PID-Mandatierungen in Förderrichtlinien.
  • Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu PID-Vergabestatistik Deutschland auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
  • Open-Access-Dissemination Veröffentlichung der Ergebnisse aus PID-Vergabestatistik Deutschland über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
  • FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus PID-Vergabestatistik Deutschland nach FAIR-Prinzipien.

BASE-Suchindex-Statistiken

Metadaten über die im Bielefelder Akademischen Suchmaschine (BASE) indizierten Quellen: Repositorien, Dokumenttypen, Fachgebietsverteilung und Wachstum des Open-Access-Anteils.

Sofort publizierbar — BASE (Universität Bielefeld) stellt Metadaten aller indizierten Dokumente via OAI-PMH und API vollständig offen bereit.

Wissenschaft/TechnikMetadatenIndividuell / MikrodatenCC0 / Public DomainJSONCSV

Verwendung in 5 Prozessen
  • OA-Monitoring BASE-Statistiken sind wichtiger Indikator für den Wachstum des offenen Wissenschaftssystems.
  • Repositorium-Governance Abdeckungsstatistiken informieren Repositorien über ihre Sichtbarkeit in Suchdiensten.
  • Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu BASE-Suchindex-Statistiken auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
  • Metadaten-Anreicherung und Katalogisierung Systematische Ergänzung beschreibender Metadaten zu BASE-Suchindex-Statistiken für verbesserte Auffindbarkeit und Nachnutzbarkeit in Datenportalen.
  • Metadaten-Standardisierung DDI Dokumentation der Erhebungsmetadaten aus BASE-Suchindex-Statistiken im DDI-Codebook-Standard für Wiederverwendbarkeit in Forschungsinfrastrukturen.

NFDI Konsortien Übersicht

Aktive NFDI-Konsortien nach Disziplin, Fördervolumen und angebotenen Diensten.

Sofort publizierbar — Konsortien, Fördervolumen und Dienste betreffen Einrichtungen und den Einsatz öffentlicher Mittel. Die Übersicht dient der Orientierung von Forschenden; die Public-Domain-Lizenz erlaubt die uneingeschränkte Weiterverwendung.

Wissenschaft/TechnikMetadatenEinzelereignis / RohdatenCC0 / Public DomainCSV

Verwendung in 5 Prozessen
  • Aggregierung Zusammenführung aus NFDI-Direktory und DFG-Förderberichten
  • Veröffentlichung und Berichterstattung Aufbereitung der aggregierten Daten zu NFDI Konsortien Übersicht für periodische Berichte und öffentliche Datenkataloge.
  • Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu NFDI Konsortien Übersicht gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
  • Metadaten-Anreicherung und Katalogisierung Systematische Ergänzung beschreibender Metadaten zu NFDI Konsortien Übersicht für verbesserte Auffindbarkeit und Nachnutzbarkeit in Datenportalen.
  • Zuwendungsdatenbank-Eintrag Erfassung aller Fördermaßnahmen aus NFDI Konsortien Übersicht in der Zuwendungsdatenbank des Bundes (subventionsbericht.de) nach Transparenzrichtlinien.

Forschungsdaten Lizenzübersicht

Verfügbare Lizenzen für Forschungsdaten in NFDI-Repositorien nach Datenkategorie.

Sofort publizierbar — Lizenzangaben je Datenkategorie sind Metadaten über Nutzungsrechte — sie müssen sichtbar sein, damit Forschungsdaten überhaupt nachnutzbar sind. Die Public-Domain-Lizenz erlaubt die uneingeschränkte Weiterverwendung.

Wissenschaft/TechnikMetadatenEinzelereignis / RohdatenCC0 / Public DomainCSV

Verwendung in 5 Prozessen
  • Harvesting Automatisierter Abruf aus re3data und DataCite
  • Qualitätssicherung und Veröffentlichung Prüfung der Daten zu Forschungsdaten Lizenzübersicht auf Qualität, Vollständigkeit und Aktualität sowie Aufbereitung für periodische Berichte.
  • Wissenschaftliche Nachnutzung Bereitstellung der Daten zu Forschungsdaten Lizenzübersicht für wissenschaftliche Sekundäranalysen über Forschungsdatenzentren.
  • Open-Access-Dissemination Veröffentlichung der Ergebnisse aus Forschungsdaten Lizenzübersicht über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
  • FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus Forschungsdaten Lizenzübersicht nach FAIR-Prinzipien.

Persistent Identifier Nutzung

Vergabe und Nutzung von DOIs, ORCIDs und RORs in der deutschen Forschungslandschaft.

Sofort publizierbar — Vergabe und Nutzung von DOIs, ORCIDs und RORs sind Kennzahlen über die Infrastruktur; persistente Kennungen sind ihrem Zweck nach auflösbar. Die Public-Domain-Lizenz erlaubt die uneingeschränkte Weiterverwendung.

Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC0 / Public DomainCSV

Verwendung in 5 Prozessen
  • API-Anbindung Abfrage der DataCite und ORCID APIs
  • Qualitätssicherung und Monitoring Kontinuierliches Monitoring der API-Anbindung für Persistent Identifier Nutzung auf Verfügbarkeit, Datenqualität und Latenz.
  • Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu Persistent Identifier Nutzung gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
  • Open-Access-Dissemination Veröffentlichung der Ergebnisse aus Persistent Identifier Nutzung über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
  • FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus Persistent Identifier Nutzung nach FAIR-Prinzipien.

NFDI-Nutzerbefragung und Community-Feedback

Ergebnisse regelmäßiger Nutzerbefragungen in NFDI-Konsortien: Zufriedenheit mit Datendiensten, Bedarfe nach neuen Funktionen, Nutzungshäufigkeit, Community-Größe nach Fachbereich. Grundlage für nutzerzentrierte Weiterentwicklung.

Sofort publizierbar — Aggregierte Befragungsergebnisse ohne personenbezogene Einzelantworten können publiziert werden.

Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSVJSON

Verwendung in 5 Prozessen
  • Community-Monitoring Regelmäßige Bedarfserhebung bei der wissenschaftlichen Community der NFDI-Konsortien.
  • Produktentwicklung Priorisierung neuer Datendienste auf Basis von Nutzerfeedback und Nutzungsstatistiken.
  • Digitale Weiterverarbeitung Bereitstellung der Daten zu NFDI-Nutzerbefragung und Community-Feedback als maschinenlesbare Schnittstelle für digitale Anwendungen.
  • Interoperabilitäts- und Schnittstellentesting Technische Überprüfung von Datenschnittstellen und Kompatibilität mit bestehenden IT-Systemen für NFDI-Nutzerbefragung und Community-Feedback.
  • Automatisierte Datenqualitätsprüfung Kontinuierliche Validierung der Datenqualität in NFDI-Nutzerbefragung und Community-Feedback durch regelbasierte Prüfroutinen und Anomalieerkennung im CI/CD-Prozess.

Datensatz-Einlieferungen nach NFDI-Konsortium

Jährliche Statistiken zu Forschungsdatensatz-Einlieferungen in die Dienste der 26 NFDI-Konsortien (NFDI4Chem, NFDI4Health, NFDI4Culture, KonsortSWD u.a.), erhoben durch die NFDI-Geschäftsstelle und die Base4NFDI-Initiative. Enthält Datensatzvolumen (Anzahl und Speichergröße), Metadatenqualitätskennzahlen und Kuratierungsaufwände nach Fachgebiet. Basis für Ressourcenplanung der DFG-NFDI-Förderung.

Sofort publizierbar — NFDI-Nutzungsberichte werden der DFG im Rahmen der Fördermonitoring-Pflichten übermittelt und in aggregierter Form publiziert. Einlieferungsstatistiken auf Konsortiumsebene sind nicht personenbeziehbar.

Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC0 / Public DomainCSVJSON

Verwendung in 5 Prozessen
  • Metadatenqualitätsbewertung Automatisierte Bewertung von Metadatenvollständigkeit und -qualität anhand von FAIR-Indikatoren (F-UJI-Score) für alle eingelieferten Datensätze je Konsortium.
  • Deduplizierung cross-Konsortium Identifikation von Datensätzen, die in mehrere NFDI-Konsortien eingeliefert wurden, über persistente Identifier (DOI, Handle) zur Vermeidung von Mehrfachzählungen.
  • Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu Datensatz-Einlieferungen nach NFDI-Konsortium gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
  • Open-Access-Dissemination Veröffentlichung der Ergebnisse aus Datensatz-Einlieferungen nach NFDI-Konsortium über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
  • FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus Datensatz-Einlieferungen nach NFDI-Konsortium nach FAIR-Prinzipien.

Suchindex-Abfragen Research Data Commons

Aggregierte Abfragestatistiken des gemeinsamen Suchindex der NFDI Research Data Commons, der Forschungsdaten aus allen NFDI-Konsortien übergreifend durchsuchbar macht. Enthält Suchanfragen-Volumen nach Fachgebiet, Trefferquoten, Null-Ergebnis-Raten und Filternutzungsverhalten. Ermöglicht nutzerzentrierte Optimierung des konsortienübergreifenden Datendiscovery-Systems.

Sofort publizierbar — Aggregierte Nutzungsstatistiken ohne personenbeziehbare Einzelabfragen werden im Rahmen der NFDI-Transparenzpflichten gegenüber der Förderinstitution DFG veröffentlicht.

Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC0 / Public DomainJSONCSV

Verwendung in 5 Prozessen
  • Query-Log-Analyse Datenschutzkonforme Anonymisierung und Analyse von Suchanfrage-Logs zur Identifikation häufiger Suchthemen, fehlgeschlagener Suchanfragen und Optimierungspotenzial in der Indexstruktur.
  • Relevanzfeedback-Auswertung Auswertung von Klick-Through-Raten und Verweildauer auf Ergebnisseiten als implizites Relevanzfeedback für Verbesserung des Ranking-Algorithmus.
  • Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu Suchindex-Abfragen Research Data Commons auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
  • Open-Access-Dissemination Veröffentlichung der Ergebnisse aus Suchindex-Abfragen Research Data Commons über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
  • FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus Suchindex-Abfragen Research Data Commons nach FAIR-Prinzipien.

Cross-Konsortium-Nutzungsstatistiken NFDI

Statistiken zur konsortienübergreifenden Nachnutzung von Forschungsdaten, d.h. Datensätze eines NFDI-Konsortiums, die von Nutzern anderer Konsortien oder Disziplinen abgerufen werden. Erhoben durch Base4NFDI-Dienste (pid4nfdi, search4nfdi) und individuelle Konsortiumsberichte. Quantifiziert den interdisziplinären Mehrwert der NFDI-Architektur und identifiziert besonders nachgefragte Datensätze.

Sofort publizierbar — Aggregierte Cross-Konsortium-Statistiken sind nicht personenbeziehbar und werden als Teil der NFDI-Wirkungsberichterstattung gegenüber DFG und Wissenschaftsrat publiziert.

Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC0 / Public DomainCSVJSON

Verwendung in 5 Prozessen
  • Disziplinen-Mapping Zuordnung von Datensatz-Konsortiumszugehörigkeit und Nutzer-Institutionszugehörigkeit zu Wissenschaftsdisziplinen (Frascati Manual) für Cross-Disziplin-Nutzungsanalysen.
  • Zitationsabgleich Verknüpfung von Datensatz-DOIs mit Zitationen in wissenschaftlichen Publikationen über DataCite Event Data zur Messung der Forschungswirkung der NFDI-Datendienste.
  • Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu Cross-Konsortium-Nutzungsstatistiken NFDI auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
  • Open-Access-Dissemination Veröffentlichung der Ergebnisse aus Cross-Konsortium-Nutzungsstatistiken NFDI über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
  • FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus Cross-Konsortium-Nutzungsstatistiken NFDI nach FAIR-Prinzipien.

NFDI-Konsortium-Leistungskennzahlen

Standardisierte Leistungskennzahlen aller NFDI-Konsortien zu Datenvolumen, Nutzerzahlen, Diensteumfang und Vernetzungsgrad. Ermöglichen vergleichende Analyse der Konsortiumsentwicklung und Identifikation von Synergien. Werden jährlich im NFDI-Jahresbericht publiziert und für Förderentscheidungen genutzt.

Sofort publizierbar — NFDI-Leistungskennzahlen sind öffentliche Rechenschaftsdaten der öffentlich finanzierten Infrastruktur.

Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSVJSON

Verwendung in 5 Prozessen
  • Kennzahlenerhebung Standardisierte Selbstauskunft aller Konsortien nach einheitlichem Fragebogen mit Definitionen und Messinstruktionen.
  • Plausibilitätsprüfung Externe Validierung gemeldeter Kennzahlen durch NFDI-Direktorat und unabhängige Evaluatoren.
  • Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu NFDI-Konsortium-Leistungskennzahlen auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
  • Interoperabilitäts- und Schnittstellentesting Technische Überprüfung von Datenschnittstellen und Kompatibilität mit bestehenden IT-Systemen für NFDI-Konsortium-Leistungskennzahlen.
  • Automatisierte Datenqualitätsprüfung Kontinuierliche Validierung der Datenqualität in NFDI-Konsortium-Leistungskennzahlen durch regelbasierte Prüfroutinen und Anomalieerkennung im CI/CD-Prozess.

NFDI-Dienste-Katalog

Maschinenlesbarer Katalog aller von NFDI-Konsortien angebotenen Datendienste mit Beschreibungen, Zugangsbedingungen, Zielgruppen und technischen Spezifikationen. Ermöglicht disziplinübergreifende Auffindbarkeit und Nachnutzung von Infrastrukturkomponenten. Wird durch automatisches Harvesting und manuelle Pflege aktuell gehalten.

Sofort publizierbar — Ein öffentlicher Dienste-Katalog ist essentiell für die Auffindbarkeit und Interoperabilität der NFDI-Infrastruktur.

Wissenschaft/TechnikMetadatenEinzelereignis / RohdatenCC0 / Public DomainJSONXML

Verwendung in 5 Prozessen
  • Service-Registry-Integration Automatisiertes Einlesen von Dienst-Beschreibungen aus konsortiumseigenen Service-Registries über standardisierte APIs.
  • Vokabular-Alignment Harmonisierung der Dienst-Beschreibungen auf gemeinsame Terminologien und Klassifikationen für konsortiumsübergreifende Suche.
  • Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu NFDI-Dienste-Katalog gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
  • Datenschutzkonformes HR-Reporting Anonymisiertes Berichtswesen zu Personaldaten aus NFDI-Dienste-Katalog unter Einhaltung datenschutzrechtlicher Anforderungen.
  • Anonymisierte Mikrodata-Bereitstellung Bereitstellung anonymisierter Mikrodaten zu NFDI-Dienste-Katalog für Forschungszwecke über Scientific-Use-Files an akkreditierte Einrichtungen.

Community-Engagement-Statistiken

Quantitative Daten zur Einbindung wissenschaftlicher Communities in die NFDI, einschließlich Mitgliederzahlen in Arbeitsgruppen, Teilnahmezahlen bei Schulungen, aktive Datenproduzenten pro Konsortium und Feedback-Einreichungen. Ermöglichen Messung des Community-Wachstums und der Akzeptanz. Werden für Governanceberichte verwendet.

Sofort publizierbar — Aggregierte Community-Engagement-Statistiken ohne Personenbezug sind öffentliche Informationen zur Reichweite der NFDI.

Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSVJSON

Verwendung in 5 Prozessen
  • Teilnahme-Tracking Automatisierte Erfassung von Registrierungen und Teilnahmen bei NFDI-Veranstaltungen und -Gremien über digitale Systeme.
  • Wachstumsanalyse Zeitreihenauswertung der Community-Größen zur Identifikation von Wachstumstrends und Engagementmustern.
  • Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu Community-Engagement-Statistiken auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
  • Anomalieerkennung und Qualitätskontrolle Automatisierte Erkennung von Ausreißern, Fehlmessungen und Datenanomalien in den Daten zu Community-Engagement-Statistiken.
  • Langzeitarchivierung nach OAIS Dauerhafter Erhalt der Messdaten aus Community-Engagement-Statistiken nach dem OAIS-Referenzmodell in einem zertifizierten digitalen Langzeitarchiv.

Software-Archivierungsrate: NFDI-Forschungssoftware in Software Heritage

NFDI-Konsortien verpflichten sich zur Langzeitarchivierung von Forschungssoftware in Software Heritage. Die Archivierungsrate (Anteil mit persistenter Referenz) wird je Konsortium und Fachgebiet gemessen. de-RSE und NFDI e.V. berichten diese Kennzahlen in Jahresberichten.

Sofort publizierbar — Software-Archivierungsstatistiken sind technische Metadaten ohne Personenbezug; öffentlich für Open-Science-Transparenz.

Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC0 / Public DomainJSON

Verwendung in 5 Prozessen
  • Archivierungsmonitoring Automatisierte Skripte prüfen regelmäßig Software-Repository-Metadaten gegen Software-Heritage-Einträge.
  • Konsortium-Reporting NFDI-Konsortien melden Archivierungsquoten jährlich an NFDI e.V. für konsolidierte Berichte.
  • Wissenschaftliche Nachnutzung Bereitstellung der Daten zu Software-Archivierungsrate: NFDI-Forschungssoftware in Software Heritage für wissenschaftliche Sekundäranalysen über Forschungsdatenzentren.
  • Anomalieerkennung und Qualitätskontrolle Automatisierte Erkennung von Ausreißern, Fehlmessungen und Datenanomalien in den Daten zu Software-Archivierungsrate: NFDI-Forschungssoftware in Software Heritage.
  • Langzeitarchivierung nach OAIS Dauerhafter Erhalt der Messdaten aus Software-Archivierungsrate: NFDI-Forschungssoftware in Software Heritage nach dem OAIS-Referenzmodell in einem zertifizierten digitalen Langzeitarchiv.

Terminologie- und Ontologie-Register der NFDI-Konsortien

NFDI-Konsortien entwickeln und pflegen fachspezifische Ontologien und Terminologien (z.B. NFDI4Chem-Ontologie, GHGA-Datenschema). Ein zentrales Register im Terminology Service der NFDI erfasst alle publizierten Vokabulare. Diese Ressourcen sind Grundlage für semantische Interoperabilität.

Sofort publizierbar — Ontologien und Terminologien sind explizit für offene Nachnutzung entwickelt; kein Personenbezug.

Wissenschaft/TechnikTextdokumenteEinzelereignis / RohdatenCC0 / Public DomainXMLJSON

Verwendung in 5 Prozessen
  • Ontologie-Registrierung Konsortien registrieren publizierte Ontologien im NFDI Terminology Service mit PURL und Versionsinformation.
  • Qualitätsprüfung Automatische OWL-Validierung und manuelle Review durch Ontologie-Experten sichern Qualität der Einträge.
  • Registeraktualisierung und Pflege Regelmäßige Aktualisierung des Registers zu Terminologie- und Ontologie-Register der NFDI-Konsortien durch Abgleich mit behördlichen Meldungen und Revisionen.
  • Georeferenzierung und Kartierung Räumliche Aufbereitung und GIS-gestützte Visualisierung der Daten zu Terminologie- und Ontologie-Register der NFDI-Konsortien für kartografische Auswertungen und Standortanalysen.
  • Open-Data-Publikation auf GovData Bereitstellung der Geodaten zu Terminologie- und Ontologie-Register der NFDI-Konsortien als offener Datensatz auf dem nationalen Datenportal GovData.de nach DCAT-AP.de-Standard.

AAI-Föderierte Identitäten und Authentifizierungsstatistik

Die NFDI-Basisinfrastruktur betreibt ein Authentication and Authorization Infrastructure (AAI) System auf Basis von DFN-AAI und EOSC-Login. Statistiken zu aktiven Nutzeridentitäten, Dienstnutzung und Zugriffsanträgen werden vom NFDI-Infrastrukturkonsortium erfasst.

Nach Aufbereitung publizierbar — AAI-Nutzungsdaten enthalten Nutzeridentitäten; aggregierte Zugriffsstatistiken nach Dienst und Nutzergruppe sind publizierbar.

Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0JSON

Verwendung in 5 Prozessen
  • AAI-Log-Analyse Automatische Auswertung von Shibboleth- und OAuth-Logs nach Dienst, Nutzergruppe und Authentifizierungsquelle.
  • Nutzungsreporting Quartalsberichte zu AAI-Nutzungsstatistiken werden an NFDI-Steuerungsgremien übermittelt.
  • Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu AAI-Föderierte Identitäten und Authentifizierungsstatistik auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
  • Metadaten-Anreicherung und Katalogisierung Systematische Ergänzung beschreibender Metadaten zu AAI-Föderierte Identitäten und Authentifizierungsstatistik für verbesserte Auffindbarkeit und Nachnutzbarkeit in Datenportalen.
  • Metadaten-Standardisierung DDI Dokumentation der Erhebungsmetadaten aus AAI-Föderierte Identitäten und Authentifizierungsstatistik im DDI-Codebook-Standard für Wiederverwendbarkeit in Forschungsinfrastrukturen.

HPC-Cluster-Auslastungsstatistiken

Nutzungsdaten zu Hochleistungsrechenclustern inkl. Auslastungsgrad, Jobwartezeiten und Nutzerverteilung nach Disziplin.

Sofort publizierbar — Aggregierte HPC-Auslastungsstatistiken sind öffentliche Kennzahlen zur Infrastrukturtransparenz.

Wissenschaft/TechnikMessungen / SensordatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSV

Verwendung in 5 Prozessen
  • Monitoring-Aggregation Aggregierung von Echtzeit-Monitoring-Daten zu stündlichen und täglichen Auslastungsprofilen.
  • Engpassanalyse Identifikation von Auslastungsspitzen und Wartezeiten zur Kapazitätsplanung und Priorisierung.
  • Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu HPC-Cluster-Auslastungsstatistiken auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
  • Metadaten-Anreicherung und Katalogisierung Systematische Ergänzung beschreibender Metadaten zu HPC-Cluster-Auslastungsstatistiken für verbesserte Auffindbarkeit und Nachnutzbarkeit in Datenportalen.
  • Metadaten-Standardisierung DDI Dokumentation der Erhebungsmetadaten aus HPC-Cluster-Auslastungsstatistiken im DDI-Codebook-Standard für Wiederverwendbarkeit in Forschungsinfrastrukturen.

Supercomputer-Rechenzeit-Vergaben

Daten zu vergebenen Rechenzeit-Kontingenten auf nationalen Supercomputern inkl. Projektbeschreibung und zugeteilter Ressourcen.

Sofort publizierbar — Rechenzeit-Vergaben auf öffentlich geförderten Supercomputern sind transparenzpflichtige Förderdaten.

Wissenschaft/TechnikMetadatenEinzelereignis / RohdatenCC BY 4.0JSON

Verwendung in 5 Prozessen
  • Allokationsregistrierung Strukturierte Erfassung von Projekttitel, Antragsteller-Institution, bewilligter Knotenstunden und Nutzungszeitraum.
  • Nutzungsmonitoring Abgleich beantragter mit tatsächlich genutzter Rechenzeit zur Ressourceneffizienzanalyse.
  • Digitale Weiterverarbeitung Bereitstellung der Daten zu Supercomputer-Rechenzeit-Vergaben als maschinenlesbare Schnittstelle für digitale Anwendungen.
  • Interoperabilitäts- und Schnittstellentesting Technische Überprüfung von Datenschnittstellen und Kompatibilität mit bestehenden IT-Systemen für Supercomputer-Rechenzeit-Vergaben.
  • Automatisierte Datenqualitätsprüfung Kontinuierliche Validierung der Datenqualität in Supercomputer-Rechenzeit-Vergaben durch regelbasierte Prüfroutinen und Anomalieerkennung im CI/CD-Prozess.

Grid-Computing-Nutzungsdaten

Statistiken zur Nutzung verteilter Grid-Computing-Infrastrukturen (z.B. EGI, WLCG) durch deutsche Forschungseinrichtungen.

Sofort publizierbar — Grid-Nutzungsstatistiken sind aggregierte Infrastrukturkennzahlen ohne sensible Projektinhalte.

Wissenschaft/TechnikMessungen / SensordatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSV

Verwendung in 5 Prozessen
  • Federation-Reporting Aggregierung von Nutzungsberichten der deutschen Grid-Knoten für EGI-Accounting-Portal-Einträge.
  • Kapazitätsplanung Analyse von Lastverteilungsmustern zur Optimierung der nationalen Grid-Beitragsplanung.
  • Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu Grid-Computing-Nutzungsdaten gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
  • Open-Access-Dissemination Veröffentlichung der Ergebnisse aus Grid-Computing-Nutzungsdaten über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
  • FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus Grid-Computing-Nutzungsdaten nach FAIR-Prinzipien.

Forschungsnetz-Bandbreiten-Statistiken

Auslastungs- und Kapazitätsdaten des deutschen Forschungsnetzes (DFN) inkl. Datendurchsatz und Engpassanalysen.

Sofort publizierbar — Netzauslastungsstatistiken sind öffentliche Infrastrukturkennzahlen ohne sicherheitsrelevante Topologieinformationen.

Wissenschaft/TechnikMessungen / SensordatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSV

Verwendung in 5 Prozessen
  • SNMP-Monitoring Kontinuierliche Erfassung von Netzauslastungsdaten über SNMP-Protokoll an DFN-Knotenpunkten.
  • Traffic-Analyse Analyse von Datenflussmustern zur Identifikation von Engpässen und Planungsgrundlage für Kapazitätserweiterungen.
  • Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu Forschungsnetz-Bandbreiten-Statistiken auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
  • Open-Access-Dissemination Veröffentlichung der Ergebnisse aus Forschungsnetz-Bandbreiten-Statistiken über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
  • FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus Forschungsnetz-Bandbreiten-Statistiken nach FAIR-Prinzipien.

Cloud-HPC-Adoptionsraten Forschung

Statistiken zur Nutzung kommerzieller Cloud-Dienste für wissenschaftliches Rechnen. Zeigt Migrationstrends von On-Premise zu Cloud.

Sofort publizierbar — Aggregierte Cloud-Adoptionsstatistiken sind methodische Trendanalysen ohne wettbewerbssensible Anbieterinformationen.

Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSV

Verwendung in 5 Prozessen
  • Umfragedatenerhebung Regelmäßige Befragungen von Rechenzentren und Forschungsgruppen zu Cloud-Nutzungsanteilen und -Diensten.
  • Trendmodellierung Extrapolation von Adoptionskurven zur Prognose des zukünftigen Cloud-HPC-Bedarfs in der deutschen Forschung.
  • Wissenschaftliche Nachnutzung Bereitstellung der Daten zu Cloud-HPC-Adoptionsraten Forschung für wissenschaftliche Sekundäranalysen über Forschungsdatenzentren.
  • Open-Access-Dissemination Veröffentlichung der Ergebnisse aus Cloud-HPC-Adoptionsraten Forschung über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
  • FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus Cloud-HPC-Adoptionsraten Forschung nach FAIR-Prinzipien.

Jupyter-Hub-Nutzungsstatistiken

Nutzungsdaten zu institutionellen JupyterHub-Instanzen inkl. aktive Nutzer, Notebook-Typen und Ressourcenverbrauch.

Sofort publizierbar — Aggregierte Nutzungsstatistiken zu wissenschaftlichen Arbeitsumgebungen sind öffentliche Infrastrukturkennzahlen.

Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSV

Verwendung in 5 Prozessen
  • Aktivitäts-Logging Anonymisierte Erfassung von Session-Dauer, Kernel-Typen und Ressourcennutzung je Nutzersitzung.
  • Nutzungsmuster-Analyse Auswertung zeitlicher und fachspezifischer Nutzungsmuster zur Kapazitäts- und Serviceplanung.
  • Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu Jupyter-Hub-Nutzungsstatistiken auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
  • Metadaten-Anreicherung und Katalogisierung Systematische Ergänzung beschreibender Metadaten zu Jupyter-Hub-Nutzungsstatistiken für verbesserte Auffindbarkeit und Nachnutzbarkeit in Datenportalen.
  • Metadaten-Standardisierung DDI Dokumentation der Erhebungsmetadaten aus Jupyter-Hub-Nutzungsstatistiken im DDI-Codebook-Standard für Wiederverwendbarkeit in Forschungsinfrastrukturen.

NFDI-Konsortium-Metadaten-Katalog

Gemeinsamer Metadatenkatalog der NFDI-Konsortien mit Informationen zu Datensätzen und Services.

Sofort publizierbar — Der Katalog beschreibt Datensätze und Dienste der Konsortien; Auffindbarkeit ist der Zweck eines Metadatenkatalogs. Personenbezogene Angaben enthält er nicht; die Public-Domain-Lizenz erlaubt die Weiterverwendung.

Wissenschaft/TechnikMetadatenEinzelereignis / RohdatenCC0 / Public DomainJSONXML

Verwendung in 5 Prozessen
  • Metadaten-Harvesting Automatisierte Aggregation von Metadaten aus Konsortien-Repositorien
  • FAIR-Prüfung Automatische Bewertung von Datensätzen auf FAIR-Prinzipien-Konformität
  • Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu NFDI-Konsortium-Metadaten-Katalog gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
  • Interoperabilitäts- und Schnittstellentesting Technische Überprüfung von Datenschnittstellen und Kompatibilität mit bestehenden IT-Systemen für NFDI-Konsortium-Metadaten-Katalog.
  • Automatisierte Datenqualitätsprüfung Kontinuierliche Validierung der Datenqualität in NFDI-Konsortium-Metadaten-Katalog durch regelbasierte Prüfroutinen und Anomalieerkennung im CI/CD-Prozess.

Terminologie-Service NFDI

Gemeinsamer Terminologie-Service mit kontrollierten Vokabularen und Ontologien für NFDI-Fachcommunities.

Sofort publizierbar — Kontrollierte Vokabulare und Ontologien sind gemeinsame Referenzen der Fachcommunities und nur nützlich, wenn alle sie verwenden können. Die Public-Domain-Lizenz erlaubt die uneingeschränkte Weiterverwendung.

Wissenschaft/TechnikMetadatenEinzelereignis / RohdatenCC0 / Public DomainXMLJSON

Verwendung in 5 Prozessen
  • Ontologie-Kuratierung Regelmäßige Aktualisierung und Harmonisierung der Fachvokabulare
  • API-Bereitstellung REST-API für Terminologieabfragen durch Forschungsanwendungen
  • Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu Terminologie-Service NFDI gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
  • Interoperabilitäts- und Schnittstellentesting Technische Überprüfung von Datenschnittstellen und Kompatibilität mit bestehenden IT-Systemen für Terminologie-Service NFDI.
  • Automatisierte Datenqualitätsprüfung Kontinuierliche Validierung der Datenqualität in Terminologie-Service NFDI durch regelbasierte Prüfroutinen und Anomalieerkennung im CI/CD-Prozess.

NFDI-Service-Nutzungsstatistik

Aggregierte Statistik zur Nutzung von NFDI-Datendiensten: Anfragen, Datentransfer, Nutzerherkunft.

Sofort publizierbar — Anfragen, Datentransfer und Nutzerherkunft sind über alle Zugriffe summiert; einzelne Nutzende sind darin nicht unterscheidbar. Die Public-Domain-Lizenz erlaubt die uneingeschränkte Weiterverwendung.

Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC0 / Public DomainCSVJSON

Verwendung in 5 Prozessen
  • Log-Aggregation Tägliche Aggregation von Service-Logs ohne IP-Adressen
  • Reporting Monatliches Nutzungsreporting an DFG und Konsortialpartner
  • Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu NFDI-Service-Nutzungsstatistik auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
  • Metadaten-Anreicherung und Katalogisierung Systematische Ergänzung beschreibender Metadaten zu NFDI-Service-Nutzungsstatistik für verbesserte Auffindbarkeit und Nachnutzbarkeit in Datenportalen.
  • Metadaten-Standardisierung DDI Dokumentation der Erhebungsmetadaten aus NFDI-Service-Nutzungsstatistik im DDI-Codebook-Standard für Wiederverwendbarkeit in Forschungsinfrastrukturen.

NFDI-Konsortienregister und Dienstekatalog

Metadatenkatalog der NFDI-Konsortien mit Fachbereich, bereitgestellten Datendiensten, Repositorien, Vokabularen und Zugangsbedingungen.

Sofort publizierbar — NFDI-Infrastrukturen sind öffentlich finanziert; Dienstekataloge sind explizit für die wissenschaftliche Community gedacht und offen zugänglich.

Wissenschaft/TechnikMetadatenEinzelereignis / RohdatenCC0 / Public DomainJSONXML

Verwendung in 5 Prozessen
  • Konsortienaufnahme Erfassung aller DFG-geförderten NFDI-Konsortien mit Dienst- und Technologieprofil nach standardisiertem Schema.
  • Dienst-API-Dokumentation Pflege maschinenlesbarer API-Beschreibungen (OpenAPI) für alle Datenzugangsdienste der Konsortien.
  • Nutzerdokumentation Bereitstellung nutzerfreundlicher Einstiegsdokumentation und Tutorial-Materialien für Forschende.
  • Georeferenzierung und Kartierung Räumliche Aufbereitung und GIS-gestützte Visualisierung der Daten zu NFDI-Konsortienregister und Dienstekatalog für kartografische Auswertungen und Standortanalysen.
  • Open-Data-Publikation auf GovData Bereitstellung der Geodaten zu NFDI-Konsortienregister und Dienstekatalog als offener Datensatz auf dem nationalen Datenportal GovData.de nach DCAT-AP.de-Standard.

Forschungsdaten-Repositorien-Verzeichnis

Verzeichnis zertifizierter Forschungsdaten-Repositorien in Deutschland (re3data.org): Fach, Zertifizierung (CoreTrustSeal), Zugangsbedingungen, Volumen.

Sofort publizierbar — re3data.org ist ein öffentlich finanzierter, offener Metadatendienst; alle Repositoriums-Metadaten sind frei zugänglich.

Wissenschaft/TechnikMetadatenEinzelereignis / RohdatenCC0 / Public DomainXMLJSON

Verwendung in 5 Prozessen
  • Repositoriumsaufnahme Erfassung neuer Repositorien über Self-Submission-Prozess auf re3data.org mit redaktioneller Prüfung.
  • Metadatenqualitätsprüfung Regelmäßige Überprüfung und Aktualisierung von Repositoriums-Metadaten durch re3data-Redaktion.
  • API-Bereitstellung Maschinenlesbare Bereitstellung über re3data-API für Integration in Datenmanagementpläne und NFDI-Dienste.
  • Open-Access-Dissemination Veröffentlichung der Ergebnisse aus Forschungsdaten-Repositorien-Verzeichnis über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
  • FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus Forschungsdaten-Repositorien-Verzeichnis nach FAIR-Prinzipien.

Datenmanagementplan-Metadaten

Metadaten aus maschinell lesbaren Datenmanagementplänen (DMP) geförderter Projekte: Datentypen, Speicherorte, Zugangsbedingungen, Archivierungsplanung.

Nach Aufbereitung publizierbar — DMP-Inhalte können proprietäre Forschungsstrategien enthalten; aggregierte DMP-Metadaten und anonymisierte Templates publizierbar.

Wissenschaft/TechnikMetadatenEinzelereignis / RohdatenCC BY 4.0JSONXML

Verwendung in 5 Prozessen
  • DMP-Extraktion Automatisiertes Parsing maschinenlesbarer DMPs (RDA-DMP Common Standard) aus Fördersystemen.
  • Mustererkennung NLP-Analyse von DMP-Texten zur Identifikation typischer Datenmanagementpraktiken nach Fach.
  • Best-Practice-Publikation Ableitung und Veröffentlichung von Muster-DMPs für verschiedene Disziplinen als Orientierungshilfe.
  • Metadaten-Anreicherung und Katalogisierung Systematische Ergänzung beschreibender Metadaten zu Datenmanagementplan-Metadaten für verbesserte Auffindbarkeit und Nachnutzbarkeit in Datenportalen.
  • Digitales Rechtemanagement Implementierung eines DRM-Systems zur Verwaltung von Urheberrechten, Nutzungslizenzen und Verwertungsansprüchen für Datenmanagementplan-Metadaten.

NFDI Datendienste Nutzungsmetriken

Aggregierte Nutzungsmetriken (Datenabrufe, API-Calls, Registrierungen) für NFDI-Konsortium-Datendienste nach Fachgebiet und Nutzertyp.

Sofort publizierbar — Nutzungsmetriken ohne Personenbezug; NFDI-Transparenzpflicht gegenüber DFG.

Wissenschaft/TechnikTransaktionsdatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSVJSON

Verwendung in 5 Prozessen
  • Log-Aggregation Server-Logs werden mit ELK-Stack aggregiert und personenbezogene IPs entfernt.
  • COUNTER-Analogie Metriken folgen dem COUNTER-5-Rahmen für Forschungsdaten-Repositories.
  • Konsortiumsvergleich Nutzungszahlen werden zwischen NFDI-Konsortien normiert verglichen.
  • DFG-Fortschrittsbericht Metriken belegen Nutzungsausbau in jährlichen DFG-Verwendungsnachweisen.
  • Open-Data-Publikation auf GovData Bereitstellung der Geodaten zu NFDI Datendienste Nutzungsmetriken als offener Datensatz auf dem nationalen Datenportal GovData.de nach DCAT-AP.de-Standard.

PID-Vergabe Statistik

Statistiken zur Persistenten Identifikatoren-Vergabe (DOI, ORCID-Verknüpfung, ROR) durch NFDI-Konsortien und ihre Mitgliedsinstitutionen.

Sofort publizierbar — PID-Metadaten sind per Designprinzip offen und maschinell abrufbar.

Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC0 / Public DomainJSONCSV

Verwendung in 5 Prozessen
  • DataCite-API-Abfrage DOI-Vergabestatistiken werden monatlich über DataCite REST-API abgerufen.
  • ORCID-Matching Forschenden-DOIs werden mit ORCID-Profilen via ORCID-API verknüpft.
  • ROR-Institutionsabdeckung Institutionelle Affiliationen werden auf ROR-Entitäten normiert.
  • Scholix-Integration Datensatz-Publikations-Links werden im Scholix-Framework angemeldet.
  • Metadaten-Standardisierung DDI Dokumentation der Erhebungsmetadaten aus PID-Vergabe Statistik im DDI-Codebook-Standard für Wiederverwendbarkeit in Forschungsinfrastrukturen.

FAIR-Reife Assessment Forschungsdaten

Automatisiertes FAIR-Assessment (Findable, Accessible, Interoperable, Reusable) für in NFDI-Diensten gespeicherte Forschungsdaten nach Maturity-Indikatoren.

Sofort publizierbar — FAIR-Bewertungsscores sind Infrastrukturmetadaten; Methodendokumentation offen.

Wissenschaft/TechnikMetadatenEinzelereignis / RohdatenCC BY 4.0JSONCSV

Verwendung in 5 Prozessen
  • F-UJI-Assessment Automatisiertes FAIR-Scoring wird mit dem F-UJI-Tool (FAIRsFAIR) durchgeführt.
  • Maturity-Modell Ergebnisse werden gegen RDA-FAIR-Maturity-Indikatoren (RDA-F-AI-01 etc.) gemappt.
  • Zeitverlaufsanalyse FAIR-Scores werden versioniert, um Verbesserungen durch Kurationsmaßnahmen zu zeigen.
  • Community-Feedback Datenprovider erhalten automatisierte Verbesserungsempfehlungen per E-Mail.
  • FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus FAIR-Reife Assessment Forschungsdaten nach FAIR-Prinzipien.

NFDI-Konsortien-Übersicht

Übersicht der Fachkonsortien der Nationalen Forschungsdateninfrastruktur.

Sofort publizierbar — Verzeichnet werden Konsortien mit Fachgebiet, Sprecherinstitution und Förderphase. Die Übersicht dient der Auffindbarkeit von Ansprechstellen; Beschäftigte erscheinen mit Funktion, nicht privat.

Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0JSON

Verwendung in 5 Prozessen
  • Datenerhebung Erhebung der Primärdaten zu NFDI-Konsortien-Übersicht im wissenschaftlichen Erhebungs- bzw. Forschungsprozess.
  • Aufbereitung Strukturierung, Kodierung und Qualitätsaufbereitung der Daten zu NFDI-Konsortien-Übersicht.
  • Qualitätssicherung Validierung, Peer-Review und Konsistenzprüfung der NFDI-Konsortien-Übersicht.
  • Archivierung und Bereitstellung Langzeitarchivierung und FAIR-konforme Bereitstellung der NFDI-Konsortien-Übersicht über Repositorien.
  • Analyse und Auswertung Wissenschaftliche Auswertung und Sekundäranalyse auf Basis der NFDI-Konsortien-Übersicht.

Katalog der Datendienste

Verzeichnis bereitgestellter Werkzeuge und Datendienste.

Sofort publizierbar — Verzeichnet werden Werkzeuge und Dienste mit Zweck, Schnittstelle und Betreiber. Ein Dienstekatalog nützt nur, wenn er auffindbar ist; Nutzungsdaten sind nicht Teil davon.

Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0JSON

Verwendung in 5 Prozessen
  • Datenerhebung Erhebung der Primärdaten zu Katalog der Datendienste im wissenschaftlichen Erhebungs- bzw. Forschungsprozess.
  • Aufbereitung Strukturierung, Kodierung und Qualitätsaufbereitung der Daten zu Katalog der Datendienste.
  • Qualitätssicherung Validierung, Peer-Review und Konsistenzprüfung der Katalog der Datendienste.
  • Archivierung und Bereitstellung Langzeitarchivierung und FAIR-konforme Bereitstellung der Katalog der Datendienste über Repositorien.
  • Analyse und Auswertung Wissenschaftliche Auswertung und Sekundäranalyse auf Basis der Katalog der Datendienste.

Terminologie- und Ontologiedienste

Bereitgestellte Vokabulare, Ontologien und Normdaten.

Sofort publizierbar — Bereitgestellt werden Vokabulare und Ontologien als Referenzressourcen. Ihr Zweck ist die gemeinsame Nutzung; sie beschreiben Begriffe und Beziehungen, keine Personen und keine Messwerte.

Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0JSON

Verwendung in 5 Prozessen
  • Datenerhebung Erhebung der Primärdaten zu Terminologie- und Ontologiedienste im wissenschaftlichen Erhebungs- bzw. Forschungsprozess.
  • Aufbereitung Strukturierung, Kodierung und Qualitätsaufbereitung der Daten zu Terminologie- und Ontologiedienste.
  • Qualitätssicherung Validierung, Peer-Review und Konsistenzprüfung der Terminologie- und Ontologiedienste.
  • Archivierung und Bereitstellung Langzeitarchivierung und FAIR-konforme Bereitstellung der Terminologie- und Ontologiedienste über Repositorien.
  • Analyse und Auswertung Wissenschaftliche Auswertung und Sekundäranalyse auf Basis der Terminologie- und Ontologiedienste.

Schulungen und Trainingsangebote

Zahl und Reichweite von Trainings zu Forschungsdatenmanagement.

Sofort publizierbar — Gezählt werden Veranstaltungen und Teilnahmen je Themenfeld und Jahr. Bezugseinheit ist der Termin; Anmeldelisten und Lernstände bleiben bei den durchführenden Einrichtungen.

BildungMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSV

Verwendung in 5 Prozessen
  • Datenerhebung Erhebung der Primärdaten zu Schulungen und Trainingsangebote im wissenschaftlichen Erhebungs- bzw. Forschungsprozess.
  • Aufbereitung Strukturierung, Kodierung und Qualitätsaufbereitung der Daten zu Schulungen und Trainingsangebote.
  • Qualitätssicherung Validierung, Peer-Review und Konsistenzprüfung der Schulungen und Trainingsangebote.
  • Archivierung und Bereitstellung Langzeitarchivierung und FAIR-konforme Bereitstellung der Schulungen und Trainingsangebote über Repositorien.
  • Analyse und Auswertung Wissenschaftliche Auswertung und Sekundäranalyse auf Basis der Schulungen und Trainingsangebote.

HPC-Infrastruktur & Wissenschaftliches Rechnen

32 Datentypen

HPC-Nutzungsstatistiken

Auslastung, Rechenzeit-Kontingente und Fachgebietsdistribution auf nationalen Hochleistungsrechnern (HLRS Stuttgart, JSC Jülich, LRZ München) und Gauss-Zentren.

Sofort publizierbar — Gauss Centre for Supercomputing und Mitgliedszentren veröffentlichen Nutzungsstatistiken in Jahresberichten.

Wissenschaft/TechnikPersonenbezogene DatenKleinräumig (Stadtteil / Gemeinde)CC BY 4.0CSVExcel (XLSX)

Verwendung in 5 Prozessen
  • Ressourcenallokation Nutzungsstatistiken informieren Kontingentierungsentscheidungen und Ausbauplanungen für HPC-Infrastruktur.
  • Evaluation Fachgebietliche Verteilung der Rechenzeiten ist Kerndaten für Bewertung der wissenschaftlichen Breitennutzung nationaler Infrastruktur.
  • Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu HPC-Nutzungsstatistiken auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
  • Interoperabilitäts- und Schnittstellentesting Technische Überprüfung von Datenschnittstellen und Kompatibilität mit bestehenden IT-Systemen für HPC-Nutzungsstatistiken.
  • Automatisierte Datenqualitätsprüfung Kontinuierliche Validierung der Datenqualität in HPC-Nutzungsstatistiken durch regelbasierte Prüfroutinen und Anomalieerkennung im CI/CD-Prozess.

KI-Infrastruktur-Kapazitäten

GPU-Kapazitäten, Modell-Trainingsvolumina und KI-Forschungsprojekte auf nationaler KI-Infrastruktur (BMBF-KI-Rechenzentren, DFKI, Helmholtz-KI) — Indikator für KI-Wettbewerbsfähigkeit.

Sofort publizierbar — Rechenkapazität, Trainingsvolumina und Projektzahlen auf öffentlich finanzierter Infrastruktur sind Ausstattungsdaten. Sie zeigen, ob eine Forschungslandschaft mithalten kann; Modelle, Daten und Nutzerkonten sind nicht Gegenstand.

Wissenschaft/TechnikPersonenbezogene DatenIndividuell / MikrodatenCC BY 4.0CSVExcel (XLSX)

Verwendung in 5 Prozessen
  • KI-Strategie GPU-Kapazitäten sind Schlüsselindikator für internationale Wettbewerbsfähigkeit in KI-Forschung und -Entwicklung.
  • Infrastrukturplanung Kapazitätsdaten informieren BMBF-Investitionsentscheidungen für weitere KI-Rechenzentren.
  • Digitale Weiterverarbeitung Bereitstellung der Daten zu KI-Infrastruktur-Kapazitäten als maschinenlesbare Schnittstelle für digitale Anwendungen.
  • Open-Access-Dissemination Veröffentlichung der Ergebnisse aus KI-Infrastruktur-Kapazitäten über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
  • FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus KI-Infrastruktur-Kapazitäten nach FAIR-Prinzipien.

Energieverbrauch Wissenschaftsrechenzentren

PUE-Werte (Power Usage Effectiveness), Stromverbrauch in GWh und CO₂-Emissionen wissenschaftlicher Rechenzentren nach Einrichtung — Grundlage für Klimaschutzstrategien.

Sofort publizierbar — Rechenzentren veröffentlichen PUE-Werte zunehmend als Teil von Nachhaltigkeitsberichten und auf Initiative von Green IT-Programmen.

FinanzenPersonenbezogene DatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSVExcel (XLSX)

Verwendung in 5 Prozessen
  • Klimaschutz Rechenzentrum-Energieverbrauch ist signifikanter und wachsender Faktor für institutionelle CO₂-Bilanzen.
  • Effizienzoptimierung PUE-Benchmarking treibt Investitionen in energieeffiziente Kühlung und erneuerbare Energieversorgung.
  • Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu Energieverbrauch Wissenschaftsrechenzentren gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
  • Klimafolgen- und Risikoabschätzung Systematische Modellierung von Klimaauswirkungen und Umweltrisiken auf Basis der Daten zu Energieverbrauch Wissenschaftsrechenzentren.
  • Umweltberichterstattung nach EU-Recht Regelmäßige Meldung der Umweltdaten aus Energieverbrauch Wissenschaftsrechenzentren an zuständige EU-Behörden (EEA, ECHA) gemäß gesetzlicher Berichtspflichten.

Simulationsdaten und Modellarchive

Archivierte Simulationsergebnisse aus wissenschaftlichen Großrechnungen: Klimamodell-Ensembles, Quantenchemie-Berechnungen, CFD-Simulationen mit Parameterdokumentation.

Sofort publizierbar — Klimamodell-Daten (CMIP6, CORDEX) werden auf ESGF vollständig offen bereitgestellt. Andere Disziplinen folgen zunehmend.

Wissenschaft/TechnikGeodatenIndividuell / MikrodatenCC BY 4.0CSVJSON

Verwendung in 5 Prozessen
  • Reproduzierbarkeit Archivierte Simulationsdaten sind Grundvoraussetzung für die Reproduzierbarkeit computationeller Wissenschaft.
  • Sekundärnutzung Verfügbare Simulationsdaten ermöglichen Analysen jenseits der ursprünglichen Fragestellung ohne erneuten Rechenaufwand.
  • Digitale Weiterverarbeitung Bereitstellung der Daten zu Simulationsdaten und Modellarchive als maschinenlesbare Schnittstelle für digitale Anwendungen.
  • Klimafolgen- und Risikoabschätzung Systematische Modellierung von Klimaauswirkungen und Umweltrisiken auf Basis der Daten zu Simulationsdaten und Modellarchive.
  • Umweltberichterstattung nach EU-Recht Regelmäßige Meldung der Umweltdaten aus Simulationsdaten und Modellarchive an zuständige EU-Behörden (EEA, ECHA) gemäß gesetzlicher Berichtspflichten.

Forschungsnetz-Datentransferstatistik

Volumen und Spitzengeschwindigkeiten des Datentransfers im Deutschen Wissenschaftsnetz (DFN-Netz) nach Nutzungstyp, Region und Wachstumstrend.

Sofort publizierbar — DFN publiziert Netzauslastungsstatistiken und Wachstumsdaten im Jahresbericht und auf der DFN-Website.

Wissenschaft/TechnikPersonenbezogene DatenIndividuell / MikrodatenCC BY 4.0CSVExcel (XLSX)

Verwendung in 5 Prozessen
  • Netzplanung Wachstumsstatistiken des DFN-Netzes informieren Ausbau- und Kapazitätsinvestitionen für das Wissenschaftsnetz.
  • Infrastruktur-Benchmarking DFN-Transfer-Kapazitäten sind Indikator für die digitale Konnektivität der deutschen Wissenschaftslandschaft.
  • Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu Forschungsnetz-Datentransferstatistik auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
  • Open-Access-Dissemination Veröffentlichung der Ergebnisse aus Forschungsnetz-Datentransferstatistik über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
  • FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus Forschungsnetz-Datentransferstatistik nach FAIR-Prinzipien.

HPC Ressourcennutzung

Rechenkapazitäten und Auslastung nationaler HPC-Systeme nach Forschungsbereich.

Sofort publizierbar — Rechenkapazität und Auslastung sind je Forschungsbereich zusammengefasst; einzelne Projekte und Rechenaufträge sind darin nicht erkennbar. Die Public-Domain-Lizenz erlaubt die uneingeschränkte Weiterverwendung.

Wissenschaft/TechnikMessungen / SensordatenAggregiert (zeitlich oder räumlich)CC0 / Public DomainCSV

Verwendung in 5 Prozessen
  • Monitoring Automatisiertes Cluster-Monitoring der Rechenzentren
  • Berichterstattung und Eskalationsmanagement Regelmäßige Berichterstattung der Monitoring-Ergebnisse zu HPC Ressourcennutzung mit Schwellenwert-Alerting bei Auffälligkeiten.
  • Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu HPC Ressourcennutzung gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
  • Open-Access-Dissemination Veröffentlichung der Ergebnisse aus HPC Ressourcennutzung über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
  • FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus HPC Ressourcennutzung nach FAIR-Prinzipien.

Cloud-Dienste für Wissenschaft

Verfügbare Cloud-Dienste und Speicherkapazitäten für Forschungsdaten (EOSC, de.NBI).

Sofort publizierbar — Der Dienstkatalog beschreibt verfügbare Angebote und Speicherkapazitäten und richtet sich an Forschende. Nutzungsdaten enthält er nicht; die Public-Domain-Lizenz erlaubt die uneingeschränkte Weiterverwendung.

Wissenschaft/TechnikMetadatenEinzelereignis / RohdatenCC0 / Public DomainCSV

Verwendung in 5 Prozessen
  • Katalogisierung Harvesting aus EOSC-Portal und de.NBI-Dienstverzeichnis
  • Datenpflege und Aktualisierung Regelmäßige Aktualisierung des Katalogs zu Cloud-Dienste für Wissenschaft sowie Prüfung auf Vollständigkeit und Aktualität der Einträge.
  • Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu Cloud-Dienste für Wissenschaft gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
  • Open-Access-Dissemination Veröffentlichung der Ergebnisse aus Cloud-Dienste für Wissenschaft über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
  • FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus Cloud-Dienste für Wissenschaft nach FAIR-Prinzipien.

HPC-Zugangsprogramme und Kontingente

Verwaltungsdaten zu HPC-Zugangsprogrammen (NHR, DFG-Großgeräteanträge): zugewiesene Rechenzeit-Kontingente nach Projekt und Institution, Ausschöpfungsquoten, Laufzeiten. Grundlage für nationale Ressourcenplanung.

Sofort publizierbar — Aggregierte Nutzungskontingente und Projektlisten ohne individuelle Nutzungsdetails können veröffentlicht werden.

Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSVJSON

Verwendung in 5 Prozessen
  • Ressourcenzuteilung Transparenz über Vergabe nationaler Rechenzeit-Ressourcen an Wissenschaftsprojekte.
  • Bedarfsplanung Grundlage für Kapazitätserweiterungsplanungen der NHR-Zentren.
  • Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu HPC-Zugangsprogramme und Kontingente gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
  • Datenschutzkonformes HR-Reporting Anonymisiertes Berichtswesen zu Personaldaten aus HPC-Zugangsprogramme und Kontingente unter Einhaltung datenschutzrechtlicher Anforderungen.
  • Anonymisierte Mikrodata-Bereitstellung Bereitstellung anonymisierter Mikrodaten zu HPC-Zugangsprogramme und Kontingente für Forschungszwecke über Scientific-Use-Files an akkreditierte Einrichtungen.

CO₂-Fußabdruck Wissenschaftliches Rechenzentrum

Emissionsdaten und Nachhaltigkeitskennzahlen wissenschaftlicher Rechenzentren: PUE-Werte, Energiemix, CO₂-Äquivalente pro Recheneinheit, Kühlungseffizienz, Anteil erneuerbarer Energien. Basis für Green-IT-Benchmarking.

Sofort publizierbar — PUE-Werte, Energiemix und Emissionen je Recheneinheit beschreiben den Betrieb technischer Anlagen. Personenbezogene Angaben enthalten sie nicht; CC BY erlaubt die Weiterverwendung mit Quellenangabe.

UmweltMessungen / SensordatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSVJSON

Verwendung in 5 Prozessen
  • Nachhaltigkeitsberichterstattung Jährliche CO₂-Bilanzierung des Rechenzentrumsbetriebs nach GHG-Protokoll.
  • Effizienzoptimierung Benchmarking von PUE und Energiemix zur Identifikation von Einsparpotenzialen.
  • Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu CO₂-Fußabdruck Wissenschaftliches Rechenzentrum gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
  • Klimafolgen- und Risikoabschätzung Systematische Modellierung von Klimaauswirkungen und Umweltrisiken auf Basis der Daten zu CO₂-Fußabdruck Wissenschaftliches Rechenzentrum.
  • Umweltberichterstattung nach EU-Recht Regelmäßige Meldung der Umweltdaten aus CO₂-Fußabdruck Wissenschaftliches Rechenzentrum an zuständige EU-Behörden (EEA, ECHA) gemäß gesetzlicher Berichtspflichten.

Rechenzeit-Belegungsstatistiken nach Fachgebiet

Jährliche Statistiken zur Nutzung von Rechenzeit auf nationalen Hochleistungsrechnern (JUWELS, SuperMUC-NG, Hawk, Lise/Emmy) der Gauss Centre for Supercomputing (GCS)-Zentren (FZJ, LRZ, HLRS), aufgeschlüsselt nach Fachgebiet (Physik, Chemie, Ingenieurwissenschaften, Lebenswissenschaften, Klima) und Projekttyp (Großprojekte, Normalverfahren). Enthält Core-h-Verbräuche und Auslastungsgrade nach Rechner und Partition.

Sofort publizierbar — Verbrauchte Rechenzeit je Fachgebiet und Projekttyp ist der Nachweis darüber, wofür eine öffentlich finanzierte Infrastruktur genutzt wurde. Projektinhalte, Codes und Antragsteller sind darin nicht enthalten.

Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC0 / Public DomainCSVJSON

Verwendung in 5 Prozessen
  • Ressourcenzuteilungsanalyse Auswertung der Diskrepanz zwischen beantragten und tatsächlich genutzten Rechenzeiten je Projekt und Fachgebiet zur Optimierung des Zuteilungsverfahrens (Peer-Review-Ausschüsse).
  • Effizienzmetriken Berechnung von CPU-Auslastung, Paralleleffizienz und GPU-Utilization aus Job-Scheduler-Logs zur Identifikation ineffizienter Applikationsmuster und Optimierungspotenzial.
  • Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu Rechenzeit-Belegungsstatistiken nach Fachgebiet auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
  • Klimafolgen- und Risikoabschätzung Systematische Modellierung von Klimaauswirkungen und Umweltrisiken auf Basis der Daten zu Rechenzeit-Belegungsstatistiken nach Fachgebiet.
  • Umweltberichterstattung nach EU-Recht Regelmäßige Meldung der Umweltdaten aus Rechenzeit-Belegungsstatistiken nach Fachgebiet an zuständige EU-Behörden (EEA, ECHA) gemäß gesetzlicher Berichtspflichten.

Energieverbrauch und PUE-Werte der Rechenzentren

Monatliche und jährliche Energieverbrauchsdaten und Power Usage Effectiveness (PUE)-Werte der nationalen Hochleistungsrechenzentren (LRZ Garching, JSC Jülich, HLRS Stuttgart, GWDG Göttingen, ZIH Dresden). Enthält IT-Lastverbrauch, Kühlenergie, USV-Verluste und Gesamtverbrauch in MWh sowie CO2-Äquivalente nach Strommix. Dient dem Nachhaltigkeitsmonitoring und der Einhaltung der Energieeffizienzrichtlinie EU 2023/1791.

Sofort publizierbar — Rechenzentren mit >500 kW IT-Last sind nach EU-Energieeffizienzrichtlinie zur Berichterstattung im European Green Deal Data Space verpflichtet. Nationale Rechenzentren publizieren PUE-Werte in Jahresberichten und Nachhaltigkeitsberichten.

UmweltMessungen / SensordatenEinzelereignis / RohdatenCC0 / Public DomainCSVJSON

Verwendung in 5 Prozessen
  • PUE-Berechnung Kontinuierliche Messung und Berechnung des Power Usage Effectiveness-Werts als Quotient aus Gesamtenergieverbrauch des Rechenzentrums und IT-Ausrüstungsenergieverbrauch nach Green Grid-Standard.
  • CO2-Bilanzierung Berechnung von Scope-1- und Scope-2-Emissionen nach GHG Protocol unter Anwendung des stündlichen Strommix (Residualmix vs. Marktmix) für standortspezifische CO2-Äquivalente.
  • Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu Energieverbrauch und PUE-Werte der Rechenzentren gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
  • Anomalieerkennung und Qualitätskontrolle Automatisierte Erkennung von Ausreißern, Fehlmessungen und Datenanomalien in den Daten zu Energieverbrauch und PUE-Werte der Rechenzentren.
  • Langzeitarchivierung nach OAIS Dauerhafter Erhalt der Messdaten aus Energieverbrauch und PUE-Werte der Rechenzentren nach dem OAIS-Referenzmodell in einem zertifizierten digitalen Langzeitarchiv.

Warteschlangenstatistiken HPC-Job-Scheduler

Aggregierte Statistiken aus den Job-Scheduler-Systemen (SLURM, PBS, LSF) der nationalen Hochleistungsrechner zu Warteschlangenzeiten, Durchsatz und Systemauslastung. Enthält mittlere Wartezeiten nach Partition und Jobgröße, Backfill-Effizienz, Abbruchquoten und Laufzeitverteilungen über monatliche Berichtsperioden. Dienen der Systemoptimierung und der Kommunikation von Dienstgüte an Nutzergemeinschaften.

Nach Aufbereitung publizierbar — Aggregierte Scheduler-Statistiken ohne Rückschluss auf einzelne Nutzerprojekte werden in Systemberichten und Benutzerhandbüchern publiziert. Detaillierte Job-Logs enthalten Projektinformationen und unterliegen Vertraulichkeit.

Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSVJSON

Verwendung in 5 Prozessen
  • Warteschlangen-Simulation Diskrete Ereignissimulation des Job-Schedulers mit historischen Lastprofilen zur Evaluation neuer Scheduling-Algorithmen und Partitionierungsstrategien vor Produktivbetrieb.
  • Anomalieerkennung Zeitreihenbasierte Anomalieerkennung auf Job-Durchsatz und Fehlraten zur Früherkennung von Hardwareausfällen und Scheduler-Fehlfunktionen im laufenden Betrieb.
  • Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu Warteschlangenstatistiken HPC-Job-Scheduler auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
  • Metadaten-Anreicherung und Katalogisierung Systematische Ergänzung beschreibender Metadaten zu Warteschlangenstatistiken HPC-Job-Scheduler für verbesserte Auffindbarkeit und Nachnutzbarkeit in Datenportalen.
  • Metadaten-Standardisierung DDI Dokumentation der Erhebungsmetadaten aus Warteschlangenstatistiken HPC-Job-Scheduler im DDI-Codebook-Standard für Wiederverwendbarkeit in Forschungsinfrastrukturen.

HPC-Job-Ausführungsstatistiken

Aggregierte Statistiken zu Rechenaufträgen (Jobs) auf HPC-Systemen, einschließlich Jobanzahl, Laufzeiten, CPU/GPU-Stunden, Warteschlangenzeiten und Erfolgsquoten. Aufgeschlüsselt nach Fachgebiet, Institutionstyp und Systemgröße. Ermöglichen Kapazitätsplanung und Benchmarking zwischen Rechenzentren.

Sofort publizierbar — Aggregierte Job-Statistiken ohne Nutzeridentifikation sind nicht schützenswert und dienen der Transparenz über öffentlich finanzierte Recheninfrastruktur.

Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSVJSON

Verwendung in 5 Prozessen
  • Job-Accounting Automatisierte Erfassung aller Job-Metriken durch das Batch-System mit standardisierten Accounting-Schnittstellen wie SLURM.
  • Fachgebietszuordnung Klassifikation aller Jobs nach Fachgebiet der nutzenden Gruppe für disziplinspezifische Nutzungsanalysen.
  • Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu HPC-Job-Ausführungsstatistiken auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
  • Metadaten-Anreicherung und Katalogisierung Systematische Ergänzung beschreibender Metadaten zu HPC-Job-Ausführungsstatistiken für verbesserte Auffindbarkeit und Nachnutzbarkeit in Datenportalen.
  • Metadaten-Standardisierung DDI Dokumentation der Erhebungsmetadaten aus HPC-Job-Ausführungsstatistiken im DDI-Codebook-Standard für Wiederverwendbarkeit in Forschungsinfrastrukturen.

Systemeffizienz- und Verfügbarkeitskennzahlen

Technische Betriebskennzahlen von HPC-Systemen, einschließlich System-Verfügbarkeit (Uptime), Mean-Time-Between-Failures, Energieeffizienz (PUE), Peak-Performance-Ausnutzung und Netzwerkdurchsatz. Ermöglichen Benchmark-Vergleiche nach TOP500-Standard und Nachhaltigkeitsberichte. Werden für Förderanträge und Evaluationen benötigt.

Sofort publizierbar — Verfügbarkeit, Ausfallabstände, Energieeffizienz und Durchsatz sind technische Betriebskennzahlen. Sie machen Systeme vergleichbar und Nachhaltigkeitsberichte prüfbar; sicherheitsrelevante Konfigurationsdetails gehören ausdrücklich nicht dazu.

Wissenschaft/TechnikMessungen / SensordatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSVJSON

Verwendung in 5 Prozessen
  • Monitoring-System Kontinuierliche Erfassung aller Systemmetriken durch integrierte Monitoring-Infrastruktur mit Alerting-Funktionen.
  • Energiemessung Granulare Erfassung des Energieverbrauchs aller Systemkomponenten für PUE-Berechnung und Klimabilanzierung.
  • Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu Systemeffizienz- und Verfügbarkeitskennzahlen auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
  • Interoperabilitäts- und Schnittstellentesting Technische Überprüfung von Datenschnittstellen und Kompatibilität mit bestehenden IT-Systemen für Systemeffizienz- und Verfügbarkeitskennzahlen.
  • Automatisierte Datenqualitätsprüfung Kontinuierliche Validierung der Datenqualität in Systemeffizienz- und Verfügbarkeitskennzahlen durch regelbasierte Prüfroutinen und Anomalieerkennung im CI/CD-Prozess.

Fachgebietsspezifische Rechenzeit-Allokationsdaten

Daten zur Verteilung bewilligter und genutzter Rechenzeit-Kontingente auf wissenschaftliche Fachgebiete, Förderlinien und Institutionstypen. Enthalten Antrags- und Bewilligungsquoten, Unterauslastungsraten und Ausschöpfungsverläufe. Ermöglichen evidenzbasierte Allokationspolitik und Bedarfsplanung für zukünftige HPC-Systeme.

Sofort publizierbar — Aggregierte Allokationsdaten nach Fachgebiet ohne Institutsidentifikation können als Transparenznachweis zur Nutzung öffentlicher Rechenressourcen veröffentlicht werden.

Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSVJSON

Verwendung in 5 Prozessen
  • Begutachtungsprotokollierung Dokumentation aller Allokationsentscheidungen des HPC-Gutachtergremiums nach standardisierten Bewertungskriterien.
  • Ausschöpfungsmonitoring Echtzeitüberwachung der Kontingentausschöpfung mit automatischer Benachrichtigung bei Unter- oder Überauslastung.
  • Räumliche Analyse und Visualisierung GIS-gestützte Auswertung der Geodaten zu Fachgebietsspezifische Rechenzeit-Allokationsdaten für Planungsentscheidungen und kartografische Darstellungen.
  • Open-Access-Dissemination Veröffentlichung der Ergebnisse aus Fachgebietsspezifische Rechenzeit-Allokationsdaten über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
  • FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus Fachgebietsspezifische Rechenzeit-Allokationsdaten nach FAIR-Prinzipien.

Energie-PUE-Kostenrechnung der Hochleistungsrechenzentren

Nationale HPC-Zentren (JSC, HLRS, LRZ) erfassen detailliert Energieverbrauch, Power Usage Effectiveness (PUE) und Betriebskosten. Diese Daten fließen in Green-IT-Berichte des BMBF und Gauss Centre for Supercomputing ein. Langzeittrends zeigen Effizienzgewinne durch neue Kühlkonzepte.

Sofort publizierbar — Energieverbrauchsdaten von Rechenzentren sind ökologisch relevant und werden in Nachhaltigkeitsberichten veröffentlicht.

UmweltMessungen / SensordatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSV

Verwendung in 5 Prozessen
  • Energiemessung Unterverteiler und Smart-Meter erfassen Energieverbrauch aller HPC-Systeme und Kühlinfrastruktur kontinuierlich.
  • PUE-Berechnung Monatliche PUE-Werte werden aus IT-Last und Gesamtverbrauch berechnet und gegen Benchmarks verglichen.
  • Finanzkontrolle und Prüfung Überprüfung der Finanzdaten zu Energie-PUE-Kostenrechnung der Hochleistungsrechenzentren durch Rechnungsprüfung und interne Revision auf Korrektheit.
  • Interoperabilitäts- und Schnittstellentesting Technische Überprüfung von Datenschnittstellen und Kompatibilität mit bestehenden IT-Systemen für Energie-PUE-Kostenrechnung der Hochleistungsrechenzentren.
  • Automatisierte Datenqualitätsprüfung Kontinuierliche Validierung der Datenqualität in Energie-PUE-Kostenrechnung der Hochleistungsrechenzentren durch regelbasierte Prüfroutinen und Anomalieerkennung im CI/CD-Prozess.

Software-Stack-Nutzungsanalyse auf HPC-Systemen

HPC-Zentren analysieren welche Softwaremodule (MPI-Bibliotheken, Compiler, Anwendungssoftware) auf ihren Systemen am häufigsten geladen werden. Diese Nutzungsstatistiken informieren Software-Support-Prioritäten und Lizenzentscheidungen. Gauss Centre und PRACE berichten aggregierte Daten.

Sofort publizierbar — Software-Modul-Ladestatistiken enthalten keinen Personenbezug; relevant für HPC-Community-Transparenz.

Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSV

Verwendung in 5 Prozessen
  • Modul-Log-Auswertung Lmod/Environment-Module-Systeme protokollieren alle Softwaremodul-Ladeoperationen mit Zeitstempel und Job-ID.
  • Aggregationsanalyse Monatliche Auswertungen der Top-Module nach CPU-Stunden informieren Software-Support-Ressourcenplanung.
  • Wissenschaftliche Nachnutzung Bereitstellung der Daten zu Software-Stack-Nutzungsanalyse auf HPC-Systemen für wissenschaftliche Sekundäranalysen über Forschungsdatenzentren.
  • Interoperabilitäts- und Schnittstellentesting Technische Überprüfung von Datenschnittstellen und Kompatibilität mit bestehenden IT-Systemen für Software-Stack-Nutzungsanalyse auf HPC-Systemen.
  • Automatisierte Datenqualitätsprüfung Kontinuierliche Validierung der Datenqualität in Software-Stack-Nutzungsanalyse auf HPC-Systemen durch regelbasierte Prüfroutinen und Anomalieerkennung im CI/CD-Prozess.

Wartungsfenster und Verfügbarkeitsstatistik der HPC-Systeme

Nationale Rechenzentren erfassen geplante und ungeplante Ausfallzeiten, Wartungsfenster und Systemverfügbarkeit (Uptime). Die Metriken fließen in Service-Level-Agreements mit Nutzern ein. Gauss Centre for Supercomputing berichtet konsolidierte Verfügbarkeitsstatistiken.

Sofort publizierbar — Systemverfügbarkeitsstatistiken sind Servicequalitätsdaten ohne Personenbezug; werden in Betreiberberichten veröffentlicht.

Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSV

Verwendung in 5 Prozessen
  • Monitoring-System Nagios/Prometheus-basierte Monitoring-Systeme erfassen Systemzustände und berechnen Verfügbarkeitsmetriken automatisch.
  • SLA-Reporting Quartalsweise SLA-Berichte an Nutzer dokumentieren tatsächliche vs. vereinbarte Systemverfügbarkeit.
  • Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu Wartungsfenster und Verfügbarkeitsstatistik der HPC-Systeme auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
  • Interoperabilitäts- und Schnittstellentesting Technische Überprüfung von Datenschnittstellen und Kompatibilität mit bestehenden IT-Systemen für Wartungsfenster und Verfügbarkeitsstatistik der HPC-Systeme.
  • Automatisierte Datenqualitätsprüfung Kontinuierliche Validierung der Datenqualität in Wartungsfenster und Verfügbarkeitsstatistik der HPC-Systeme durch regelbasierte Prüfroutinen und Anomalieerkennung im CI/CD-Prozess.

HPC-Job-Statistik

Aggregierte Statistik zu Rechenaufträgen: Laufzeiten, Ressourcenverbrauch und Nutzung nach Fachgebiet.

Nach Aufbereitung publizierbar — Detaillierte Jobdaten können Rückschlüsse auf laufende Forschungsprojekte ermöglichen.

Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)Datenlizenz DeutschlandCSV

Verwendung in 5 Prozessen
  • Log-Aggregation Tägliche Extraktion und Anonymisierung der Scheduler-Logs
  • Ressourcenanalyse Auswertung von CPU/GPU-Auslastung und Energieverbrauch
  • Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu HPC-Job-Statistik auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
  • Metadaten-Anreicherung und Katalogisierung Systematische Ergänzung beschreibender Metadaten zu HPC-Job-Statistik für verbesserte Auffindbarkeit und Nachnutzbarkeit in Datenportalen.
  • Metadaten-Standardisierung DDI Dokumentation der Erhebungsmetadaten aus HPC-Job-Statistik im DDI-Codebook-Standard für Wiederverwendbarkeit in Forschungsinfrastrukturen.

Rechenzentrum-Energieverbrauchsdaten

Energieverbrauchsmessung des HPC-Rechenzentrums: PUE-Wert, Kühlungseffizienz, CO2-Äquivalente.

Sofort publizierbar — Energiedaten sind für Nachhaltigkeitsberichterstattung öffentlich relevant.

UmweltMessungen / SensordatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSVJSON

Verwendung in 5 Prozessen
  • Smart-Metering Kontinuierliche Erfassung durch Gebäudeleittechnik-Integration
  • CO2-Kalkulation Umrechnung in CO2-Äquivalente nach Bundesnetzagentur-Strommix
  • Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu Rechenzentrum-Energieverbrauchsdaten gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
  • Anomalieerkennung und Qualitätskontrolle Automatisierte Erkennung von Ausreißern, Fehlmessungen und Datenanomalien in den Daten zu Rechenzentrum-Energieverbrauchsdaten.
  • Langzeitarchivierung nach OAIS Dauerhafter Erhalt der Messdaten aus Rechenzentrum-Energieverbrauchsdaten nach dem OAIS-Referenzmodell in einem zertifizierten digitalen Langzeitarchiv.

Softwarelizenz-Nutzungsstatistik HPC

Auslastungsstatistik kommerzieller Softwarelizenzen auf HPC-Systemen (z.B. Matlab, Ansys).

Nach Aufbereitung publizierbar — Lizenznutzungsdaten nach Aggregation und Entfernung von Nutzerinformationen publizierbar.

Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)Datenlizenz DeutschlandCSV

Verwendung in 5 Prozessen
  • Lizenzserver-Monitoring Automatische Erfassung über License-Manager (FlexLM/RLM)
  • Kostenoptimierung Auswertung für Lizenzportfolio-Optimierung und Beschaffungsplanung
  • Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu Softwarelizenz-Nutzungsstatistik HPC auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
  • Interoperabilitäts- und Schnittstellentesting Technische Überprüfung von Datenschnittstellen und Kompatibilität mit bestehenden IT-Systemen für Softwarelizenz-Nutzungsstatistik HPC.
  • Automatisierte Datenqualitätsprüfung Kontinuierliche Validierung der Datenqualität in Softwarelizenz-Nutzungsstatistik HPC durch regelbasierte Prüfroutinen und Anomalieerkennung im CI/CD-Prozess.

HPC-Nutzungsstatistik Rechenzeiten

Aggregierte Statistiken zur Nutzung von Hochleistungsrechenzentren (HLRN, HPC@BWHPC): Rechenzeit nach Fach, CPU/GPU-Stunden, Auslastungsgrad.

Sofort publizierbar — Aggregierte HPC-Kapazitätsstatistiken ohne Projektdetails sind für Fördernachweise und Ressourcenplanung öffentlich; GAUSS-Alliance veröffentlicht Jahresberichte.

Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC0 / Public DomainCSVJSON

Verwendung in 5 Prozessen
  • Job-Accounting Automatisiertes Logging aller Rechenjobs mit CPU-Zeit, Speicherbedarf und Nutzergruppe im SLURM-Scheduler.
  • Nutzungsaggregation Quartalsweise Aggregation der Nutzungsdaten nach Fachgebiet, Projekt-Typ und Förderprogramm.
  • Kapazitätsbericht Jährlicher Kapazitäts- und Nutzungsbericht an Zuwendungsgeber (BMBF, DFG) und GAUSS-Alliance.
  • Interoperabilitäts- und Schnittstellentesting Technische Überprüfung von Datenschnittstellen und Kompatibilität mit bestehenden IT-Systemen für HPC-Nutzungsstatistik Rechenzeiten.
  • Automatisierte Datenqualitätsprüfung Kontinuierliche Validierung der Datenqualität in HPC-Nutzungsstatistik Rechenzeiten durch regelbasierte Prüfroutinen und Anomalieerkennung im CI/CD-Prozess.

Forschungsdatenspeicher-Kapazitäten

Daten zu Speicherinfrastruktur für Forschungsdaten: Kapazitäten, Auslastung, Archivvolumina, Wachstumsraten und Kostenmodelle nach Einrichtung.

Nach Aufbereitung publizierbar — Interne Infrastrukturdetails vertraulich; aggregierte Kapazitätsdaten für NFDI-Berichterstattung und Bundesplanung publizierbar.

Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSVJSON

Verwendung in 5 Prozessen
  • Kapazitätsmonitoring Kontinuierliches Monitoring von Speicherauslastung und Wachstumsraten im Infrastruktur-Management-System.
  • Bedarfsplanung Projektion des Speicherbedarfs für die kommenden 3-5 Jahre auf Basis von Wachstumstrends und Projektzuläufen.
  • NFDI-Berichterstattung Aufbereitung von Kapazitätsdaten für NFDI-Jahresbericht und Bundesplanung zur Forschungsinfrastruktur.
  • Open-Access-Dissemination Veröffentlichung der Ergebnisse aus Forschungsdatenspeicher-Kapazitäten über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
  • FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus Forschungsdatenspeicher-Kapazitäten nach FAIR-Prinzipien.

Forschungssoftware-Repositorium Metadaten

Metadaten zu publizierter Forschungssoftware aus deutschen Hochschulen und Forschungseinrichtungen: Sprache, Lizenz, Zitierbarkeit (CITATION.cff), DOI.

Sofort publizierbar — Open-Source-Forschungssoftware-Metadaten sind per Definition öffentlich; Softwarezitation ist aufkommende Open-Science-Praxis.

Wissenschaft/TechnikMetadatenEinzelereignis / RohdatenCC0 / Public DomainJSONXML

Verwendung in 5 Prozessen
  • Software-Harvesting Automatisiertes Harvesting von Forschungssoftware-Metadaten aus GitHub, GitLab und Zenodo.
  • CITATION.cff-Validierung Prüfung und Anreicherung von Softwaremetadaten mit validen CITATION.cff-Dateien für Zitierfähigkeit.
  • DOI-Registrierung Vergabe persistenter DOIs für archivierte Softwareversionen über Zenodo/DataCite für Langzeitverfügbarkeit.
  • Kompetenz- und Outcome-Messung Evaluierung von Bildungsergebnissen und Kompetenzzuwachs anhand der Daten zu Forschungssoftware-Repositorium Metadaten.
  • Länderübergreifendes Bildungsmonitoring Integration der Daten aus Forschungssoftware-Repositorium Metadaten in das nationale Bildungsmonitoring der KMK für bundesweite Vergleichsberichte.

HPC-Rechnerauslastung Job-Statistik

Zeitreihen zur CPU/GPU-Auslastung, Wartezeiten und Jobdurchsatz auf Großrechnern der HLRS, JSC und LRZ; Grundlage für Kapazitätsplanung.

Nach Aufbereitung publizierbar — Rohe Job-Logs enthalten Nutzerkennung; aggregierte Auslastungskurven publizierbar.

Wissenschaft/TechnikMessungen / SensordatenEinzelereignis / RohdatenCC BY 4.0CSVJSON

Verwendung in 5 Prozessen
  • SLURM-Log-Extraktion Job-Accounting-Daten werden aus SLURM-Scheduler exportiert.
  • Anonymisierung Nutzer-UIDs werden durch Pseudonyme ersetzt; Projektkennung bleibt für Abrechnung.
  • Engpassanalyse Bottlenecks in I/O-Subsystemen werden durch Performance-Counter identifiziert.
  • Kapazitätsbericht Quartalliche Auslastungsberichte werden an Geldgeber (BMBF, DFG) übermittelt.
  • Metadaten-Standardisierung DDI Dokumentation der Erhebungsmetadaten aus HPC-Rechnerauslastung Job-Statistik im DDI-Codebook-Standard für Wiederverwendbarkeit in Forschungsinfrastrukturen.

HPC Energieverbrauch PUE-Monitoring

Echtzeit-Energiemonitoring-Daten (PUE, Kühleffizienz, CO₂-Äquivalent) für wissenschaftliche Rechenzentren nach EU-Energieeffizienz-Richtlinie.

Sofort publizierbar — Energiedaten ohne Personenbezug; EU-Berichtspflicht sieht öffentliche Transparenz vor.

UmweltMessungen / SensordatenEinzelereignis / RohdatenCC BY 4.0CSVJSON

Verwendung in 5 Prozessen
  • Smart-Metering Leistungsmessgeräte erfassen 15-Minuten-Verbrauchswerte je Serverrack.
  • PUE-Berechnung Power Usage Effectiveness wird täglich aus Gesamt- und IT-Last berechnet.
  • CO2-Scope2-Reporting Emissionen werden mit regionalem Strommix-Faktor (UNFCCC-Methode) berechnet.
  • EU-Klimadatenbank Jahreswerte werden in die EU-Klimadatenbank für Rechenzentren eingetragen.
  • Langzeitarchivierung nach OAIS Dauerhafter Erhalt der Messdaten aus HPC Energieverbrauch PUE-Monitoring nach dem OAIS-Referenzmodell in einem zertifizierten digitalen Langzeitarchiv.

HPC Software-Lizenz Nutzungsmonitoring

Tracking kommerzieller Softwarelizenzen auf HPC-Systemen (ANSYS, MATLAB, VASP) nach Nutzungszeiten und Fachgebiet zur Lizenzoptimierung.

Nur Metadaten publizierbar — Lizenzverträge und Nutzungsdetails sind vertraulich; nur aggregierte Lizenzauslastung intern.

Wissenschaft/TechnikTransaktionsdatenAggregiert (zeitlich oder räumlich)Proprietär / RestriktivCSV

Verwendung in 5 Prozessen
  • Flexlm-Monitoring Lizenz-Checkout-Events werden mit FlexLM-Daemon in Echtzeit protokolliert.
  • Nutzungsanalyse Lizenzbelegungszeiten je Projekt und Fachgebiet werden täglich aggregiert.
  • Auslastungsoptimierung Untergenutzte Lizenzblöcke werden bei Vertragsverlängerung reduziert.
  • Bedarfsplanung Prognosticmodelle schätzen künftigen Lizenzbedarf aus Wachstumstrends.
  • Langzeitarchivierung nach OAIS Dauerhafter Erhalt der Messdaten aus HPC Software-Lizenz Nutzungsmonitoring nach dem OAIS-Referenzmodell in einem zertifizierten digitalen Langzeitarchiv.

Rechenleistung und Auslastung

Verfügbare Rechenkapazität und Auslastung der HPC-Cluster.

Sofort publizierbar — Gemessen werden verfügbare Rechenknoten und ihre Belegung je Zeitscheibe. Bezugseinheit ist die Maschine; welche Projekte gerade rechnen, ist eine andere Kennzahl.

Wissenschaft/TechnikMessungen / SensordatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSV

Verwendung in 5 Prozessen
  • Datenerhebung Erhebung der Primärdaten zu Rechenleistung und Auslastung im wissenschaftlichen Erhebungs- bzw. Forschungsprozess.
  • Aufbereitung Strukturierung, Kodierung und Qualitätsaufbereitung der Daten zu Rechenleistung und Auslastung.
  • Qualitätssicherung Validierung, Peer-Review und Konsistenzprüfung der Rechenleistung und Auslastung.
  • Archivierung und Bereitstellung Langzeitarchivierung und FAIR-konforme Bereitstellung der Rechenleistung und Auslastung über Repositorien.
  • Analyse und Auswertung Wissenschaftliche Auswertung und Sekundäranalyse auf Basis der Rechenleistung und Auslastung.

Rechenzeitvergabe nach Projekt

Zugeteilte Rechenzeit und Projektzahl nach Wissenschaftsgebiet.

Sofort publizierbar — Gezählt werden zugeteilte Kernstunden und Projekte je Wissenschaftsgebiet. Bei Gebieten mit wenigen Großprojekten ist zusammenzufassen, sonst beschreibt die Zahl ein einzelnes Vorhaben.

Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSV

Verwendung in 5 Prozessen
  • Datenerhebung Erhebung der Primärdaten zu Rechenzeitvergabe nach Projekt im wissenschaftlichen Erhebungs- bzw. Forschungsprozess.
  • Aufbereitung Strukturierung, Kodierung und Qualitätsaufbereitung der Daten zu Rechenzeitvergabe nach Projekt.
  • Qualitätssicherung Validierung, Peer-Review und Konsistenzprüfung der Rechenzeitvergabe nach Projekt.
  • Archivierung und Bereitstellung Langzeitarchivierung und FAIR-konforme Bereitstellung der Rechenzeitvergabe nach Projekt über Repositorien.
  • Analyse und Auswertung Wissenschaftliche Auswertung und Sekundäranalyse auf Basis der Rechenzeitvergabe nach Projekt.

Energieverbrauch der Rechenzentren

Strom- und Kühlbedarf sowie PUE-Kennzahlen der HPC-Zentren.

Sofort publizierbar — Gemessen werden Strom- und Kühlbedarf je Standort und Jahr. Ein Rechenzentrum ist eine technische Anlage; Rückschlüsse auf einzelne Rechenaufträge ergeben sich aus Jahreswerten nicht.

UmweltMessungen / SensordatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSV

Verwendung in 5 Prozessen
  • Datenerhebung Erhebung der Primärdaten zu Energieverbrauch der Rechenzentren im wissenschaftlichen Erhebungs- bzw. Forschungsprozess.
  • Aufbereitung Strukturierung, Kodierung und Qualitätsaufbereitung der Daten zu Energieverbrauch der Rechenzentren.
  • Qualitätssicherung Validierung, Peer-Review und Konsistenzprüfung der Energieverbrauch der Rechenzentren.
  • Archivierung und Bereitstellung Langzeitarchivierung und FAIR-konforme Bereitstellung der Energieverbrauch der Rechenzentren über Repositorien.
  • Analyse und Auswertung Wissenschaftliche Auswertung und Sekundäranalyse auf Basis der Energieverbrauch der Rechenzentren.

Speicherkapazität und Datenvolumen

Vorgehaltene Speicherkapazität und verwaltetes Datenvolumen.

Sofort publizierbar — Gezählt werden vorgehaltene Kapazität und belegtes Volumen je Standort. Bezugseinheit ist das Terabyte; die gespeicherten Datensätze unterliegen jeweils eigenen Zugangsregeln.

Wissenschaft/TechnikMessungen / SensordatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSV

Verwendung in 5 Prozessen
  • Datenerhebung Erhebung der Primärdaten zu Speicherkapazität und Datenvolumen im wissenschaftlichen Erhebungs- bzw. Forschungsprozess.
  • Aufbereitung Strukturierung, Kodierung und Qualitätsaufbereitung der Daten zu Speicherkapazität und Datenvolumen.
  • Qualitätssicherung Validierung, Peer-Review und Konsistenzprüfung der Speicherkapazität und Datenvolumen.
  • Archivierung und Bereitstellung Langzeitarchivierung und FAIR-konforme Bereitstellung der Speicherkapazität und Datenvolumen über Repositorien.
  • Analyse und Auswertung Wissenschaftliche Auswertung und Sekundäranalyse auf Basis der Speicherkapazität und Datenvolumen.

Nutzergemeinschaft der HPC-Zentren

Zahl und Disziplinverteilung der HPC-Nutzenden und Projekte.

Sofort publizierbar — Gezählt werden aktive Projekte und Nutzungsberechtigungen je Disziplin. Eine Berechtigung ist eine Zahl, keine Person mit Merkmalen; Kennungen und Jobprotokolle fließen nicht ein.

Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSV

Verwendung in 5 Prozessen
  • Datenerhebung Erhebung der Primärdaten zu Nutzergemeinschaft der HPC-Zentren im wissenschaftlichen Erhebungs- bzw. Forschungsprozess.
  • Aufbereitung Strukturierung, Kodierung und Qualitätsaufbereitung der Daten zu Nutzergemeinschaft der HPC-Zentren.
  • Qualitätssicherung Validierung, Peer-Review und Konsistenzprüfung der Nutzergemeinschaft der HPC-Zentren.
  • Archivierung und Bereitstellung Langzeitarchivierung und FAIR-konforme Bereitstellung der Nutzergemeinschaft der HPC-Zentren über Repositorien.
  • Analyse und Auswertung Wissenschaftliche Auswertung und Sekundäranalyse auf Basis der Nutzergemeinschaft der HPC-Zentren.

Weitere Organisationstypen im Sektor Wissenschaft und Forschung