Organisationstyp · Wissenschaft und Forschung
Digitale Forschungsinfrastruktur (NFDI & HPC)
Welche Daten bei dieser Organisationsform entstehen — und wie offen sie sein könnten. 2 Aktivitäten, 69 Datentypen.
- 88,4 % sofort publizierbar
- 10,1 % nach Aufbereitung
- 1,4 % nur Metadaten
Auf der interaktiven Karte öffnen →
NFDI-Datendienste & Fachkonsortien
NFDI-Konsortien-Metadaten
Verzeichnis aller 26 NFDI-Konsortien mit Fachgebiet, beteiligten Institutionen, Fördervolumen (DFG) und geplanten bzw. implementierten Datendiensten.
Sofort publizierbar — NFDI-Konsortien sind in GEPRIS dokumentiert. Konsortien publizieren eigene Steckbriefe und Jahresberichte offen.
Wissenschaft/TechnikFinanzdatenIndividuell / MikrodatenCC0 / Public DomainJSONCSV
Verwendung in 5 Prozessen
- Forschungsinfrastrukturplanung NFDI ist die wichtigste Infrastrukturinvestition der deutschen Wissenschaft im Bereich Forschungsdaten.
- Systemkoordination Übergreifende Koordination durch NFDI-Direktorat erfordert transparente Metadaten zu allen Konsortien.
- Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu NFDI-Konsortien-Metadaten gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
- Maschinenlesbare API-Bereitstellung Bereitstellung der Daten aus NFDI-Konsortien-Metadaten über strukturierte APIs für automatisierte Drittnutzung und Integration.
- API-first-Bereitstellung Maschinenlesbare REST-API mit OpenAPI-Spezifikation für den programmatischen Zugriff auf die Datensätze aus NFDI-Konsortien-Metadaten.
NFDI-Nutzungsstatistiken
Zugriffszahlen auf NFDI-Datendienste nach Konsortium, Fachgebiet und Nutzerinstitution — Indikator für Akzeptanz und gesellschaftlichen Nutzen der Infrastrukturinvestition.
Sofort publizierbar — Aggregierte Nutzungsstatistiken sind nicht schutzbedürftig und werden in NFDI-Jahresberichten publiziert.
Wissenschaft/TechnikPersonenbezogene DatenIndividuell / MikrodatenCC0 / Public DomainCSVExcel (XLSX)
Verwendung in 5 Prozessen
- Evaluation Nutzungsstatistiken sind Kerndaten für die Erfolgsevaluation der DFG-Förderung im NFDI-Programm.
- Community Building Nutzerzahlen informieren Strategieentscheidungen für Outreach- und Community-Aktivitäten der Konsortien.
- Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu NFDI-Nutzungsstatistiken auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
- Metadaten-Anreicherung und Katalogisierung Systematische Ergänzung beschreibender Metadaten zu NFDI-Nutzungsstatistiken für verbesserte Auffindbarkeit und Nachnutzbarkeit in Datenportalen.
- Metadaten-Standardisierung DDI Dokumentation der Erhebungsmetadaten aus NFDI-Nutzungsstatistiken im DDI-Codebook-Standard für Wiederverwendbarkeit in Forschungsinfrastrukturen.
Ontologien und Terminologiedienste
Fachspezifische Ontologien, Thesauri und kontrollierte Vokabulare, die im Rahmen von NFDI-Projekten entwickelt werden — z.B. EMMO (Materialwissenschaften), NFDI4Chem-Ontologie.
Sofort publizierbar — Wissenschaftliche Ontologien werden als Open Data entwickelt und auf OBO Foundry, EBI OLS oder BioPortal registriert.
Wissenschaft/TechnikMetadatenIndividuell / MikrodatenCC0 / Public DomainXMLJSON
Verwendung in 5 Prozessen
- Interoperabilität Gemeinsame Ontologien ermöglichen semantische Interoperabilität zwischen Forschungsdaten verschiedener Disziplinen und Institutionen.
- FAIR-Prinzipien Standardisierte Terminologien sind Grundvoraussetzung für das I (Interoperable) in FAIR-Forschungsdaten.
- Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu Ontologien und Terminologiedienste gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
- Open-Access-Dissemination Veröffentlichung der Ergebnisse aus Ontologien und Terminologiedienste über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
- FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus Ontologien und Terminologiedienste nach FAIR-Prinzipien.
PID-Vergabestatistik Deutschland
Anzahl vergebener persistenter Identifier für Forschungsdaten (DOI über DataCite), Personen (ORCID) und Institutionen (ROR) in Deutschland — jährliche Wachstumsraten und Sektorverteilung.
Sofort publizierbar — DataCite, ORCID und ROR stellen vollständige Metadaten ihrer Registrierungen als Open Data bereit.
Wissenschaft/TechnikPersonenbezogene DatenIndividuell / MikrodatenCC0 / Public DomainCSVJSON
Verwendung in 5 Prozessen
- FAIR-Infrastruktur PID-Durchdringung ist ein Schlüsselindikator für den Fortschritt der FAIR-Datentransformation.
- Strategieplanung Wachstumsraten nach Institution und Fach informieren Prioritäten für PID-Mandatierungen in Förderrichtlinien.
- Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu PID-Vergabestatistik Deutschland auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
- Open-Access-Dissemination Veröffentlichung der Ergebnisse aus PID-Vergabestatistik Deutschland über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
- FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus PID-Vergabestatistik Deutschland nach FAIR-Prinzipien.
BASE-Suchindex-Statistiken
Metadaten über die im Bielefelder Akademischen Suchmaschine (BASE) indizierten Quellen: Repositorien, Dokumenttypen, Fachgebietsverteilung und Wachstum des Open-Access-Anteils.
Sofort publizierbar — BASE (Universität Bielefeld) stellt Metadaten aller indizierten Dokumente via OAI-PMH und API vollständig offen bereit.
Wissenschaft/TechnikMetadatenIndividuell / MikrodatenCC0 / Public DomainJSONCSV
Verwendung in 5 Prozessen
- OA-Monitoring BASE-Statistiken sind wichtiger Indikator für den Wachstum des offenen Wissenschaftssystems.
- Repositorium-Governance Abdeckungsstatistiken informieren Repositorien über ihre Sichtbarkeit in Suchdiensten.
- Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu BASE-Suchindex-Statistiken auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
- Metadaten-Anreicherung und Katalogisierung Systematische Ergänzung beschreibender Metadaten zu BASE-Suchindex-Statistiken für verbesserte Auffindbarkeit und Nachnutzbarkeit in Datenportalen.
- Metadaten-Standardisierung DDI Dokumentation der Erhebungsmetadaten aus BASE-Suchindex-Statistiken im DDI-Codebook-Standard für Wiederverwendbarkeit in Forschungsinfrastrukturen.
NFDI Konsortien Übersicht
Aktive NFDI-Konsortien nach Disziplin, Fördervolumen und angebotenen Diensten.
Sofort publizierbar — Konsortien, Fördervolumen und Dienste betreffen Einrichtungen und den Einsatz öffentlicher Mittel. Die Übersicht dient der Orientierung von Forschenden; die Public-Domain-Lizenz erlaubt die uneingeschränkte Weiterverwendung.
Wissenschaft/TechnikMetadatenEinzelereignis / RohdatenCC0 / Public DomainCSV
Verwendung in 5 Prozessen
- Aggregierung Zusammenführung aus NFDI-Direktory und DFG-Förderberichten
- Veröffentlichung und Berichterstattung Aufbereitung der aggregierten Daten zu NFDI Konsortien Übersicht für periodische Berichte und öffentliche Datenkataloge.
- Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu NFDI Konsortien Übersicht gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
- Metadaten-Anreicherung und Katalogisierung Systematische Ergänzung beschreibender Metadaten zu NFDI Konsortien Übersicht für verbesserte Auffindbarkeit und Nachnutzbarkeit in Datenportalen.
- Zuwendungsdatenbank-Eintrag Erfassung aller Fördermaßnahmen aus NFDI Konsortien Übersicht in der Zuwendungsdatenbank des Bundes (subventionsbericht.de) nach Transparenzrichtlinien.
Forschungsdaten Lizenzübersicht
Verfügbare Lizenzen für Forschungsdaten in NFDI-Repositorien nach Datenkategorie.
Sofort publizierbar — Lizenzangaben je Datenkategorie sind Metadaten über Nutzungsrechte — sie müssen sichtbar sein, damit Forschungsdaten überhaupt nachnutzbar sind. Die Public-Domain-Lizenz erlaubt die uneingeschränkte Weiterverwendung.
Wissenschaft/TechnikMetadatenEinzelereignis / RohdatenCC0 / Public DomainCSV
Verwendung in 5 Prozessen
- Harvesting Automatisierter Abruf aus re3data und DataCite
- Qualitätssicherung und Veröffentlichung Prüfung der Daten zu Forschungsdaten Lizenzübersicht auf Qualität, Vollständigkeit und Aktualität sowie Aufbereitung für periodische Berichte.
- Wissenschaftliche Nachnutzung Bereitstellung der Daten zu Forschungsdaten Lizenzübersicht für wissenschaftliche Sekundäranalysen über Forschungsdatenzentren.
- Open-Access-Dissemination Veröffentlichung der Ergebnisse aus Forschungsdaten Lizenzübersicht über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
- FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus Forschungsdaten Lizenzübersicht nach FAIR-Prinzipien.
Persistent Identifier Nutzung
Vergabe und Nutzung von DOIs, ORCIDs und RORs in der deutschen Forschungslandschaft.
Sofort publizierbar — Vergabe und Nutzung von DOIs, ORCIDs und RORs sind Kennzahlen über die Infrastruktur; persistente Kennungen sind ihrem Zweck nach auflösbar. Die Public-Domain-Lizenz erlaubt die uneingeschränkte Weiterverwendung.
Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC0 / Public DomainCSV
Verwendung in 5 Prozessen
- API-Anbindung Abfrage der DataCite und ORCID APIs
- Qualitätssicherung und Monitoring Kontinuierliches Monitoring der API-Anbindung für Persistent Identifier Nutzung auf Verfügbarkeit, Datenqualität und Latenz.
- Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu Persistent Identifier Nutzung gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
- Open-Access-Dissemination Veröffentlichung der Ergebnisse aus Persistent Identifier Nutzung über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
- FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus Persistent Identifier Nutzung nach FAIR-Prinzipien.
NFDI-Nutzerbefragung und Community-Feedback
Ergebnisse regelmäßiger Nutzerbefragungen in NFDI-Konsortien: Zufriedenheit mit Datendiensten, Bedarfe nach neuen Funktionen, Nutzungshäufigkeit, Community-Größe nach Fachbereich. Grundlage für nutzerzentrierte Weiterentwicklung.
Sofort publizierbar — Aggregierte Befragungsergebnisse ohne personenbezogene Einzelantworten können publiziert werden.
Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSVJSON
Verwendung in 5 Prozessen
- Community-Monitoring Regelmäßige Bedarfserhebung bei der wissenschaftlichen Community der NFDI-Konsortien.
- Produktentwicklung Priorisierung neuer Datendienste auf Basis von Nutzerfeedback und Nutzungsstatistiken.
- Digitale Weiterverarbeitung Bereitstellung der Daten zu NFDI-Nutzerbefragung und Community-Feedback als maschinenlesbare Schnittstelle für digitale Anwendungen.
- Interoperabilitäts- und Schnittstellentesting Technische Überprüfung von Datenschnittstellen und Kompatibilität mit bestehenden IT-Systemen für NFDI-Nutzerbefragung und Community-Feedback.
- Automatisierte Datenqualitätsprüfung Kontinuierliche Validierung der Datenqualität in NFDI-Nutzerbefragung und Community-Feedback durch regelbasierte Prüfroutinen und Anomalieerkennung im CI/CD-Prozess.
Datensatz-Einlieferungen nach NFDI-Konsortium
Jährliche Statistiken zu Forschungsdatensatz-Einlieferungen in die Dienste der 26 NFDI-Konsortien (NFDI4Chem, NFDI4Health, NFDI4Culture, KonsortSWD u.a.), erhoben durch die NFDI-Geschäftsstelle und die Base4NFDI-Initiative. Enthält Datensatzvolumen (Anzahl und Speichergröße), Metadatenqualitätskennzahlen und Kuratierungsaufwände nach Fachgebiet. Basis für Ressourcenplanung der DFG-NFDI-Förderung.
Sofort publizierbar — NFDI-Nutzungsberichte werden der DFG im Rahmen der Fördermonitoring-Pflichten übermittelt und in aggregierter Form publiziert. Einlieferungsstatistiken auf Konsortiumsebene sind nicht personenbeziehbar.
Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC0 / Public DomainCSVJSON
Verwendung in 5 Prozessen
- Metadatenqualitätsbewertung Automatisierte Bewertung von Metadatenvollständigkeit und -qualität anhand von FAIR-Indikatoren (F-UJI-Score) für alle eingelieferten Datensätze je Konsortium.
- Deduplizierung cross-Konsortium Identifikation von Datensätzen, die in mehrere NFDI-Konsortien eingeliefert wurden, über persistente Identifier (DOI, Handle) zur Vermeidung von Mehrfachzählungen.
- Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu Datensatz-Einlieferungen nach NFDI-Konsortium gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
- Open-Access-Dissemination Veröffentlichung der Ergebnisse aus Datensatz-Einlieferungen nach NFDI-Konsortium über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
- FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus Datensatz-Einlieferungen nach NFDI-Konsortium nach FAIR-Prinzipien.
Suchindex-Abfragen Research Data Commons
Aggregierte Abfragestatistiken des gemeinsamen Suchindex der NFDI Research Data Commons, der Forschungsdaten aus allen NFDI-Konsortien übergreifend durchsuchbar macht. Enthält Suchanfragen-Volumen nach Fachgebiet, Trefferquoten, Null-Ergebnis-Raten und Filternutzungsverhalten. Ermöglicht nutzerzentrierte Optimierung des konsortienübergreifenden Datendiscovery-Systems.
Sofort publizierbar — Aggregierte Nutzungsstatistiken ohne personenbeziehbare Einzelabfragen werden im Rahmen der NFDI-Transparenzpflichten gegenüber der Förderinstitution DFG veröffentlicht.
Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC0 / Public DomainJSONCSV
Verwendung in 5 Prozessen
- Query-Log-Analyse Datenschutzkonforme Anonymisierung und Analyse von Suchanfrage-Logs zur Identifikation häufiger Suchthemen, fehlgeschlagener Suchanfragen und Optimierungspotenzial in der Indexstruktur.
- Relevanzfeedback-Auswertung Auswertung von Klick-Through-Raten und Verweildauer auf Ergebnisseiten als implizites Relevanzfeedback für Verbesserung des Ranking-Algorithmus.
- Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu Suchindex-Abfragen Research Data Commons auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
- Open-Access-Dissemination Veröffentlichung der Ergebnisse aus Suchindex-Abfragen Research Data Commons über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
- FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus Suchindex-Abfragen Research Data Commons nach FAIR-Prinzipien.
Cross-Konsortium-Nutzungsstatistiken NFDI
Statistiken zur konsortienübergreifenden Nachnutzung von Forschungsdaten, d.h. Datensätze eines NFDI-Konsortiums, die von Nutzern anderer Konsortien oder Disziplinen abgerufen werden. Erhoben durch Base4NFDI-Dienste (pid4nfdi, search4nfdi) und individuelle Konsortiumsberichte. Quantifiziert den interdisziplinären Mehrwert der NFDI-Architektur und identifiziert besonders nachgefragte Datensätze.
Sofort publizierbar — Aggregierte Cross-Konsortium-Statistiken sind nicht personenbeziehbar und werden als Teil der NFDI-Wirkungsberichterstattung gegenüber DFG und Wissenschaftsrat publiziert.
Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC0 / Public DomainCSVJSON
Verwendung in 5 Prozessen
- Disziplinen-Mapping Zuordnung von Datensatz-Konsortiumszugehörigkeit und Nutzer-Institutionszugehörigkeit zu Wissenschaftsdisziplinen (Frascati Manual) für Cross-Disziplin-Nutzungsanalysen.
- Zitationsabgleich Verknüpfung von Datensatz-DOIs mit Zitationen in wissenschaftlichen Publikationen über DataCite Event Data zur Messung der Forschungswirkung der NFDI-Datendienste.
- Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu Cross-Konsortium-Nutzungsstatistiken NFDI auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
- Open-Access-Dissemination Veröffentlichung der Ergebnisse aus Cross-Konsortium-Nutzungsstatistiken NFDI über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
- FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus Cross-Konsortium-Nutzungsstatistiken NFDI nach FAIR-Prinzipien.
NFDI-Konsortium-Leistungskennzahlen
Standardisierte Leistungskennzahlen aller NFDI-Konsortien zu Datenvolumen, Nutzerzahlen, Diensteumfang und Vernetzungsgrad. Ermöglichen vergleichende Analyse der Konsortiumsentwicklung und Identifikation von Synergien. Werden jährlich im NFDI-Jahresbericht publiziert und für Förderentscheidungen genutzt.
Sofort publizierbar — NFDI-Leistungskennzahlen sind öffentliche Rechenschaftsdaten der öffentlich finanzierten Infrastruktur.
Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSVJSON
Verwendung in 5 Prozessen
- Kennzahlenerhebung Standardisierte Selbstauskunft aller Konsortien nach einheitlichem Fragebogen mit Definitionen und Messinstruktionen.
- Plausibilitätsprüfung Externe Validierung gemeldeter Kennzahlen durch NFDI-Direktorat und unabhängige Evaluatoren.
- Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu NFDI-Konsortium-Leistungskennzahlen auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
- Interoperabilitäts- und Schnittstellentesting Technische Überprüfung von Datenschnittstellen und Kompatibilität mit bestehenden IT-Systemen für NFDI-Konsortium-Leistungskennzahlen.
- Automatisierte Datenqualitätsprüfung Kontinuierliche Validierung der Datenqualität in NFDI-Konsortium-Leistungskennzahlen durch regelbasierte Prüfroutinen und Anomalieerkennung im CI/CD-Prozess.
NFDI-Dienste-Katalog
Maschinenlesbarer Katalog aller von NFDI-Konsortien angebotenen Datendienste mit Beschreibungen, Zugangsbedingungen, Zielgruppen und technischen Spezifikationen. Ermöglicht disziplinübergreifende Auffindbarkeit und Nachnutzung von Infrastrukturkomponenten. Wird durch automatisches Harvesting und manuelle Pflege aktuell gehalten.
Sofort publizierbar — Ein öffentlicher Dienste-Katalog ist essentiell für die Auffindbarkeit und Interoperabilität der NFDI-Infrastruktur.
Wissenschaft/TechnikMetadatenEinzelereignis / RohdatenCC0 / Public DomainJSONXML
Verwendung in 5 Prozessen
- Service-Registry-Integration Automatisiertes Einlesen von Dienst-Beschreibungen aus konsortiumseigenen Service-Registries über standardisierte APIs.
- Vokabular-Alignment Harmonisierung der Dienst-Beschreibungen auf gemeinsame Terminologien und Klassifikationen für konsortiumsübergreifende Suche.
- Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu NFDI-Dienste-Katalog gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
- Datenschutzkonformes HR-Reporting Anonymisiertes Berichtswesen zu Personaldaten aus NFDI-Dienste-Katalog unter Einhaltung datenschutzrechtlicher Anforderungen.
- Anonymisierte Mikrodata-Bereitstellung Bereitstellung anonymisierter Mikrodaten zu NFDI-Dienste-Katalog für Forschungszwecke über Scientific-Use-Files an akkreditierte Einrichtungen.
Community-Engagement-Statistiken
Quantitative Daten zur Einbindung wissenschaftlicher Communities in die NFDI, einschließlich Mitgliederzahlen in Arbeitsgruppen, Teilnahmezahlen bei Schulungen, aktive Datenproduzenten pro Konsortium und Feedback-Einreichungen. Ermöglichen Messung des Community-Wachstums und der Akzeptanz. Werden für Governanceberichte verwendet.
Sofort publizierbar — Aggregierte Community-Engagement-Statistiken ohne Personenbezug sind öffentliche Informationen zur Reichweite der NFDI.
Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSVJSON
Verwendung in 5 Prozessen
- Teilnahme-Tracking Automatisierte Erfassung von Registrierungen und Teilnahmen bei NFDI-Veranstaltungen und -Gremien über digitale Systeme.
- Wachstumsanalyse Zeitreihenauswertung der Community-Größen zur Identifikation von Wachstumstrends und Engagementmustern.
- Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu Community-Engagement-Statistiken auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
- Anomalieerkennung und Qualitätskontrolle Automatisierte Erkennung von Ausreißern, Fehlmessungen und Datenanomalien in den Daten zu Community-Engagement-Statistiken.
- Langzeitarchivierung nach OAIS Dauerhafter Erhalt der Messdaten aus Community-Engagement-Statistiken nach dem OAIS-Referenzmodell in einem zertifizierten digitalen Langzeitarchiv.
Software-Archivierungsrate: NFDI-Forschungssoftware in Software Heritage
NFDI-Konsortien verpflichten sich zur Langzeitarchivierung von Forschungssoftware in Software Heritage. Die Archivierungsrate (Anteil mit persistenter Referenz) wird je Konsortium und Fachgebiet gemessen. de-RSE und NFDI e.V. berichten diese Kennzahlen in Jahresberichten.
Sofort publizierbar — Software-Archivierungsstatistiken sind technische Metadaten ohne Personenbezug; öffentlich für Open-Science-Transparenz.
Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC0 / Public DomainJSON
Verwendung in 5 Prozessen
- Archivierungsmonitoring Automatisierte Skripte prüfen regelmäßig Software-Repository-Metadaten gegen Software-Heritage-Einträge.
- Konsortium-Reporting NFDI-Konsortien melden Archivierungsquoten jährlich an NFDI e.V. für konsolidierte Berichte.
- Wissenschaftliche Nachnutzung Bereitstellung der Daten zu Software-Archivierungsrate: NFDI-Forschungssoftware in Software Heritage für wissenschaftliche Sekundäranalysen über Forschungsdatenzentren.
- Anomalieerkennung und Qualitätskontrolle Automatisierte Erkennung von Ausreißern, Fehlmessungen und Datenanomalien in den Daten zu Software-Archivierungsrate: NFDI-Forschungssoftware in Software Heritage.
- Langzeitarchivierung nach OAIS Dauerhafter Erhalt der Messdaten aus Software-Archivierungsrate: NFDI-Forschungssoftware in Software Heritage nach dem OAIS-Referenzmodell in einem zertifizierten digitalen Langzeitarchiv.
Terminologie- und Ontologie-Register der NFDI-Konsortien
NFDI-Konsortien entwickeln und pflegen fachspezifische Ontologien und Terminologien (z.B. NFDI4Chem-Ontologie, GHGA-Datenschema). Ein zentrales Register im Terminology Service der NFDI erfasst alle publizierten Vokabulare. Diese Ressourcen sind Grundlage für semantische Interoperabilität.
Sofort publizierbar — Ontologien und Terminologien sind explizit für offene Nachnutzung entwickelt; kein Personenbezug.
Wissenschaft/TechnikTextdokumenteEinzelereignis / RohdatenCC0 / Public DomainXMLJSON
Verwendung in 5 Prozessen
- Ontologie-Registrierung Konsortien registrieren publizierte Ontologien im NFDI Terminology Service mit PURL und Versionsinformation.
- Qualitätsprüfung Automatische OWL-Validierung und manuelle Review durch Ontologie-Experten sichern Qualität der Einträge.
- Registeraktualisierung und Pflege Regelmäßige Aktualisierung des Registers zu Terminologie- und Ontologie-Register der NFDI-Konsortien durch Abgleich mit behördlichen Meldungen und Revisionen.
- Georeferenzierung und Kartierung Räumliche Aufbereitung und GIS-gestützte Visualisierung der Daten zu Terminologie- und Ontologie-Register der NFDI-Konsortien für kartografische Auswertungen und Standortanalysen.
- Open-Data-Publikation auf GovData Bereitstellung der Geodaten zu Terminologie- und Ontologie-Register der NFDI-Konsortien als offener Datensatz auf dem nationalen Datenportal GovData.de nach DCAT-AP.de-Standard.
AAI-Föderierte Identitäten und Authentifizierungsstatistik
Die NFDI-Basisinfrastruktur betreibt ein Authentication and Authorization Infrastructure (AAI) System auf Basis von DFN-AAI und EOSC-Login. Statistiken zu aktiven Nutzeridentitäten, Dienstnutzung und Zugriffsanträgen werden vom NFDI-Infrastrukturkonsortium erfasst.
Nach Aufbereitung publizierbar — AAI-Nutzungsdaten enthalten Nutzeridentitäten; aggregierte Zugriffsstatistiken nach Dienst und Nutzergruppe sind publizierbar.
Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0JSON
Verwendung in 5 Prozessen
- AAI-Log-Analyse Automatische Auswertung von Shibboleth- und OAuth-Logs nach Dienst, Nutzergruppe und Authentifizierungsquelle.
- Nutzungsreporting Quartalsberichte zu AAI-Nutzungsstatistiken werden an NFDI-Steuerungsgremien übermittelt.
- Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu AAI-Föderierte Identitäten und Authentifizierungsstatistik auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
- Metadaten-Anreicherung und Katalogisierung Systematische Ergänzung beschreibender Metadaten zu AAI-Föderierte Identitäten und Authentifizierungsstatistik für verbesserte Auffindbarkeit und Nachnutzbarkeit in Datenportalen.
- Metadaten-Standardisierung DDI Dokumentation der Erhebungsmetadaten aus AAI-Föderierte Identitäten und Authentifizierungsstatistik im DDI-Codebook-Standard für Wiederverwendbarkeit in Forschungsinfrastrukturen.
HPC-Cluster-Auslastungsstatistiken
Nutzungsdaten zu Hochleistungsrechenclustern inkl. Auslastungsgrad, Jobwartezeiten und Nutzerverteilung nach Disziplin.
Sofort publizierbar — Aggregierte HPC-Auslastungsstatistiken sind öffentliche Kennzahlen zur Infrastrukturtransparenz.
Wissenschaft/TechnikMessungen / SensordatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSV
Verwendung in 5 Prozessen
- Monitoring-Aggregation Aggregierung von Echtzeit-Monitoring-Daten zu stündlichen und täglichen Auslastungsprofilen.
- Engpassanalyse Identifikation von Auslastungsspitzen und Wartezeiten zur Kapazitätsplanung und Priorisierung.
- Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu HPC-Cluster-Auslastungsstatistiken auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
- Metadaten-Anreicherung und Katalogisierung Systematische Ergänzung beschreibender Metadaten zu HPC-Cluster-Auslastungsstatistiken für verbesserte Auffindbarkeit und Nachnutzbarkeit in Datenportalen.
- Metadaten-Standardisierung DDI Dokumentation der Erhebungsmetadaten aus HPC-Cluster-Auslastungsstatistiken im DDI-Codebook-Standard für Wiederverwendbarkeit in Forschungsinfrastrukturen.
Supercomputer-Rechenzeit-Vergaben
Daten zu vergebenen Rechenzeit-Kontingenten auf nationalen Supercomputern inkl. Projektbeschreibung und zugeteilter Ressourcen.
Sofort publizierbar — Rechenzeit-Vergaben auf öffentlich geförderten Supercomputern sind transparenzpflichtige Förderdaten.
Wissenschaft/TechnikMetadatenEinzelereignis / RohdatenCC BY 4.0JSON
Verwendung in 5 Prozessen
- Allokationsregistrierung Strukturierte Erfassung von Projekttitel, Antragsteller-Institution, bewilligter Knotenstunden und Nutzungszeitraum.
- Nutzungsmonitoring Abgleich beantragter mit tatsächlich genutzter Rechenzeit zur Ressourceneffizienzanalyse.
- Digitale Weiterverarbeitung Bereitstellung der Daten zu Supercomputer-Rechenzeit-Vergaben als maschinenlesbare Schnittstelle für digitale Anwendungen.
- Interoperabilitäts- und Schnittstellentesting Technische Überprüfung von Datenschnittstellen und Kompatibilität mit bestehenden IT-Systemen für Supercomputer-Rechenzeit-Vergaben.
- Automatisierte Datenqualitätsprüfung Kontinuierliche Validierung der Datenqualität in Supercomputer-Rechenzeit-Vergaben durch regelbasierte Prüfroutinen und Anomalieerkennung im CI/CD-Prozess.
Grid-Computing-Nutzungsdaten
Statistiken zur Nutzung verteilter Grid-Computing-Infrastrukturen (z.B. EGI, WLCG) durch deutsche Forschungseinrichtungen.
Sofort publizierbar — Grid-Nutzungsstatistiken sind aggregierte Infrastrukturkennzahlen ohne sensible Projektinhalte.
Wissenschaft/TechnikMessungen / SensordatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSV
Verwendung in 5 Prozessen
- Federation-Reporting Aggregierung von Nutzungsberichten der deutschen Grid-Knoten für EGI-Accounting-Portal-Einträge.
- Kapazitätsplanung Analyse von Lastverteilungsmustern zur Optimierung der nationalen Grid-Beitragsplanung.
- Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu Grid-Computing-Nutzungsdaten gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
- Open-Access-Dissemination Veröffentlichung der Ergebnisse aus Grid-Computing-Nutzungsdaten über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
- FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus Grid-Computing-Nutzungsdaten nach FAIR-Prinzipien.
Forschungsnetz-Bandbreiten-Statistiken
Auslastungs- und Kapazitätsdaten des deutschen Forschungsnetzes (DFN) inkl. Datendurchsatz und Engpassanalysen.
Sofort publizierbar — Netzauslastungsstatistiken sind öffentliche Infrastrukturkennzahlen ohne sicherheitsrelevante Topologieinformationen.
Wissenschaft/TechnikMessungen / SensordatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSV
Verwendung in 5 Prozessen
- SNMP-Monitoring Kontinuierliche Erfassung von Netzauslastungsdaten über SNMP-Protokoll an DFN-Knotenpunkten.
- Traffic-Analyse Analyse von Datenflussmustern zur Identifikation von Engpässen und Planungsgrundlage für Kapazitätserweiterungen.
- Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu Forschungsnetz-Bandbreiten-Statistiken auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
- Open-Access-Dissemination Veröffentlichung der Ergebnisse aus Forschungsnetz-Bandbreiten-Statistiken über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
- FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus Forschungsnetz-Bandbreiten-Statistiken nach FAIR-Prinzipien.
Cloud-HPC-Adoptionsraten Forschung
Statistiken zur Nutzung kommerzieller Cloud-Dienste für wissenschaftliches Rechnen. Zeigt Migrationstrends von On-Premise zu Cloud.
Sofort publizierbar — Aggregierte Cloud-Adoptionsstatistiken sind methodische Trendanalysen ohne wettbewerbssensible Anbieterinformationen.
Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSV
Verwendung in 5 Prozessen
- Umfragedatenerhebung Regelmäßige Befragungen von Rechenzentren und Forschungsgruppen zu Cloud-Nutzungsanteilen und -Diensten.
- Trendmodellierung Extrapolation von Adoptionskurven zur Prognose des zukünftigen Cloud-HPC-Bedarfs in der deutschen Forschung.
- Wissenschaftliche Nachnutzung Bereitstellung der Daten zu Cloud-HPC-Adoptionsraten Forschung für wissenschaftliche Sekundäranalysen über Forschungsdatenzentren.
- Open-Access-Dissemination Veröffentlichung der Ergebnisse aus Cloud-HPC-Adoptionsraten Forschung über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
- FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus Cloud-HPC-Adoptionsraten Forschung nach FAIR-Prinzipien.
Jupyter-Hub-Nutzungsstatistiken
Nutzungsdaten zu institutionellen JupyterHub-Instanzen inkl. aktive Nutzer, Notebook-Typen und Ressourcenverbrauch.
Sofort publizierbar — Aggregierte Nutzungsstatistiken zu wissenschaftlichen Arbeitsumgebungen sind öffentliche Infrastrukturkennzahlen.
Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSV
Verwendung in 5 Prozessen
- Aktivitäts-Logging Anonymisierte Erfassung von Session-Dauer, Kernel-Typen und Ressourcennutzung je Nutzersitzung.
- Nutzungsmuster-Analyse Auswertung zeitlicher und fachspezifischer Nutzungsmuster zur Kapazitäts- und Serviceplanung.
- Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu Jupyter-Hub-Nutzungsstatistiken auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
- Metadaten-Anreicherung und Katalogisierung Systematische Ergänzung beschreibender Metadaten zu Jupyter-Hub-Nutzungsstatistiken für verbesserte Auffindbarkeit und Nachnutzbarkeit in Datenportalen.
- Metadaten-Standardisierung DDI Dokumentation der Erhebungsmetadaten aus Jupyter-Hub-Nutzungsstatistiken im DDI-Codebook-Standard für Wiederverwendbarkeit in Forschungsinfrastrukturen.
NFDI-Konsortium-Metadaten-Katalog
Gemeinsamer Metadatenkatalog der NFDI-Konsortien mit Informationen zu Datensätzen und Services.
Sofort publizierbar — Der Katalog beschreibt Datensätze und Dienste der Konsortien; Auffindbarkeit ist der Zweck eines Metadatenkatalogs. Personenbezogene Angaben enthält er nicht; die Public-Domain-Lizenz erlaubt die Weiterverwendung.
Wissenschaft/TechnikMetadatenEinzelereignis / RohdatenCC0 / Public DomainJSONXML
Verwendung in 5 Prozessen
- Metadaten-Harvesting Automatisierte Aggregation von Metadaten aus Konsortien-Repositorien
- FAIR-Prüfung Automatische Bewertung von Datensätzen auf FAIR-Prinzipien-Konformität
- Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu NFDI-Konsortium-Metadaten-Katalog gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
- Interoperabilitäts- und Schnittstellentesting Technische Überprüfung von Datenschnittstellen und Kompatibilität mit bestehenden IT-Systemen für NFDI-Konsortium-Metadaten-Katalog.
- Automatisierte Datenqualitätsprüfung Kontinuierliche Validierung der Datenqualität in NFDI-Konsortium-Metadaten-Katalog durch regelbasierte Prüfroutinen und Anomalieerkennung im CI/CD-Prozess.
Terminologie-Service NFDI
Gemeinsamer Terminologie-Service mit kontrollierten Vokabularen und Ontologien für NFDI-Fachcommunities.
Sofort publizierbar — Kontrollierte Vokabulare und Ontologien sind gemeinsame Referenzen der Fachcommunities und nur nützlich, wenn alle sie verwenden können. Die Public-Domain-Lizenz erlaubt die uneingeschränkte Weiterverwendung.
Wissenschaft/TechnikMetadatenEinzelereignis / RohdatenCC0 / Public DomainXMLJSON
Verwendung in 5 Prozessen
- Ontologie-Kuratierung Regelmäßige Aktualisierung und Harmonisierung der Fachvokabulare
- API-Bereitstellung REST-API für Terminologieabfragen durch Forschungsanwendungen
- Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu Terminologie-Service NFDI gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
- Interoperabilitäts- und Schnittstellentesting Technische Überprüfung von Datenschnittstellen und Kompatibilität mit bestehenden IT-Systemen für Terminologie-Service NFDI.
- Automatisierte Datenqualitätsprüfung Kontinuierliche Validierung der Datenqualität in Terminologie-Service NFDI durch regelbasierte Prüfroutinen und Anomalieerkennung im CI/CD-Prozess.
NFDI-Service-Nutzungsstatistik
Aggregierte Statistik zur Nutzung von NFDI-Datendiensten: Anfragen, Datentransfer, Nutzerherkunft.
Sofort publizierbar — Anfragen, Datentransfer und Nutzerherkunft sind über alle Zugriffe summiert; einzelne Nutzende sind darin nicht unterscheidbar. Die Public-Domain-Lizenz erlaubt die uneingeschränkte Weiterverwendung.
Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC0 / Public DomainCSVJSON
Verwendung in 5 Prozessen
- Log-Aggregation Tägliche Aggregation von Service-Logs ohne IP-Adressen
- Reporting Monatliches Nutzungsreporting an DFG und Konsortialpartner
- Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu NFDI-Service-Nutzungsstatistik auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
- Metadaten-Anreicherung und Katalogisierung Systematische Ergänzung beschreibender Metadaten zu NFDI-Service-Nutzungsstatistik für verbesserte Auffindbarkeit und Nachnutzbarkeit in Datenportalen.
- Metadaten-Standardisierung DDI Dokumentation der Erhebungsmetadaten aus NFDI-Service-Nutzungsstatistik im DDI-Codebook-Standard für Wiederverwendbarkeit in Forschungsinfrastrukturen.
NFDI-Konsortienregister und Dienstekatalog
Metadatenkatalog der NFDI-Konsortien mit Fachbereich, bereitgestellten Datendiensten, Repositorien, Vokabularen und Zugangsbedingungen.
Sofort publizierbar — NFDI-Infrastrukturen sind öffentlich finanziert; Dienstekataloge sind explizit für die wissenschaftliche Community gedacht und offen zugänglich.
Wissenschaft/TechnikMetadatenEinzelereignis / RohdatenCC0 / Public DomainJSONXML
Verwendung in 5 Prozessen
- Konsortienaufnahme Erfassung aller DFG-geförderten NFDI-Konsortien mit Dienst- und Technologieprofil nach standardisiertem Schema.
- Dienst-API-Dokumentation Pflege maschinenlesbarer API-Beschreibungen (OpenAPI) für alle Datenzugangsdienste der Konsortien.
- Nutzerdokumentation Bereitstellung nutzerfreundlicher Einstiegsdokumentation und Tutorial-Materialien für Forschende.
- Georeferenzierung und Kartierung Räumliche Aufbereitung und GIS-gestützte Visualisierung der Daten zu NFDI-Konsortienregister und Dienstekatalog für kartografische Auswertungen und Standortanalysen.
- Open-Data-Publikation auf GovData Bereitstellung der Geodaten zu NFDI-Konsortienregister und Dienstekatalog als offener Datensatz auf dem nationalen Datenportal GovData.de nach DCAT-AP.de-Standard.
Forschungsdaten-Repositorien-Verzeichnis
Verzeichnis zertifizierter Forschungsdaten-Repositorien in Deutschland (re3data.org): Fach, Zertifizierung (CoreTrustSeal), Zugangsbedingungen, Volumen.
Sofort publizierbar — re3data.org ist ein öffentlich finanzierter, offener Metadatendienst; alle Repositoriums-Metadaten sind frei zugänglich.
Wissenschaft/TechnikMetadatenEinzelereignis / RohdatenCC0 / Public DomainXMLJSON
Verwendung in 5 Prozessen
- Repositoriumsaufnahme Erfassung neuer Repositorien über Self-Submission-Prozess auf re3data.org mit redaktioneller Prüfung.
- Metadatenqualitätsprüfung Regelmäßige Überprüfung und Aktualisierung von Repositoriums-Metadaten durch re3data-Redaktion.
- API-Bereitstellung Maschinenlesbare Bereitstellung über re3data-API für Integration in Datenmanagementpläne und NFDI-Dienste.
- Open-Access-Dissemination Veröffentlichung der Ergebnisse aus Forschungsdaten-Repositorien-Verzeichnis über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
- FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus Forschungsdaten-Repositorien-Verzeichnis nach FAIR-Prinzipien.
Datenmanagementplan-Metadaten
Metadaten aus maschinell lesbaren Datenmanagementplänen (DMP) geförderter Projekte: Datentypen, Speicherorte, Zugangsbedingungen, Archivierungsplanung.
Nach Aufbereitung publizierbar — DMP-Inhalte können proprietäre Forschungsstrategien enthalten; aggregierte DMP-Metadaten und anonymisierte Templates publizierbar.
Wissenschaft/TechnikMetadatenEinzelereignis / RohdatenCC BY 4.0JSONXML
Verwendung in 5 Prozessen
- DMP-Extraktion Automatisiertes Parsing maschinenlesbarer DMPs (RDA-DMP Common Standard) aus Fördersystemen.
- Mustererkennung NLP-Analyse von DMP-Texten zur Identifikation typischer Datenmanagementpraktiken nach Fach.
- Best-Practice-Publikation Ableitung und Veröffentlichung von Muster-DMPs für verschiedene Disziplinen als Orientierungshilfe.
- Metadaten-Anreicherung und Katalogisierung Systematische Ergänzung beschreibender Metadaten zu Datenmanagementplan-Metadaten für verbesserte Auffindbarkeit und Nachnutzbarkeit in Datenportalen.
- Digitales Rechtemanagement Implementierung eines DRM-Systems zur Verwaltung von Urheberrechten, Nutzungslizenzen und Verwertungsansprüchen für Datenmanagementplan-Metadaten.
NFDI Datendienste Nutzungsmetriken
Aggregierte Nutzungsmetriken (Datenabrufe, API-Calls, Registrierungen) für NFDI-Konsortium-Datendienste nach Fachgebiet und Nutzertyp.
Sofort publizierbar — Nutzungsmetriken ohne Personenbezug; NFDI-Transparenzpflicht gegenüber DFG.
Wissenschaft/TechnikTransaktionsdatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSVJSON
Verwendung in 5 Prozessen
- Log-Aggregation Server-Logs werden mit ELK-Stack aggregiert und personenbezogene IPs entfernt.
- COUNTER-Analogie Metriken folgen dem COUNTER-5-Rahmen für Forschungsdaten-Repositories.
- Konsortiumsvergleich Nutzungszahlen werden zwischen NFDI-Konsortien normiert verglichen.
- DFG-Fortschrittsbericht Metriken belegen Nutzungsausbau in jährlichen DFG-Verwendungsnachweisen.
- Open-Data-Publikation auf GovData Bereitstellung der Geodaten zu NFDI Datendienste Nutzungsmetriken als offener Datensatz auf dem nationalen Datenportal GovData.de nach DCAT-AP.de-Standard.
PID-Vergabe Statistik
Statistiken zur Persistenten Identifikatoren-Vergabe (DOI, ORCID-Verknüpfung, ROR) durch NFDI-Konsortien und ihre Mitgliedsinstitutionen.
Sofort publizierbar — PID-Metadaten sind per Designprinzip offen und maschinell abrufbar.
Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC0 / Public DomainJSONCSV
Verwendung in 5 Prozessen
- DataCite-API-Abfrage DOI-Vergabestatistiken werden monatlich über DataCite REST-API abgerufen.
- ORCID-Matching Forschenden-DOIs werden mit ORCID-Profilen via ORCID-API verknüpft.
- ROR-Institutionsabdeckung Institutionelle Affiliationen werden auf ROR-Entitäten normiert.
- Scholix-Integration Datensatz-Publikations-Links werden im Scholix-Framework angemeldet.
- Metadaten-Standardisierung DDI Dokumentation der Erhebungsmetadaten aus PID-Vergabe Statistik im DDI-Codebook-Standard für Wiederverwendbarkeit in Forschungsinfrastrukturen.
FAIR-Reife Assessment Forschungsdaten
Automatisiertes FAIR-Assessment (Findable, Accessible, Interoperable, Reusable) für in NFDI-Diensten gespeicherte Forschungsdaten nach Maturity-Indikatoren.
Sofort publizierbar — FAIR-Bewertungsscores sind Infrastrukturmetadaten; Methodendokumentation offen.
Wissenschaft/TechnikMetadatenEinzelereignis / RohdatenCC BY 4.0JSONCSV
Verwendung in 5 Prozessen
- F-UJI-Assessment Automatisiertes FAIR-Scoring wird mit dem F-UJI-Tool (FAIRsFAIR) durchgeführt.
- Maturity-Modell Ergebnisse werden gegen RDA-FAIR-Maturity-Indikatoren (RDA-F-AI-01 etc.) gemappt.
- Zeitverlaufsanalyse FAIR-Scores werden versioniert, um Verbesserungen durch Kurationsmaßnahmen zu zeigen.
- Community-Feedback Datenprovider erhalten automatisierte Verbesserungsempfehlungen per E-Mail.
- FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus FAIR-Reife Assessment Forschungsdaten nach FAIR-Prinzipien.
NFDI-Konsortien-Übersicht
Übersicht der Fachkonsortien der Nationalen Forschungsdateninfrastruktur.
Sofort publizierbar — Verzeichnet werden Konsortien mit Fachgebiet, Sprecherinstitution und Förderphase. Die Übersicht dient der Auffindbarkeit von Ansprechstellen; Beschäftigte erscheinen mit Funktion, nicht privat.
Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0JSON
Verwendung in 5 Prozessen
- Datenerhebung Erhebung der Primärdaten zu NFDI-Konsortien-Übersicht im wissenschaftlichen Erhebungs- bzw. Forschungsprozess.
- Aufbereitung Strukturierung, Kodierung und Qualitätsaufbereitung der Daten zu NFDI-Konsortien-Übersicht.
- Qualitätssicherung Validierung, Peer-Review und Konsistenzprüfung der NFDI-Konsortien-Übersicht.
- Archivierung und Bereitstellung Langzeitarchivierung und FAIR-konforme Bereitstellung der NFDI-Konsortien-Übersicht über Repositorien.
- Analyse und Auswertung Wissenschaftliche Auswertung und Sekundäranalyse auf Basis der NFDI-Konsortien-Übersicht.
Katalog der Datendienste
Verzeichnis bereitgestellter Werkzeuge und Datendienste.
Sofort publizierbar — Verzeichnet werden Werkzeuge und Dienste mit Zweck, Schnittstelle und Betreiber. Ein Dienstekatalog nützt nur, wenn er auffindbar ist; Nutzungsdaten sind nicht Teil davon.
Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0JSON
Verwendung in 5 Prozessen
- Datenerhebung Erhebung der Primärdaten zu Katalog der Datendienste im wissenschaftlichen Erhebungs- bzw. Forschungsprozess.
- Aufbereitung Strukturierung, Kodierung und Qualitätsaufbereitung der Daten zu Katalog der Datendienste.
- Qualitätssicherung Validierung, Peer-Review und Konsistenzprüfung der Katalog der Datendienste.
- Archivierung und Bereitstellung Langzeitarchivierung und FAIR-konforme Bereitstellung der Katalog der Datendienste über Repositorien.
- Analyse und Auswertung Wissenschaftliche Auswertung und Sekundäranalyse auf Basis der Katalog der Datendienste.
Terminologie- und Ontologiedienste
Bereitgestellte Vokabulare, Ontologien und Normdaten.
Sofort publizierbar — Bereitgestellt werden Vokabulare und Ontologien als Referenzressourcen. Ihr Zweck ist die gemeinsame Nutzung; sie beschreiben Begriffe und Beziehungen, keine Personen und keine Messwerte.
Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0JSON
Verwendung in 5 Prozessen
- Datenerhebung Erhebung der Primärdaten zu Terminologie- und Ontologiedienste im wissenschaftlichen Erhebungs- bzw. Forschungsprozess.
- Aufbereitung Strukturierung, Kodierung und Qualitätsaufbereitung der Daten zu Terminologie- und Ontologiedienste.
- Qualitätssicherung Validierung, Peer-Review und Konsistenzprüfung der Terminologie- und Ontologiedienste.
- Archivierung und Bereitstellung Langzeitarchivierung und FAIR-konforme Bereitstellung der Terminologie- und Ontologiedienste über Repositorien.
- Analyse und Auswertung Wissenschaftliche Auswertung und Sekundäranalyse auf Basis der Terminologie- und Ontologiedienste.
Schulungen und Trainingsangebote
Zahl und Reichweite von Trainings zu Forschungsdatenmanagement.
Sofort publizierbar — Gezählt werden Veranstaltungen und Teilnahmen je Themenfeld und Jahr. Bezugseinheit ist der Termin; Anmeldelisten und Lernstände bleiben bei den durchführenden Einrichtungen.
BildungMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSV
Verwendung in 5 Prozessen
- Datenerhebung Erhebung der Primärdaten zu Schulungen und Trainingsangebote im wissenschaftlichen Erhebungs- bzw. Forschungsprozess.
- Aufbereitung Strukturierung, Kodierung und Qualitätsaufbereitung der Daten zu Schulungen und Trainingsangebote.
- Qualitätssicherung Validierung, Peer-Review und Konsistenzprüfung der Schulungen und Trainingsangebote.
- Archivierung und Bereitstellung Langzeitarchivierung und FAIR-konforme Bereitstellung der Schulungen und Trainingsangebote über Repositorien.
- Analyse und Auswertung Wissenschaftliche Auswertung und Sekundäranalyse auf Basis der Schulungen und Trainingsangebote.
HPC-Infrastruktur & Wissenschaftliches Rechnen
HPC-Nutzungsstatistiken
Auslastung, Rechenzeit-Kontingente und Fachgebietsdistribution auf nationalen Hochleistungsrechnern (HLRS Stuttgart, JSC Jülich, LRZ München) und Gauss-Zentren.
Sofort publizierbar — Gauss Centre for Supercomputing und Mitgliedszentren veröffentlichen Nutzungsstatistiken in Jahresberichten.
Wissenschaft/TechnikPersonenbezogene DatenKleinräumig (Stadtteil / Gemeinde)CC BY 4.0CSVExcel (XLSX)
Verwendung in 5 Prozessen
- Ressourcenallokation Nutzungsstatistiken informieren Kontingentierungsentscheidungen und Ausbauplanungen für HPC-Infrastruktur.
- Evaluation Fachgebietliche Verteilung der Rechenzeiten ist Kerndaten für Bewertung der wissenschaftlichen Breitennutzung nationaler Infrastruktur.
- Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu HPC-Nutzungsstatistiken auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
- Interoperabilitäts- und Schnittstellentesting Technische Überprüfung von Datenschnittstellen und Kompatibilität mit bestehenden IT-Systemen für HPC-Nutzungsstatistiken.
- Automatisierte Datenqualitätsprüfung Kontinuierliche Validierung der Datenqualität in HPC-Nutzungsstatistiken durch regelbasierte Prüfroutinen und Anomalieerkennung im CI/CD-Prozess.
KI-Infrastruktur-Kapazitäten
GPU-Kapazitäten, Modell-Trainingsvolumina und KI-Forschungsprojekte auf nationaler KI-Infrastruktur (BMBF-KI-Rechenzentren, DFKI, Helmholtz-KI) — Indikator für KI-Wettbewerbsfähigkeit.
Sofort publizierbar — Rechenkapazität, Trainingsvolumina und Projektzahlen auf öffentlich finanzierter Infrastruktur sind Ausstattungsdaten. Sie zeigen, ob eine Forschungslandschaft mithalten kann; Modelle, Daten und Nutzerkonten sind nicht Gegenstand.
Wissenschaft/TechnikPersonenbezogene DatenIndividuell / MikrodatenCC BY 4.0CSVExcel (XLSX)
Verwendung in 5 Prozessen
- KI-Strategie GPU-Kapazitäten sind Schlüsselindikator für internationale Wettbewerbsfähigkeit in KI-Forschung und -Entwicklung.
- Infrastrukturplanung Kapazitätsdaten informieren BMBF-Investitionsentscheidungen für weitere KI-Rechenzentren.
- Digitale Weiterverarbeitung Bereitstellung der Daten zu KI-Infrastruktur-Kapazitäten als maschinenlesbare Schnittstelle für digitale Anwendungen.
- Open-Access-Dissemination Veröffentlichung der Ergebnisse aus KI-Infrastruktur-Kapazitäten über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
- FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus KI-Infrastruktur-Kapazitäten nach FAIR-Prinzipien.
Energieverbrauch Wissenschaftsrechenzentren
PUE-Werte (Power Usage Effectiveness), Stromverbrauch in GWh und CO₂-Emissionen wissenschaftlicher Rechenzentren nach Einrichtung — Grundlage für Klimaschutzstrategien.
Sofort publizierbar — Rechenzentren veröffentlichen PUE-Werte zunehmend als Teil von Nachhaltigkeitsberichten und auf Initiative von Green IT-Programmen.
FinanzenPersonenbezogene DatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSVExcel (XLSX)
Verwendung in 5 Prozessen
- Klimaschutz Rechenzentrum-Energieverbrauch ist signifikanter und wachsender Faktor für institutionelle CO₂-Bilanzen.
- Effizienzoptimierung PUE-Benchmarking treibt Investitionen in energieeffiziente Kühlung und erneuerbare Energieversorgung.
- Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu Energieverbrauch Wissenschaftsrechenzentren gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
- Klimafolgen- und Risikoabschätzung Systematische Modellierung von Klimaauswirkungen und Umweltrisiken auf Basis der Daten zu Energieverbrauch Wissenschaftsrechenzentren.
- Umweltberichterstattung nach EU-Recht Regelmäßige Meldung der Umweltdaten aus Energieverbrauch Wissenschaftsrechenzentren an zuständige EU-Behörden (EEA, ECHA) gemäß gesetzlicher Berichtspflichten.
Simulationsdaten und Modellarchive
Archivierte Simulationsergebnisse aus wissenschaftlichen Großrechnungen: Klimamodell-Ensembles, Quantenchemie-Berechnungen, CFD-Simulationen mit Parameterdokumentation.
Sofort publizierbar — Klimamodell-Daten (CMIP6, CORDEX) werden auf ESGF vollständig offen bereitgestellt. Andere Disziplinen folgen zunehmend.
Wissenschaft/TechnikGeodatenIndividuell / MikrodatenCC BY 4.0CSVJSON
Verwendung in 5 Prozessen
- Reproduzierbarkeit Archivierte Simulationsdaten sind Grundvoraussetzung für die Reproduzierbarkeit computationeller Wissenschaft.
- Sekundärnutzung Verfügbare Simulationsdaten ermöglichen Analysen jenseits der ursprünglichen Fragestellung ohne erneuten Rechenaufwand.
- Digitale Weiterverarbeitung Bereitstellung der Daten zu Simulationsdaten und Modellarchive als maschinenlesbare Schnittstelle für digitale Anwendungen.
- Klimafolgen- und Risikoabschätzung Systematische Modellierung von Klimaauswirkungen und Umweltrisiken auf Basis der Daten zu Simulationsdaten und Modellarchive.
- Umweltberichterstattung nach EU-Recht Regelmäßige Meldung der Umweltdaten aus Simulationsdaten und Modellarchive an zuständige EU-Behörden (EEA, ECHA) gemäß gesetzlicher Berichtspflichten.
Forschungsnetz-Datentransferstatistik
Volumen und Spitzengeschwindigkeiten des Datentransfers im Deutschen Wissenschaftsnetz (DFN-Netz) nach Nutzungstyp, Region und Wachstumstrend.
Sofort publizierbar — DFN publiziert Netzauslastungsstatistiken und Wachstumsdaten im Jahresbericht und auf der DFN-Website.
Wissenschaft/TechnikPersonenbezogene DatenIndividuell / MikrodatenCC BY 4.0CSVExcel (XLSX)
Verwendung in 5 Prozessen
- Netzplanung Wachstumsstatistiken des DFN-Netzes informieren Ausbau- und Kapazitätsinvestitionen für das Wissenschaftsnetz.
- Infrastruktur-Benchmarking DFN-Transfer-Kapazitäten sind Indikator für die digitale Konnektivität der deutschen Wissenschaftslandschaft.
- Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu Forschungsnetz-Datentransferstatistik auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
- Open-Access-Dissemination Veröffentlichung der Ergebnisse aus Forschungsnetz-Datentransferstatistik über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
- FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus Forschungsnetz-Datentransferstatistik nach FAIR-Prinzipien.
HPC Ressourcennutzung
Rechenkapazitäten und Auslastung nationaler HPC-Systeme nach Forschungsbereich.
Sofort publizierbar — Rechenkapazität und Auslastung sind je Forschungsbereich zusammengefasst; einzelne Projekte und Rechenaufträge sind darin nicht erkennbar. Die Public-Domain-Lizenz erlaubt die uneingeschränkte Weiterverwendung.
Wissenschaft/TechnikMessungen / SensordatenAggregiert (zeitlich oder räumlich)CC0 / Public DomainCSV
Verwendung in 5 Prozessen
- Monitoring Automatisiertes Cluster-Monitoring der Rechenzentren
- Berichterstattung und Eskalationsmanagement Regelmäßige Berichterstattung der Monitoring-Ergebnisse zu HPC Ressourcennutzung mit Schwellenwert-Alerting bei Auffälligkeiten.
- Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu HPC Ressourcennutzung gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
- Open-Access-Dissemination Veröffentlichung der Ergebnisse aus HPC Ressourcennutzung über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
- FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus HPC Ressourcennutzung nach FAIR-Prinzipien.
Cloud-Dienste für Wissenschaft
Verfügbare Cloud-Dienste und Speicherkapazitäten für Forschungsdaten (EOSC, de.NBI).
Sofort publizierbar — Der Dienstkatalog beschreibt verfügbare Angebote und Speicherkapazitäten und richtet sich an Forschende. Nutzungsdaten enthält er nicht; die Public-Domain-Lizenz erlaubt die uneingeschränkte Weiterverwendung.
Wissenschaft/TechnikMetadatenEinzelereignis / RohdatenCC0 / Public DomainCSV
Verwendung in 5 Prozessen
- Katalogisierung Harvesting aus EOSC-Portal und de.NBI-Dienstverzeichnis
- Datenpflege und Aktualisierung Regelmäßige Aktualisierung des Katalogs zu Cloud-Dienste für Wissenschaft sowie Prüfung auf Vollständigkeit und Aktualität der Einträge.
- Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu Cloud-Dienste für Wissenschaft gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
- Open-Access-Dissemination Veröffentlichung der Ergebnisse aus Cloud-Dienste für Wissenschaft über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
- FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus Cloud-Dienste für Wissenschaft nach FAIR-Prinzipien.
HPC-Zugangsprogramme und Kontingente
Verwaltungsdaten zu HPC-Zugangsprogrammen (NHR, DFG-Großgeräteanträge): zugewiesene Rechenzeit-Kontingente nach Projekt und Institution, Ausschöpfungsquoten, Laufzeiten. Grundlage für nationale Ressourcenplanung.
Sofort publizierbar — Aggregierte Nutzungskontingente und Projektlisten ohne individuelle Nutzungsdetails können veröffentlicht werden.
Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSVJSON
Verwendung in 5 Prozessen
- Ressourcenzuteilung Transparenz über Vergabe nationaler Rechenzeit-Ressourcen an Wissenschaftsprojekte.
- Bedarfsplanung Grundlage für Kapazitätserweiterungsplanungen der NHR-Zentren.
- Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu HPC-Zugangsprogramme und Kontingente gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
- Datenschutzkonformes HR-Reporting Anonymisiertes Berichtswesen zu Personaldaten aus HPC-Zugangsprogramme und Kontingente unter Einhaltung datenschutzrechtlicher Anforderungen.
- Anonymisierte Mikrodata-Bereitstellung Bereitstellung anonymisierter Mikrodaten zu HPC-Zugangsprogramme und Kontingente für Forschungszwecke über Scientific-Use-Files an akkreditierte Einrichtungen.
CO₂-Fußabdruck Wissenschaftliches Rechenzentrum
Emissionsdaten und Nachhaltigkeitskennzahlen wissenschaftlicher Rechenzentren: PUE-Werte, Energiemix, CO₂-Äquivalente pro Recheneinheit, Kühlungseffizienz, Anteil erneuerbarer Energien. Basis für Green-IT-Benchmarking.
Sofort publizierbar — PUE-Werte, Energiemix und Emissionen je Recheneinheit beschreiben den Betrieb technischer Anlagen. Personenbezogene Angaben enthalten sie nicht; CC BY erlaubt die Weiterverwendung mit Quellenangabe.
UmweltMessungen / SensordatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSVJSON
Verwendung in 5 Prozessen
- Nachhaltigkeitsberichterstattung Jährliche CO₂-Bilanzierung des Rechenzentrumsbetriebs nach GHG-Protokoll.
- Effizienzoptimierung Benchmarking von PUE und Energiemix zur Identifikation von Einsparpotenzialen.
- Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu CO₂-Fußabdruck Wissenschaftliches Rechenzentrum gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
- Klimafolgen- und Risikoabschätzung Systematische Modellierung von Klimaauswirkungen und Umweltrisiken auf Basis der Daten zu CO₂-Fußabdruck Wissenschaftliches Rechenzentrum.
- Umweltberichterstattung nach EU-Recht Regelmäßige Meldung der Umweltdaten aus CO₂-Fußabdruck Wissenschaftliches Rechenzentrum an zuständige EU-Behörden (EEA, ECHA) gemäß gesetzlicher Berichtspflichten.
Rechenzeit-Belegungsstatistiken nach Fachgebiet
Jährliche Statistiken zur Nutzung von Rechenzeit auf nationalen Hochleistungsrechnern (JUWELS, SuperMUC-NG, Hawk, Lise/Emmy) der Gauss Centre for Supercomputing (GCS)-Zentren (FZJ, LRZ, HLRS), aufgeschlüsselt nach Fachgebiet (Physik, Chemie, Ingenieurwissenschaften, Lebenswissenschaften, Klima) und Projekttyp (Großprojekte, Normalverfahren). Enthält Core-h-Verbräuche und Auslastungsgrade nach Rechner und Partition.
Sofort publizierbar — Verbrauchte Rechenzeit je Fachgebiet und Projekttyp ist der Nachweis darüber, wofür eine öffentlich finanzierte Infrastruktur genutzt wurde. Projektinhalte, Codes und Antragsteller sind darin nicht enthalten.
Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC0 / Public DomainCSVJSON
Verwendung in 5 Prozessen
- Ressourcenzuteilungsanalyse Auswertung der Diskrepanz zwischen beantragten und tatsächlich genutzten Rechenzeiten je Projekt und Fachgebiet zur Optimierung des Zuteilungsverfahrens (Peer-Review-Ausschüsse).
- Effizienzmetriken Berechnung von CPU-Auslastung, Paralleleffizienz und GPU-Utilization aus Job-Scheduler-Logs zur Identifikation ineffizienter Applikationsmuster und Optimierungspotenzial.
- Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu Rechenzeit-Belegungsstatistiken nach Fachgebiet auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
- Klimafolgen- und Risikoabschätzung Systematische Modellierung von Klimaauswirkungen und Umweltrisiken auf Basis der Daten zu Rechenzeit-Belegungsstatistiken nach Fachgebiet.
- Umweltberichterstattung nach EU-Recht Regelmäßige Meldung der Umweltdaten aus Rechenzeit-Belegungsstatistiken nach Fachgebiet an zuständige EU-Behörden (EEA, ECHA) gemäß gesetzlicher Berichtspflichten.
Energieverbrauch und PUE-Werte der Rechenzentren
Monatliche und jährliche Energieverbrauchsdaten und Power Usage Effectiveness (PUE)-Werte der nationalen Hochleistungsrechenzentren (LRZ Garching, JSC Jülich, HLRS Stuttgart, GWDG Göttingen, ZIH Dresden). Enthält IT-Lastverbrauch, Kühlenergie, USV-Verluste und Gesamtverbrauch in MWh sowie CO2-Äquivalente nach Strommix. Dient dem Nachhaltigkeitsmonitoring und der Einhaltung der Energieeffizienzrichtlinie EU 2023/1791.
Sofort publizierbar — Rechenzentren mit >500 kW IT-Last sind nach EU-Energieeffizienzrichtlinie zur Berichterstattung im European Green Deal Data Space verpflichtet. Nationale Rechenzentren publizieren PUE-Werte in Jahresberichten und Nachhaltigkeitsberichten.
UmweltMessungen / SensordatenEinzelereignis / RohdatenCC0 / Public DomainCSVJSON
Verwendung in 5 Prozessen
- PUE-Berechnung Kontinuierliche Messung und Berechnung des Power Usage Effectiveness-Werts als Quotient aus Gesamtenergieverbrauch des Rechenzentrums und IT-Ausrüstungsenergieverbrauch nach Green Grid-Standard.
- CO2-Bilanzierung Berechnung von Scope-1- und Scope-2-Emissionen nach GHG Protocol unter Anwendung des stündlichen Strommix (Residualmix vs. Marktmix) für standortspezifische CO2-Äquivalente.
- Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu Energieverbrauch und PUE-Werte der Rechenzentren gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
- Anomalieerkennung und Qualitätskontrolle Automatisierte Erkennung von Ausreißern, Fehlmessungen und Datenanomalien in den Daten zu Energieverbrauch und PUE-Werte der Rechenzentren.
- Langzeitarchivierung nach OAIS Dauerhafter Erhalt der Messdaten aus Energieverbrauch und PUE-Werte der Rechenzentren nach dem OAIS-Referenzmodell in einem zertifizierten digitalen Langzeitarchiv.
Warteschlangenstatistiken HPC-Job-Scheduler
Aggregierte Statistiken aus den Job-Scheduler-Systemen (SLURM, PBS, LSF) der nationalen Hochleistungsrechner zu Warteschlangenzeiten, Durchsatz und Systemauslastung. Enthält mittlere Wartezeiten nach Partition und Jobgröße, Backfill-Effizienz, Abbruchquoten und Laufzeitverteilungen über monatliche Berichtsperioden. Dienen der Systemoptimierung und der Kommunikation von Dienstgüte an Nutzergemeinschaften.
Nach Aufbereitung publizierbar — Aggregierte Scheduler-Statistiken ohne Rückschluss auf einzelne Nutzerprojekte werden in Systemberichten und Benutzerhandbüchern publiziert. Detaillierte Job-Logs enthalten Projektinformationen und unterliegen Vertraulichkeit.
Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSVJSON
Verwendung in 5 Prozessen
- Warteschlangen-Simulation Diskrete Ereignissimulation des Job-Schedulers mit historischen Lastprofilen zur Evaluation neuer Scheduling-Algorithmen und Partitionierungsstrategien vor Produktivbetrieb.
- Anomalieerkennung Zeitreihenbasierte Anomalieerkennung auf Job-Durchsatz und Fehlraten zur Früherkennung von Hardwareausfällen und Scheduler-Fehlfunktionen im laufenden Betrieb.
- Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu Warteschlangenstatistiken HPC-Job-Scheduler auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
- Metadaten-Anreicherung und Katalogisierung Systematische Ergänzung beschreibender Metadaten zu Warteschlangenstatistiken HPC-Job-Scheduler für verbesserte Auffindbarkeit und Nachnutzbarkeit in Datenportalen.
- Metadaten-Standardisierung DDI Dokumentation der Erhebungsmetadaten aus Warteschlangenstatistiken HPC-Job-Scheduler im DDI-Codebook-Standard für Wiederverwendbarkeit in Forschungsinfrastrukturen.
HPC-Job-Ausführungsstatistiken
Aggregierte Statistiken zu Rechenaufträgen (Jobs) auf HPC-Systemen, einschließlich Jobanzahl, Laufzeiten, CPU/GPU-Stunden, Warteschlangenzeiten und Erfolgsquoten. Aufgeschlüsselt nach Fachgebiet, Institutionstyp und Systemgröße. Ermöglichen Kapazitätsplanung und Benchmarking zwischen Rechenzentren.
Sofort publizierbar — Aggregierte Job-Statistiken ohne Nutzeridentifikation sind nicht schützenswert und dienen der Transparenz über öffentlich finanzierte Recheninfrastruktur.
Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSVJSON
Verwendung in 5 Prozessen
- Job-Accounting Automatisierte Erfassung aller Job-Metriken durch das Batch-System mit standardisierten Accounting-Schnittstellen wie SLURM.
- Fachgebietszuordnung Klassifikation aller Jobs nach Fachgebiet der nutzenden Gruppe für disziplinspezifische Nutzungsanalysen.
- Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu HPC-Job-Ausführungsstatistiken auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
- Metadaten-Anreicherung und Katalogisierung Systematische Ergänzung beschreibender Metadaten zu HPC-Job-Ausführungsstatistiken für verbesserte Auffindbarkeit und Nachnutzbarkeit in Datenportalen.
- Metadaten-Standardisierung DDI Dokumentation der Erhebungsmetadaten aus HPC-Job-Ausführungsstatistiken im DDI-Codebook-Standard für Wiederverwendbarkeit in Forschungsinfrastrukturen.
Systemeffizienz- und Verfügbarkeitskennzahlen
Technische Betriebskennzahlen von HPC-Systemen, einschließlich System-Verfügbarkeit (Uptime), Mean-Time-Between-Failures, Energieeffizienz (PUE), Peak-Performance-Ausnutzung und Netzwerkdurchsatz. Ermöglichen Benchmark-Vergleiche nach TOP500-Standard und Nachhaltigkeitsberichte. Werden für Förderanträge und Evaluationen benötigt.
Sofort publizierbar — Verfügbarkeit, Ausfallabstände, Energieeffizienz und Durchsatz sind technische Betriebskennzahlen. Sie machen Systeme vergleichbar und Nachhaltigkeitsberichte prüfbar; sicherheitsrelevante Konfigurationsdetails gehören ausdrücklich nicht dazu.
Wissenschaft/TechnikMessungen / SensordatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSVJSON
Verwendung in 5 Prozessen
- Monitoring-System Kontinuierliche Erfassung aller Systemmetriken durch integrierte Monitoring-Infrastruktur mit Alerting-Funktionen.
- Energiemessung Granulare Erfassung des Energieverbrauchs aller Systemkomponenten für PUE-Berechnung und Klimabilanzierung.
- Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu Systemeffizienz- und Verfügbarkeitskennzahlen auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
- Interoperabilitäts- und Schnittstellentesting Technische Überprüfung von Datenschnittstellen und Kompatibilität mit bestehenden IT-Systemen für Systemeffizienz- und Verfügbarkeitskennzahlen.
- Automatisierte Datenqualitätsprüfung Kontinuierliche Validierung der Datenqualität in Systemeffizienz- und Verfügbarkeitskennzahlen durch regelbasierte Prüfroutinen und Anomalieerkennung im CI/CD-Prozess.
Fachgebietsspezifische Rechenzeit-Allokationsdaten
Daten zur Verteilung bewilligter und genutzter Rechenzeit-Kontingente auf wissenschaftliche Fachgebiete, Förderlinien und Institutionstypen. Enthalten Antrags- und Bewilligungsquoten, Unterauslastungsraten und Ausschöpfungsverläufe. Ermöglichen evidenzbasierte Allokationspolitik und Bedarfsplanung für zukünftige HPC-Systeme.
Sofort publizierbar — Aggregierte Allokationsdaten nach Fachgebiet ohne Institutsidentifikation können als Transparenznachweis zur Nutzung öffentlicher Rechenressourcen veröffentlicht werden.
Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSVJSON
Verwendung in 5 Prozessen
- Begutachtungsprotokollierung Dokumentation aller Allokationsentscheidungen des HPC-Gutachtergremiums nach standardisierten Bewertungskriterien.
- Ausschöpfungsmonitoring Echtzeitüberwachung der Kontingentausschöpfung mit automatischer Benachrichtigung bei Unter- oder Überauslastung.
- Räumliche Analyse und Visualisierung GIS-gestützte Auswertung der Geodaten zu Fachgebietsspezifische Rechenzeit-Allokationsdaten für Planungsentscheidungen und kartografische Darstellungen.
- Open-Access-Dissemination Veröffentlichung der Ergebnisse aus Fachgebietsspezifische Rechenzeit-Allokationsdaten über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
- FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus Fachgebietsspezifische Rechenzeit-Allokationsdaten nach FAIR-Prinzipien.
Energie-PUE-Kostenrechnung der Hochleistungsrechenzentren
Nationale HPC-Zentren (JSC, HLRS, LRZ) erfassen detailliert Energieverbrauch, Power Usage Effectiveness (PUE) und Betriebskosten. Diese Daten fließen in Green-IT-Berichte des BMBF und Gauss Centre for Supercomputing ein. Langzeittrends zeigen Effizienzgewinne durch neue Kühlkonzepte.
Sofort publizierbar — Energieverbrauchsdaten von Rechenzentren sind ökologisch relevant und werden in Nachhaltigkeitsberichten veröffentlicht.
UmweltMessungen / SensordatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSV
Verwendung in 5 Prozessen
- Energiemessung Unterverteiler und Smart-Meter erfassen Energieverbrauch aller HPC-Systeme und Kühlinfrastruktur kontinuierlich.
- PUE-Berechnung Monatliche PUE-Werte werden aus IT-Last und Gesamtverbrauch berechnet und gegen Benchmarks verglichen.
- Finanzkontrolle und Prüfung Überprüfung der Finanzdaten zu Energie-PUE-Kostenrechnung der Hochleistungsrechenzentren durch Rechnungsprüfung und interne Revision auf Korrektheit.
- Interoperabilitäts- und Schnittstellentesting Technische Überprüfung von Datenschnittstellen und Kompatibilität mit bestehenden IT-Systemen für Energie-PUE-Kostenrechnung der Hochleistungsrechenzentren.
- Automatisierte Datenqualitätsprüfung Kontinuierliche Validierung der Datenqualität in Energie-PUE-Kostenrechnung der Hochleistungsrechenzentren durch regelbasierte Prüfroutinen und Anomalieerkennung im CI/CD-Prozess.
Software-Stack-Nutzungsanalyse auf HPC-Systemen
HPC-Zentren analysieren welche Softwaremodule (MPI-Bibliotheken, Compiler, Anwendungssoftware) auf ihren Systemen am häufigsten geladen werden. Diese Nutzungsstatistiken informieren Software-Support-Prioritäten und Lizenzentscheidungen. Gauss Centre und PRACE berichten aggregierte Daten.
Sofort publizierbar — Software-Modul-Ladestatistiken enthalten keinen Personenbezug; relevant für HPC-Community-Transparenz.
Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSV
Verwendung in 5 Prozessen
- Modul-Log-Auswertung Lmod/Environment-Module-Systeme protokollieren alle Softwaremodul-Ladeoperationen mit Zeitstempel und Job-ID.
- Aggregationsanalyse Monatliche Auswertungen der Top-Module nach CPU-Stunden informieren Software-Support-Ressourcenplanung.
- Wissenschaftliche Nachnutzung Bereitstellung der Daten zu Software-Stack-Nutzungsanalyse auf HPC-Systemen für wissenschaftliche Sekundäranalysen über Forschungsdatenzentren.
- Interoperabilitäts- und Schnittstellentesting Technische Überprüfung von Datenschnittstellen und Kompatibilität mit bestehenden IT-Systemen für Software-Stack-Nutzungsanalyse auf HPC-Systemen.
- Automatisierte Datenqualitätsprüfung Kontinuierliche Validierung der Datenqualität in Software-Stack-Nutzungsanalyse auf HPC-Systemen durch regelbasierte Prüfroutinen und Anomalieerkennung im CI/CD-Prozess.
Wartungsfenster und Verfügbarkeitsstatistik der HPC-Systeme
Nationale Rechenzentren erfassen geplante und ungeplante Ausfallzeiten, Wartungsfenster und Systemverfügbarkeit (Uptime). Die Metriken fließen in Service-Level-Agreements mit Nutzern ein. Gauss Centre for Supercomputing berichtet konsolidierte Verfügbarkeitsstatistiken.
Sofort publizierbar — Systemverfügbarkeitsstatistiken sind Servicequalitätsdaten ohne Personenbezug; werden in Betreiberberichten veröffentlicht.
Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSV
Verwendung in 5 Prozessen
- Monitoring-System Nagios/Prometheus-basierte Monitoring-Systeme erfassen Systemzustände und berechnen Verfügbarkeitsmetriken automatisch.
- SLA-Reporting Quartalsweise SLA-Berichte an Nutzer dokumentieren tatsächliche vs. vereinbarte Systemverfügbarkeit.
- Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu Wartungsfenster und Verfügbarkeitsstatistik der HPC-Systeme auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
- Interoperabilitäts- und Schnittstellentesting Technische Überprüfung von Datenschnittstellen und Kompatibilität mit bestehenden IT-Systemen für Wartungsfenster und Verfügbarkeitsstatistik der HPC-Systeme.
- Automatisierte Datenqualitätsprüfung Kontinuierliche Validierung der Datenqualität in Wartungsfenster und Verfügbarkeitsstatistik der HPC-Systeme durch regelbasierte Prüfroutinen und Anomalieerkennung im CI/CD-Prozess.
HPC-Job-Statistik
Aggregierte Statistik zu Rechenaufträgen: Laufzeiten, Ressourcenverbrauch und Nutzung nach Fachgebiet.
Nach Aufbereitung publizierbar — Detaillierte Jobdaten können Rückschlüsse auf laufende Forschungsprojekte ermöglichen.
Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)Datenlizenz DeutschlandCSV
Verwendung in 5 Prozessen
- Log-Aggregation Tägliche Extraktion und Anonymisierung der Scheduler-Logs
- Ressourcenanalyse Auswertung von CPU/GPU-Auslastung und Energieverbrauch
- Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu HPC-Job-Statistik auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
- Metadaten-Anreicherung und Katalogisierung Systematische Ergänzung beschreibender Metadaten zu HPC-Job-Statistik für verbesserte Auffindbarkeit und Nachnutzbarkeit in Datenportalen.
- Metadaten-Standardisierung DDI Dokumentation der Erhebungsmetadaten aus HPC-Job-Statistik im DDI-Codebook-Standard für Wiederverwendbarkeit in Forschungsinfrastrukturen.
Rechenzentrum-Energieverbrauchsdaten
Energieverbrauchsmessung des HPC-Rechenzentrums: PUE-Wert, Kühlungseffizienz, CO2-Äquivalente.
Sofort publizierbar — Energiedaten sind für Nachhaltigkeitsberichterstattung öffentlich relevant.
UmweltMessungen / SensordatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSVJSON
Verwendung in 5 Prozessen
- Smart-Metering Kontinuierliche Erfassung durch Gebäudeleittechnik-Integration
- CO2-Kalkulation Umrechnung in CO2-Äquivalente nach Bundesnetzagentur-Strommix
- Archivierung und Langzeitverfügbarkeit Langfristige Archivierung der Daten zu Rechenzentrum-Energieverbrauchsdaten gemäß gesetzlicher Aufbewahrungspflichten und Zugänglichmachung für die Nachwelt.
- Anomalieerkennung und Qualitätskontrolle Automatisierte Erkennung von Ausreißern, Fehlmessungen und Datenanomalien in den Daten zu Rechenzentrum-Energieverbrauchsdaten.
- Langzeitarchivierung nach OAIS Dauerhafter Erhalt der Messdaten aus Rechenzentrum-Energieverbrauchsdaten nach dem OAIS-Referenzmodell in einem zertifizierten digitalen Langzeitarchiv.
Softwarelizenz-Nutzungsstatistik HPC
Auslastungsstatistik kommerzieller Softwarelizenzen auf HPC-Systemen (z.B. Matlab, Ansys).
Nach Aufbereitung publizierbar — Lizenznutzungsdaten nach Aggregation und Entfernung von Nutzerinformationen publizierbar.
Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)Datenlizenz DeutschlandCSV
Verwendung in 5 Prozessen
- Lizenzserver-Monitoring Automatische Erfassung über License-Manager (FlexLM/RLM)
- Kostenoptimierung Auswertung für Lizenzportfolio-Optimierung und Beschaffungsplanung
- Statistische Qualitätssicherung Plausibilitätsprüfung der Statistiken zu Softwarelizenz-Nutzungsstatistik HPC auf Ausreißer, Revisionsbedarf und methodische Konsistenz.
- Interoperabilitäts- und Schnittstellentesting Technische Überprüfung von Datenschnittstellen und Kompatibilität mit bestehenden IT-Systemen für Softwarelizenz-Nutzungsstatistik HPC.
- Automatisierte Datenqualitätsprüfung Kontinuierliche Validierung der Datenqualität in Softwarelizenz-Nutzungsstatistik HPC durch regelbasierte Prüfroutinen und Anomalieerkennung im CI/CD-Prozess.
HPC-Nutzungsstatistik Rechenzeiten
Aggregierte Statistiken zur Nutzung von Hochleistungsrechenzentren (HLRN, HPC@BWHPC): Rechenzeit nach Fach, CPU/GPU-Stunden, Auslastungsgrad.
Sofort publizierbar — Aggregierte HPC-Kapazitätsstatistiken ohne Projektdetails sind für Fördernachweise und Ressourcenplanung öffentlich; GAUSS-Alliance veröffentlicht Jahresberichte.
Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC0 / Public DomainCSVJSON
Verwendung in 5 Prozessen
- Job-Accounting Automatisiertes Logging aller Rechenjobs mit CPU-Zeit, Speicherbedarf und Nutzergruppe im SLURM-Scheduler.
- Nutzungsaggregation Quartalsweise Aggregation der Nutzungsdaten nach Fachgebiet, Projekt-Typ und Förderprogramm.
- Kapazitätsbericht Jährlicher Kapazitäts- und Nutzungsbericht an Zuwendungsgeber (BMBF, DFG) und GAUSS-Alliance.
- Interoperabilitäts- und Schnittstellentesting Technische Überprüfung von Datenschnittstellen und Kompatibilität mit bestehenden IT-Systemen für HPC-Nutzungsstatistik Rechenzeiten.
- Automatisierte Datenqualitätsprüfung Kontinuierliche Validierung der Datenqualität in HPC-Nutzungsstatistik Rechenzeiten durch regelbasierte Prüfroutinen und Anomalieerkennung im CI/CD-Prozess.
Forschungsdatenspeicher-Kapazitäten
Daten zu Speicherinfrastruktur für Forschungsdaten: Kapazitäten, Auslastung, Archivvolumina, Wachstumsraten und Kostenmodelle nach Einrichtung.
Nach Aufbereitung publizierbar — Interne Infrastrukturdetails vertraulich; aggregierte Kapazitätsdaten für NFDI-Berichterstattung und Bundesplanung publizierbar.
Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSVJSON
Verwendung in 5 Prozessen
- Kapazitätsmonitoring Kontinuierliches Monitoring von Speicherauslastung und Wachstumsraten im Infrastruktur-Management-System.
- Bedarfsplanung Projektion des Speicherbedarfs für die kommenden 3-5 Jahre auf Basis von Wachstumstrends und Projektzuläufen.
- NFDI-Berichterstattung Aufbereitung von Kapazitätsdaten für NFDI-Jahresbericht und Bundesplanung zur Forschungsinfrastruktur.
- Open-Access-Dissemination Veröffentlichung der Ergebnisse aus Forschungsdatenspeicher-Kapazitäten über Open-Access-Repositorien und wissenschaftliche Fachzeitschriften.
- FAIR-Daten-Zertifizierung Überprüfung und Zertifizierung der Findability, Accessibility, Interoperability und Reusability der Daten aus Forschungsdatenspeicher-Kapazitäten nach FAIR-Prinzipien.
Forschungssoftware-Repositorium Metadaten
Metadaten zu publizierter Forschungssoftware aus deutschen Hochschulen und Forschungseinrichtungen: Sprache, Lizenz, Zitierbarkeit (CITATION.cff), DOI.
Sofort publizierbar — Open-Source-Forschungssoftware-Metadaten sind per Definition öffentlich; Softwarezitation ist aufkommende Open-Science-Praxis.
Wissenschaft/TechnikMetadatenEinzelereignis / RohdatenCC0 / Public DomainJSONXML
Verwendung in 5 Prozessen
- Software-Harvesting Automatisiertes Harvesting von Forschungssoftware-Metadaten aus GitHub, GitLab und Zenodo.
- CITATION.cff-Validierung Prüfung und Anreicherung von Softwaremetadaten mit validen CITATION.cff-Dateien für Zitierfähigkeit.
- DOI-Registrierung Vergabe persistenter DOIs für archivierte Softwareversionen über Zenodo/DataCite für Langzeitverfügbarkeit.
- Kompetenz- und Outcome-Messung Evaluierung von Bildungsergebnissen und Kompetenzzuwachs anhand der Daten zu Forschungssoftware-Repositorium Metadaten.
- Länderübergreifendes Bildungsmonitoring Integration der Daten aus Forschungssoftware-Repositorium Metadaten in das nationale Bildungsmonitoring der KMK für bundesweite Vergleichsberichte.
HPC-Rechnerauslastung Job-Statistik
Zeitreihen zur CPU/GPU-Auslastung, Wartezeiten und Jobdurchsatz auf Großrechnern der HLRS, JSC und LRZ; Grundlage für Kapazitätsplanung.
Nach Aufbereitung publizierbar — Rohe Job-Logs enthalten Nutzerkennung; aggregierte Auslastungskurven publizierbar.
Wissenschaft/TechnikMessungen / SensordatenEinzelereignis / RohdatenCC BY 4.0CSVJSON
Verwendung in 5 Prozessen
- SLURM-Log-Extraktion Job-Accounting-Daten werden aus SLURM-Scheduler exportiert.
- Anonymisierung Nutzer-UIDs werden durch Pseudonyme ersetzt; Projektkennung bleibt für Abrechnung.
- Engpassanalyse Bottlenecks in I/O-Subsystemen werden durch Performance-Counter identifiziert.
- Kapazitätsbericht Quartalliche Auslastungsberichte werden an Geldgeber (BMBF, DFG) übermittelt.
- Metadaten-Standardisierung DDI Dokumentation der Erhebungsmetadaten aus HPC-Rechnerauslastung Job-Statistik im DDI-Codebook-Standard für Wiederverwendbarkeit in Forschungsinfrastrukturen.
HPC Energieverbrauch PUE-Monitoring
Echtzeit-Energiemonitoring-Daten (PUE, Kühleffizienz, CO₂-Äquivalent) für wissenschaftliche Rechenzentren nach EU-Energieeffizienz-Richtlinie.
Sofort publizierbar — Energiedaten ohne Personenbezug; EU-Berichtspflicht sieht öffentliche Transparenz vor.
UmweltMessungen / SensordatenEinzelereignis / RohdatenCC BY 4.0CSVJSON
Verwendung in 5 Prozessen
- Smart-Metering Leistungsmessgeräte erfassen 15-Minuten-Verbrauchswerte je Serverrack.
- PUE-Berechnung Power Usage Effectiveness wird täglich aus Gesamt- und IT-Last berechnet.
- CO2-Scope2-Reporting Emissionen werden mit regionalem Strommix-Faktor (UNFCCC-Methode) berechnet.
- EU-Klimadatenbank Jahreswerte werden in die EU-Klimadatenbank für Rechenzentren eingetragen.
- Langzeitarchivierung nach OAIS Dauerhafter Erhalt der Messdaten aus HPC Energieverbrauch PUE-Monitoring nach dem OAIS-Referenzmodell in einem zertifizierten digitalen Langzeitarchiv.
HPC Software-Lizenz Nutzungsmonitoring
Tracking kommerzieller Softwarelizenzen auf HPC-Systemen (ANSYS, MATLAB, VASP) nach Nutzungszeiten und Fachgebiet zur Lizenzoptimierung.
Nur Metadaten publizierbar — Lizenzverträge und Nutzungsdetails sind vertraulich; nur aggregierte Lizenzauslastung intern.
Wissenschaft/TechnikTransaktionsdatenAggregiert (zeitlich oder räumlich)Proprietär / RestriktivCSV
Verwendung in 5 Prozessen
- Flexlm-Monitoring Lizenz-Checkout-Events werden mit FlexLM-Daemon in Echtzeit protokolliert.
- Nutzungsanalyse Lizenzbelegungszeiten je Projekt und Fachgebiet werden täglich aggregiert.
- Auslastungsoptimierung Untergenutzte Lizenzblöcke werden bei Vertragsverlängerung reduziert.
- Bedarfsplanung Prognosticmodelle schätzen künftigen Lizenzbedarf aus Wachstumstrends.
- Langzeitarchivierung nach OAIS Dauerhafter Erhalt der Messdaten aus HPC Software-Lizenz Nutzungsmonitoring nach dem OAIS-Referenzmodell in einem zertifizierten digitalen Langzeitarchiv.
Rechenleistung und Auslastung
Verfügbare Rechenkapazität und Auslastung der HPC-Cluster.
Sofort publizierbar — Gemessen werden verfügbare Rechenknoten und ihre Belegung je Zeitscheibe. Bezugseinheit ist die Maschine; welche Projekte gerade rechnen, ist eine andere Kennzahl.
Wissenschaft/TechnikMessungen / SensordatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSV
Verwendung in 5 Prozessen
- Datenerhebung Erhebung der Primärdaten zu Rechenleistung und Auslastung im wissenschaftlichen Erhebungs- bzw. Forschungsprozess.
- Aufbereitung Strukturierung, Kodierung und Qualitätsaufbereitung der Daten zu Rechenleistung und Auslastung.
- Qualitätssicherung Validierung, Peer-Review und Konsistenzprüfung der Rechenleistung und Auslastung.
- Archivierung und Bereitstellung Langzeitarchivierung und FAIR-konforme Bereitstellung der Rechenleistung und Auslastung über Repositorien.
- Analyse und Auswertung Wissenschaftliche Auswertung und Sekundäranalyse auf Basis der Rechenleistung und Auslastung.
Rechenzeitvergabe nach Projekt
Zugeteilte Rechenzeit und Projektzahl nach Wissenschaftsgebiet.
Sofort publizierbar — Gezählt werden zugeteilte Kernstunden und Projekte je Wissenschaftsgebiet. Bei Gebieten mit wenigen Großprojekten ist zusammenzufassen, sonst beschreibt die Zahl ein einzelnes Vorhaben.
Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSV
Verwendung in 5 Prozessen
- Datenerhebung Erhebung der Primärdaten zu Rechenzeitvergabe nach Projekt im wissenschaftlichen Erhebungs- bzw. Forschungsprozess.
- Aufbereitung Strukturierung, Kodierung und Qualitätsaufbereitung der Daten zu Rechenzeitvergabe nach Projekt.
- Qualitätssicherung Validierung, Peer-Review und Konsistenzprüfung der Rechenzeitvergabe nach Projekt.
- Archivierung und Bereitstellung Langzeitarchivierung und FAIR-konforme Bereitstellung der Rechenzeitvergabe nach Projekt über Repositorien.
- Analyse und Auswertung Wissenschaftliche Auswertung und Sekundäranalyse auf Basis der Rechenzeitvergabe nach Projekt.
Energieverbrauch der Rechenzentren
Strom- und Kühlbedarf sowie PUE-Kennzahlen der HPC-Zentren.
Sofort publizierbar — Gemessen werden Strom- und Kühlbedarf je Standort und Jahr. Ein Rechenzentrum ist eine technische Anlage; Rückschlüsse auf einzelne Rechenaufträge ergeben sich aus Jahreswerten nicht.
UmweltMessungen / SensordatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSV
Verwendung in 5 Prozessen
- Datenerhebung Erhebung der Primärdaten zu Energieverbrauch der Rechenzentren im wissenschaftlichen Erhebungs- bzw. Forschungsprozess.
- Aufbereitung Strukturierung, Kodierung und Qualitätsaufbereitung der Daten zu Energieverbrauch der Rechenzentren.
- Qualitätssicherung Validierung, Peer-Review und Konsistenzprüfung der Energieverbrauch der Rechenzentren.
- Archivierung und Bereitstellung Langzeitarchivierung und FAIR-konforme Bereitstellung der Energieverbrauch der Rechenzentren über Repositorien.
- Analyse und Auswertung Wissenschaftliche Auswertung und Sekundäranalyse auf Basis der Energieverbrauch der Rechenzentren.
Speicherkapazität und Datenvolumen
Vorgehaltene Speicherkapazität und verwaltetes Datenvolumen.
Sofort publizierbar — Gezählt werden vorgehaltene Kapazität und belegtes Volumen je Standort. Bezugseinheit ist das Terabyte; die gespeicherten Datensätze unterliegen jeweils eigenen Zugangsregeln.
Wissenschaft/TechnikMessungen / SensordatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSV
Verwendung in 5 Prozessen
- Datenerhebung Erhebung der Primärdaten zu Speicherkapazität und Datenvolumen im wissenschaftlichen Erhebungs- bzw. Forschungsprozess.
- Aufbereitung Strukturierung, Kodierung und Qualitätsaufbereitung der Daten zu Speicherkapazität und Datenvolumen.
- Qualitätssicherung Validierung, Peer-Review und Konsistenzprüfung der Speicherkapazität und Datenvolumen.
- Archivierung und Bereitstellung Langzeitarchivierung und FAIR-konforme Bereitstellung der Speicherkapazität und Datenvolumen über Repositorien.
- Analyse und Auswertung Wissenschaftliche Auswertung und Sekundäranalyse auf Basis der Speicherkapazität und Datenvolumen.
Nutzergemeinschaft der HPC-Zentren
Zahl und Disziplinverteilung der HPC-Nutzenden und Projekte.
Sofort publizierbar — Gezählt werden aktive Projekte und Nutzungsberechtigungen je Disziplin. Eine Berechtigung ist eine Zahl, keine Person mit Merkmalen; Kennungen und Jobprotokolle fließen nicht ein.
Wissenschaft/TechnikMetadatenAggregiert (zeitlich oder räumlich)CC BY 4.0CSV
Verwendung in 5 Prozessen
- Datenerhebung Erhebung der Primärdaten zu Nutzergemeinschaft der HPC-Zentren im wissenschaftlichen Erhebungs- bzw. Forschungsprozess.
- Aufbereitung Strukturierung, Kodierung und Qualitätsaufbereitung der Daten zu Nutzergemeinschaft der HPC-Zentren.
- Qualitätssicherung Validierung, Peer-Review und Konsistenzprüfung der Nutzergemeinschaft der HPC-Zentren.
- Archivierung und Bereitstellung Langzeitarchivierung und FAIR-konforme Bereitstellung der Nutzergemeinschaft der HPC-Zentren über Repositorien.
- Analyse und Auswertung Wissenschaftliche Auswertung und Sekundäranalyse auf Basis der Nutzergemeinschaft der HPC-Zentren.
Weitere Organisationstypen im Sektor Wissenschaft und Forschung
- Universität
- Forschungsinstitut
- Forschungsdatenzentrum
- Akademie der Wissenschaften
- Forschungsförderorganisation
- Wirtschafts- und Sozialforschungsinstitut
- Hochschule für angewandte Wissenschaften (HAW)
- Wissenschaftliche Bibliothek & Informationsinfrastruktur
- Umweltforschungsinstitut
- Sozialwissenschaftliches Forschungsinstitut
- Rechtswissenschaftliches Institut
- Messnetz, Observatorium & Astronomie
- Medizinische Forschung & Klinische Studien
- KI-Forschungsinstitute
- Berufsbildungsforschung
- NFDI-Konsortien
- Citizen Science Plattformen
- Geowissenschaftliche Institute