Zum Hauptinhalt springen

CRASH Hackathon

Cultural Heritage Advanced Search Hackathon

Wann: Montag, 30. November und Dienstag, 1. Dezember 2026

Wo: UNICORN Startup & Innovation Hub
Schubertstraße 6a, 8010 Graz, Austria

Anmeldung: Eine Teilnahme ist kostenlos, jedoch verbindlich: Bitte melden Sie sich bis zum 1. November 2026 über dieses Anmeldeformular an. Das Hacken findet ausschließlich vor Ort statt.

Sprache: Die Veranstaltungssprache ist Englisch. Ein wenig Deutsch im Team ist hilfreich, da einige Datensätze Deutsch enthalten.


Suche steht im Zentrum der Forschung. Forschende wissen, was ein gutes Suchwerkzeug für sie leistet: Es ermöglicht ihnen, sich durch eine Sammlung zu bewegen, die Ergebnisse zu steuern, es ist schnell und funktioniert auch mit dem nächsten Datensatz. Forschungssoftware scheitert oft genau an diesem Punkt.

Suche ist Abruf, und was ein Werkzeug abruft, spiegelt die Fragestellung wider: Die Ergebnisse sind die Elemente, die der Anfrage am ähnlichsten sind. Ähnlichkeit ist die erste Entscheidung in jedem Suchwerkzeug, und die meisten Werkzeuge treffen diese Entscheidung für die Nutzer*innen und verbergen sie. Doch das Finden ist nur der Anfang. Ein gutes Werkzeug zeigt auch, warum ein Ergebnis angezeigt wird. Es ermöglicht den Nutzer*innen, zu ändern, was „ähnlich“ bedeutet, und die Ergebnisse entsprechend zu verfolgen. Es funktioniert für Menschen, die mit einem Screenreader lesen oder in einer anderen Sprache arbeiten. Es gibt an, was eine Suche in Zeit und Energie kostet. Und hin und wieder findet es das, wonach niemand gesucht hat. CRASH beschäftigt sich mit Werkzeugen, die diese Arbeit offen leisten, sodass die Nutzer*innen sie nachvollziehen und steuern können.

Für zwei Tage bringt CRASH Kulturerbe-Daten und die Menschen, die sich dafür interessieren, in einem Raum zusammen.

CRASH Website

Vibes and Checks

Vibes

Baue, was du möchtest – mit deinem Team, deinen Daten und deinem Problem.

Gewinner der Herzen, gewählt vom Raum.

Checks

Wähle eine Sache, die du gut machen möchtest, und zeige am Ende, wie du sie überprüft hast.

Gewinner der Zahlen, gewählt von der Jury.

Jedes Team wählt einen Schwerpunktbereich. In der Abschlusspräsentation zeigt das Team eine Überprüfung für diesen Bereich: Was getestet wurde und wie. Es gibt zwei Rankings, eines durch den Raum und eines durch die Jury, jeweils mit den Plätzen eins bis drei. Die Preise sind klein und symbolisch.

AreaQuestionExample of a check
EffizienzWas kostet eine Suche?Zeit, Rechenleistung und Energie pro Anfrage
VertrauenKann ich nachvollziehen, warum dieses Ergebnis angezeigt wird?Jedes Ergebnis ist mit seinem Datensatz verknüpft; die gleiche Anfrage liefert zweimal die gleiche Antwort
SteuerungKann der/die Nutzer*in das Ergebnis beeinflussen?Der/die Nutzer*in ändert, was „ähnlich“ bedeutet, und die Ergebnisse passen sich an
ZugangWer kann es nutzen?Screenreader, Spracheingabe, einfache Sprache, eine zweite Sprache
EntdeckungFindet es auch ungewöhnliche Dinge?Maßstäbe jenseits der Genauigkeit: Vielfalt, Zufallstreffer, unähnliche Elemente

Agenten sind in jedem Bereich willkommen. Wie du baust, liegt ganz bei dir.

Topics

Einige Beispiele für Methoden, die wir gerne sehen würden:

  • Abruf über Bild, Text und Layout gleichzeitig
  • Einbettungen für jede Art von Objekt und eine Erklärung, was sie nicht erfassen
  • Neusortierung, die eine Ergebnisliste verbessert, ohne sie zu verfälschen
  • Retrieval-augmented Generation (RAG), die ihre Quellen zitiert und angibt, wo sie nichts gefunden hat
  • Agenten, die im Auftrag der Nutzer*innen suchen und ein Protokoll ihrer Aktionen führen
  • Vision-Language-Modelle, die Handschrift lesen
  • Suche über Sprachen, Schriftsysteme und die acht Schreibweisen eines Dorfes hinweg
  • Erkennung von Kopien, Fälschungen und nahezu identischen Duplikaten
  • Empfehlungen und Erkundungen als Alternative zur Suchbox
  • Wissensgraphen und Linked Open Data
  • Bewertung jenseits der Genauigkeit
  • Die Kosten einer Anfrage in Watt

Einige Beispiele für Materialien:

  • Urkunden mit und ohne Siegel
  • Manuskripte mit ihren Randnotizen und Kritzeleien
  • Zeitungen mit Texterkennung aus dem Jahr 2009
  • Briefe, Tagebücher und Kontobücher
  • Karten, die sich gegenseitig widersprechen
  • Museumsobjekte, die in drei Worten beschrieben sind
  • Fotografien ohne Bildunterschriften
  • Audio, Film und 3D-Scans
  • Katalogkarten, die andere Katalogkarten beschreiben
  • Metadaten in jedem Standard und in keinem

Wer kann teilnehmen

Wir laden Studierende, Forschende, Praktiker*innen und Expert*innen aus der Wissenschaft, Gedächtnisinstitutionen und der Industrie ein, zum Beispiel:

  • Hacker*innen
  • Personen aus den Bereichen Natural Language Processing (NLP) und Computer Vision (CV)
  • Datenmanager*innen
  • Kurator*innen
  • Archivar*innen
  • Bibliothekar*innen
  • Designer*innen

Die Liste ist nicht vollständig. Wenn dich die Veranstaltung interessiert, melde dich an.

Das Wertvollste, was du mitbringen kannst, ist dein Team oder ein Teil deines Labors, zusammen mit einem Datensatz und einem Problem, das du gut kennst. Falls das nicht möglich ist, komm alleine. In diesem Fall bringst du etwas mit, mit dem der Raum arbeiten kann: eine Fähigkeit, einen Datensatz oder ein Problem. Du musst nicht programmieren können. Wir ermutigen insbesondere Menschen, die einem in der Tech-Branche unterrepräsentierten Geschlecht angehören, sich anzumelden.

Die Einladung richtet sich an die Institutionen von CLARIAH-AT, an Partneruniversitäten sowie an CLARIN- und DARIAH-Institutionen in den Nachbarländern Österreichs und darüber hinaus. Die Plätze sind begrenzt. Wir lesen jede Anmeldung sorgfältig und stellen den Raum so zusammen, dass die Teams stark und divers sind.

Die Veranstaltungssprache ist Englisch. Ein wenig Deutsch im Team ist hilfreich, da einige Datensätze auf Deutsch sind. Das Hacking findet ausschließlich vor Ort statt.

Weitere ausführliche Informationen finden sich auf der CRASH Website:

CRASH Website