PROVENANCE
Methodik und Herkunft.
Wie eine Akte von der offiziellen Veröffentlichung zu einer Seite auf dieser Website wird, was die KI mit ihr macht und wo wir wissen, dass das Ergebnis unvollkommen ist. Wenn du dieses Archiv zitieren möchtest, lies zuerst diese Seite.
Woher die Daten stammen
Die einzige Quelle ist die offizielle Veröffentlichung: der Katalog, den das US-Kriegsministerium unter war.gov/ufo publiziert, zuzüglich der über DVIDS ausgelieferten Videodateien. Nichts hier stammt aus UFO-Foren, Privatsammlungen oder Sekundärliteratur. Was nicht in der offiziellen Veröffentlichung steht, steht auch nicht in diesem Archiv.
Wie jede Akte verarbeitet wird
- 01Der offizielle Katalog wird heruntergeladen und mit dem bereits vorhandenen Bestand abgeglichen, sodass nur neue oder geänderte Akten erneut verarbeitet werden.
- 02Ortsangaben werden geokodiert, sofern sie einen realen Ort benennen; Einträge wie „Various“ oder „Low-Earth orbit“ bleiben bewusst ohne Kartenpunkt.
- 03Aus Dokumenten wird der Text extrahiert, gescannte Seiten durchlaufen eine OCR-Erkennung. Seiten, die unleserlich zurückkommen, werden als solche gekennzeichnet, statt stillschweigend zu verschwinden.
- 04Ein Sprachmodell verfasst für Dokumente eine Zusammenfassung und eine Transkription, für Videos und Bildmaterial eine visuelle Beschreibung — so wird das Material danach durchsuchbar, was es tatsächlich enthält.
- 05Zusammenfassungen und Beschreibungen werden in die übrigen fünf Sprachen übersetzt, Suchindex und Entitätsgraph werden neu aufgebaut, und die gesamte Website wird als statische Seiten neu erzeugt.
Was die KI tut — und was sie nicht tun darf
Das Modell transkribiert, fasst zusammen, beschreibt Bildmaterial und übersetzt. Es ist angewiesen, nicht zu interpretieren, keine Schlüsse zu ziehen und keine Lücken zu füllen: Lässt sich eine Seite nicht lesen, ist die richtige Ausgabe, genau das zu sagen. Jeder KI-erzeugte Block auf dieser Seite ist als solcher gekennzeichnet, und das Originaldokument ist stets daneben verlinkt. Die KI entscheidet nie, ob eine Sichtung geklärt ist — dieses Urteil steht, sofern es existiert, im Behördenkommentar innerhalb der Akte.
Bekannte Einschränkungen
Unleserliche Scans
Ein großer Teil des Bestands besteht aus maschinengeschriebenen Durchschlägen, Mikrofilmen oder stark geschwärztem Papier aus den 1940er- bis 1960er-Jahren. Wo die OCR scheitert, nennt der Seitenzähler exakt, wie viel lesbar war — „4 von 55 Seiten lesbar“ — statt eine vollständige Erfassung nahezulegen.
Dokumente ohne Zusammenfassung
Nicht jedes Dokument hat eine KI-Zusammenfassung. Wenn die Texterkennung den größten Teil eines Dokuments als unlesbar zurückgibt, wird gar keine Zusammenfassung veröffentlicht: 27 Einträge zeigen derzeit nur die offizielle Beschreibung. Eine Zusammenfassung über Seiten, die sich nicht lesen lassen, wäre geraten — und dieses Archiv rät nicht. Diese Einträge bekommen erst dann wieder eine Zusammenfassung, wenn sich die Quelle später erfolgreich verarbeiten lässt.
Maschinelle Übersetzung
Die fünf nicht-englischen Fassungen jeder Zusammenfassung sind maschinell übersetzt, und die Dokumente selbst werden nie übersetzt — die Transkription, die du durchsuchst, ist immer das englische Original. Wo Übersetzung und Original voneinander abweichen, gilt das Original.
Automatische Entitätsextraktion
Der Wissensgraph entsteht, indem Personen, Orte, Behörden, Objektbeschreibungen und Phänomene aus dem Text extrahiert werden. Er ist eine Navigationshilfe, kein Befund: Eine Entität wird nur beibehalten, wenn der Begriff in lesbarem Text oder in der offiziellen Beschreibung vorkommt, und nahezu identische Einträge werden zurückhaltend zusammengeführt.
Umgang mit Korrekturen
Wenn hier etwas falsch ist, wird es korrigiert und die Korrektur dokumentiert. Schreib an leonardo.sapuy@hotmail.com und nenne die Akte, die betreffende Stelle und, wenn möglich, die Seite im Original-PDF. Sachfehler in Transkriptionen, Zusammenfassungen oder Übersetzungen werden in den Quelldaten behoben und die Website wird neu erzeugt; hat ein Fehler eine KI-Zusammenfassung betroffen, wird die Zusammenfassung zurückgezogen, statt sie zu einer Vermutung zurechtzuflicken. Diese Seite wird aktualisiert, sobald ein systematisches Problem — wie das oben beschriebene — gefunden und behoben wurde.
Last reviewed: 2026-07-26
Über uns — ein unabhängiges Archiv freigegebener UAP-Akten →