Zum Inhalt

Dokumente

BearStack organisiert Dokumente um die vorhandenen Dateien herum. Die Dateien bleiben unverändert im lokalen Speicher; Metadaten, Volltext, Vorschaudaten und Indexe liegen getrennt davon in SQLite und Cache-Verzeichnissen.

Einstellungen

Im Systemmenü bilden Einstellungen (Zahnrad), Konto (Person) und Logout eine gemeinsame Icon-Zeile. API und Log stehen im Footer neben der Versionsnummer. Sichtbar sind jeweils die Aktionen, für die das Konto berechtigt ist.

Die Einstellungen starten auf Allgemein (/settings/general). Unter Einstellungen → Allgemein (/settings/general) stehen die globalen Optionen für Anwendungsname, Design, Startseite, Tag-Darstellung und Favicon. Einstellungen → Dokumente (/settings) enthält Desktop-Vorschau, Dokument-Wolke, Tag-Ordner und Papierkorb-Aufbewahrung. Speichern ändert jeweils nur den geöffneten Bereich; Favicon-Upload und Zurücksetzen bleiben separate Aktionen.

Die Einstellungsnavigation steht auf großen Bildschirmen seitlich und bricht auf kleineren Bildschirmen in mehrere Zeilen um. Formulargruppen, lange Beschriftungen und Aktionen passen sich der verfügbaren Breite an.

Ablage und Verarbeitung

Dokumente können über die Weboberfläche (POST /upload), die JSON-API (POST /api/upload) oder kompatible PUT-Anfragen importiert werden. BearStack speichert die Originaldatei im konfigurierten storage_dir, legt Metadaten in SQLite ab und führt Text-, Vorschau- und Thumbnail-Verarbeitung asynchron im Hintergrund aus.

Bei Vorschau und Thumbnail-Erstellung gelten dieselben Formatregeln. MIME-Parameter wie charset=utf-8, Groß-/Kleinschreibung und umgebende Leerzeichen verhindern die Erkennung nicht. Office- und Textdateien können weiterhin über ihre Dateiendung erkannt werden, wenn der MIME-Typ unspezifisch ist. Beispielsweise wird eine Datei mit neutralem Namen und application/rtf; charset=utf-8 auch von der Hintergrund-Thumbnail-Erstellung berücksichtigt.

Unterstützt werden PDF, Bilder sowie einfache Text- und Office-Formate. Office-Text und Office-Vorschauen benötigen LibreOffice. Uploads werden nach dem konfigurierten Limit begrenzt, Dateinamen werden normalisiert, unbekannte Dateitypen werden abgelehnt und gespeicherte Pfade immer gegen den Storage-Root aufgelöst. Unerwartete Import- und Vorschaufehler werden für HTTP-Antworten generisch ausgegeben, damit interne Pfade oder Werkzeugdetails nicht im Browser landen.

PDFs werden standardmäßig im Viewer des Browsers angezeigt. Jeder Nutzer kann unter Konto -> Darstellung stattdessen den integrierten BearStack-PDF-Viewer aktivieren. Er bietet Seitennavigation, Zoom, Anpassung an Breite oder Seite, Textauswahl, Links und den direkten Wechsel zum Browser-Viewer beziehungsweise Originaldownload. Die Präferenz gilt auch für als PDF erzeugte Office-/Textvorschauen, wird geräteübergreifend gespeichert und lädt PDF.js erst beim Öffnen einer Vorschau. Kann PDF.js ein Dokument nicht darstellen, fällt BearStack automatisch auf den Browser-Viewer zurück.

Weitere Dokumentfunktionen:

  • Detailseiten mit Metadaten, Vorschau, Verknüpfungen und gruppierten Dateien
  • E-Mail-Import für PDF-Anhänge und EML-Archive aus einem IMAP-Postfach
  • Papierkorb, Duplikatübersicht und Exportfunktionen
  • Hintergrundverarbeitung mit nachvollziehbaren Statusansichten
  • Statistik- und Audit-Ansichten für den Betrieb

PDF-Thumbnails werden zunächst temporär erzeugt und vollständig als JPEG geprüft. Erst danach ersetzen sie die veröffentlichte Vorschau atomar. Der Thumbnail-Nachholprozess arbeitet über Dokument-IDs in kleinen Batches weiter; auch ein vollständig fehlerhafter Batch blockiert spätere Dokumente nicht.

Dokument-Bildthumbnails prüfen vor dem Dekodieren die Bilddimensionen und erlauben höchstens 40 Megapixel. Bei ungültigen oder größeren Bildern wird keine neue Vorschau erzeugt; Originaldatei und vorhandenes Thumbnail bleiben erhalten.

Endgültiges Löschen

BearStack speichert Dateibereinigungsaufträge und die Löschung der Dokumentmetadaten gemeinsam in einer SQLite-Transaktion. Originale und Vorschauen werden zunächst in storage_dir/.purge/ verschoben. Die Phase wird gespeichert, bevor Dateien endgültig entfernt werden. Noch offene Aufträge überstehen Neustarts und werden beim Start sowie danach minütlich erneut verarbeitet, auch bei deaktivierter Papierkorb-Aufbewahrungsfrist. Originaldateinamen bleiben bis zum Abschluss reserviert; ein späterer Upload kann dadurch nicht versehentlich von einem wiederholten Löschauftrag entfernt werden.

Die Dokumentdatenbank wird automatisch auf Schema 17 migriert. Für konsistente Backups die Datenbank und den vollständigen Dokumentenspeicher einschließlich .purge/ gemeinsam sichern. Bei einer fehlgeschlagenen Dateibereinigung zeigt die Oberfläche an, dass sie im Hintergrund wiederholt wird; Einzelheiten stehen im Server-Log.

Die Bereinigung wartet auf eine laufende Vorschauerzeugung desselben Dokuments. Parallel angeforderte Löschungen anderer Dokumente können weiterarbeiten; abgebrochene Wartevorgänge lassen ihren Auftrag für einen späteren Versuch bestehen.

Dokumentstatistik

Gleichzeitige Seitenaufrufe teilen sich eine Berechnung der Dokumentstatistik. Änderungen an Dokumenten invalidieren den Cache; ein älterer, noch laufender Berechnungsvorgang kann diese Invalidierung nicht rückgängig machen. Wartende Seitenaufrufe können unabhängig voneinander abgebrochen werden.

Suche und OCR

  • Volltextsuche über extrahierte Inhalte
  • OCR-Unterstützung für PDFs und Scans
  • Filter nach Tags, Feldwerten und Zeiträumen
  • Suchfavoriten für wiederkehrende Filter
  • Wortwolke für häufige und fachlich zentrale Tags
  • virtuelle Ordner für Tags, Felder und Favoriten

E-Mail-Import

Der E-Mail-Import ruft PDF-Anhänge und angehängte .eml-Dateien aus einem IMAP-Postfach ab und führt sie durch denselben Dokumentimport wie normale Uploads. PDF-Anhänge bleiben dabei unverändert; BearStack übernimmt die PDF-Datei in den Dokumentenspeicher, erkennt Duplikate und startet die weitere Verarbeitung wie Vorschau, Volltext und OCR-Status getrennt davon.

EML-Anhänge werden als eigenständige E-Mail-Archive importiert. BearStack erzeugt dafür ein PDF mit unabhängigem Metadaten-Deckblatt, gerenderter sicherer HTML-/Textabbildung der E-Mail und anschließenden PDF-Anhängen aus der EML. Nicht-PDF-Anhänge innerhalb der EML werden auf dem Deckblatt mit Name, Typ und Größe gelistet, aber nicht eingebettet. Für die gerenderte Mailabbildung wird chromium benötigt; für das Zusammenführen von Deckblatt, Mailabbildung und PDF-Anhängen nutzt BearStack pdfunite aus poppler-utils.

Konfiguriert wird der Import unter Einstellungen -> E-Mail-Import. Unterstützt werden SSL/TLS, STARTTLS und unverschlüsselte IMAP-Verbindungen; Standardwerte sind Port 993, INBOX und ein Abrufintervall von 15 Minuten. Ein Verbindungstest prüft die Zugangsdaten, ein manueller Lauf ruft sofort ab, und bei aktiviertem Import prüft BearStack das Postfach regelmäßig im Hintergrund.

Ab 1.13.2 ist der gesamte Verbindungsaufbau einschließlich TLS, Begrüßung, CAPABILITY und STARTTLS auf 20 Sekunden begrenzt. Ein fehlgeschlagener Aufbau schließt die Verbindung. Für anschließende IMAP-Kommandos gilt weiterhin ein Zeitlimit von zwei Minuten.

Die Absenderliste kann leer bleiben oder einzelne Adressen und Domänen enthalten. Eine leere Liste verarbeitet alle Absender. Domänenregeln passen auch auf Subdomains; nicht erlaubte Absender werden abgelehnt, protokolliert und aus dem IMAP-Postfach gelöscht. Die Prüfung bezieht sich auf die Import-Nachricht im IMAP-Postfach. Erfolgreich verarbeitete E-Mails mit PDF- oder EML-Anhängen werden ebenfalls gelöscht, damit das Postfach als Eingangskorb funktioniert. E-Mails ohne verarbeitbare Anhänge bleiben unberührt.

Die Größe einer Nachricht wird vor dem IMAP-Download geprüft; auch die angeforderte Inhaltsmenge ist begrenzt. Das bestehende Nachrichtenlimit beträgt das 20-Fache der konfigurierten Upload-Dateigröße und berücksichtigt Anhänge sowie Mail-Kodierung. Mail-Import und EML-Archivierung akzeptieren höchstens 32 verschachtelte MIME-Container. Nachrichten, die diese Grenzen überschreiten, werden als Fehler protokolliert und bleiben im Postfach.

Alle Importläufe werden im Audit-Log sichtbar: erfolgreiche Importe, Duplikate, abgelehnte Absender, Verbindungstests und Fehler bekommen eigene Einträge. Die Verwaltung des Mail-Imports erfordert Systemverwaltungsrechte.

Tags

Tags sind kurze, frei wählbare Markierungen für Dokumente. Sie bleiben als Metadaten in BearStack gespeichert und verändern die Dateien nicht. Tags lassen sich in Listen, Detailseiten, Filtern und Batch-Aktionen nutzen, damit ein Dokument gleichzeitig in mehreren fachlichen Zusammenhängen auffindbar bleibt.

Benutzer ohne Struktur-Recht können nur vorhandene Dokument-Tags zuweisen. Neue Tags werden bei Dokument-Metadaten, Batch-Tagging und kompatiblen Uploads abgelehnt, wenn die Berechtigung für Struktur-Daten fehlt.

Dokument-Tags können mehr als nur markieren:

Funktion Wirkung
Farbe und Beschreibung machen Tags in Listen, Details, Filtern und Auswahlfeldern leichter unterscheidbar
Automatisches Tagging Regelsets vergeben Tags anhand von Dateiname, Textinhalt oder beidem; Regeln können „mindestens eins“ oder „alle“ Treffer verlangen und Ausschlüsse definieren
Primärer Tag markiert fachliche Hauptkategorien für die Wortwolke; primäre Tags bilden dort eigene Bereiche
Gruppenmodus verbindet Dokumente mit demselben Gruppentag automatisch; sie erscheinen auf Detailseiten als gruppierte Dateien, auch ohne manuelle Verknüpfung
Nur im Detail anzeigen hält interne oder sehr technische Tags in Listen kompakt verborgen; sie bleiben suchbar und sind auf Detailseiten sichtbar
Löschschutz verhindert das Löschen von Dokumenten mit diesem Tag; Löschaktionen werden ausgeblendet und direkte Löschversuche serverseitig blockiert

Dateien verknüpfen

BearStack kann Dokumente manuell miteinander verknüpfen. In der Dokumentliste werden dafür mehrere Dateien ausgewählt und anschließend verknüpft. Auf der Detailseite erscheinen diese Dateien im Abschnitt „Verknüpfte und gruppierte Dateien“ mit Vorschau, Titel, Originalname, Datum, Größe, Upload-Weg, Detail-Link und Download.

Wenn du genau eine bereits verknüpfte und eine oder mehrere unverknüpfte Dateien auswählst und auf Verknüpfen klickst, erscheint ein Dialog:

  • Zur vorhandenen Verknüpfung hinzufügen: Die neuen Dateien werden untereinander sowie mit der bereits verknüpften Datei und allen ihren direkt verknüpften, aktiven Dateien verbunden. Weitere Verknüpfungen dieser Partner werden nicht verfolgt; Gruppentags bleiben unverändert.
  • Neue Verknüpfung erstellen: Nur die ausgewählten Dateien werden miteinander verbunden. Bisherige Verknüpfungen bleiben bestehen.
  • Abbrechen oder Escape schließt den Dialog ohne Änderung.

Bei anderen Auswahlen bleibt die bisherige Bestätigung erhalten. Die Erweiterung wird atomar gespeichert. Ist inzwischen nicht mehr genau eine ausgewählte Datei verknüpft, wird sie abgelehnt; lade dann die Liste neu. Ohne JavaScript oder ohne Angabe eines Modus gilt weiterhin das Verknüpfen nur der ausgewählten Dateien.

Manuelle Verknüpfungen eignen sich für Anlagen, Nachweise, Verträge mit Nachträgen oder mehrteilige Vorgänge. Sie verändern die Originaldateien nicht; die Beziehung liegt als BearStack-Metadatum in der Datenbank. Mit Dokument-Bearbeitungsrechten kann eine manuelle Verknüpfung auf der Detailseite wieder aufgehoben werden.

Zusätzlich gibt es automatische Gruppierung über Tags im Gruppenmodus. Alle Dokumente mit demselben Gruppentag werden auf der Detailseite zusammen angezeigt. Gruppierte Dateien sind dort erkennbar, lassen sich aber nicht einzeln als Verknüpfung aufheben, weil die Gruppierung aus dem gemeinsamen Tag entsteht. Um die Gruppierung zu ändern, wird der Gruppentag am Dokument angepasst.

Suchfavoriten

Suchfavoriten speichern wiederkehrende Suchen als benannte Abkürzungen. Ein Favorit kann Suchtext, Tags, benutzerdefinierte Feldwerte und Zeiträume kombinieren, zum Beispiel „Rechnungen dieses Jahr“ oder „Steuer letzte 30 Tage“. Relative Zeiträume werden beim Aufruf neu berechnet, feste Jahresfilter bleiben stabil.

Wortwolke

Die Dokument-Wolke ist standardmäßig deaktiviert und kann unter Einstellungen -> Dokument-Wolke eingeschaltet werden. Danach erscheint Wolke in der Hauptnavigation und kann optional als Startseite gewählt werden.

Die Wolke visualisiert Dokument-Tags nach Häufigkeit. Größere Wörter stehen für häufiger verwendete Tags, jedes Wort führt direkt zur passenden Dokumentliste. Wenn keine primären Tags gesetzt sind, zeigt BearStack eine zentrale Wolke der wichtigsten Tags. Wenn primäre Tags gesetzt sind, entstehen eigene Wolkenbereiche: primäre Tags werden hervorgehoben, und verwandte Tags erscheinen in ihrem Umfeld.

Die Wortwolke bleibt eine Navigations- und Suchhilfe. Sie verändert keine Dateien, Tags oder Dokumente, sondern nutzt vorhandene Tag-Metadaten und die gleiche Dokumentfilterung wie Listen, Suche und virtuelle Ordner.

Benutzerdefinierte Felder

Benutzerdefinierte Felder ergänzen Dokumente um strukturierte Werte wie Kundennummer, Projekt, Vertragspartner oder Aktenzeichen. Felder können mit Autocomplete arbeiten, in der Filterleiste erscheinen und auf Wunsch Wertordner erzeugen, wenn genügend Dokumente denselben Wert teilen. So entsteht Ordnung über Metadaten, ohne die vorhandene Ablage oder die Dateien selbst umzubauen.

Virtuelle Ordner

Die Ordneransicht ist virtuell: Ordner entstehen aus Dokument-Tags, Feldwerten und Suchfavoriten, nicht aus einem beschreibbaren Dateisystembaum. Sie werden in der Weboberfläche als eigene Ordneransicht angezeigt und führen von dort direkt zu den passenden Dokumentlisten.

Der WebDAV-kompatible Endpunkt bildet dieselbe virtuelle Struktur ab. PROPFIND, GET, HEAD und PUT sind unterstützt; DELETE, MKCOL, MOVE, COPY, LOCK, UNLOCK, PROPPATCH, PATCH und POST werden als read-only abgelehnt. PUT importiert neue Dateien in den Zielordner und übernimmt vorhandene Tag-Ordner als Initial-Tags, überschreibt aber keine existierenden Ressourcen.

Berechtigungen

Dokumentrechte sind capability-basiert und werden über Rollen oder einzelne Permissions vergeben:

Rolle oder Recht Wirkung
documents_read Dokumente lesen, herunterladen, suchen, exportieren und WebDAV lesend nutzen
documents_editor zusätzlich hochladen, Metadaten bearbeiten, OCR starten, Dokumente verknüpfen und vorhandene Tags zuweisen
documents_manager zusätzlich löschen, wiederherstellen und Struktur-Daten wie Tags, Felder und Suchfavoriten pflegen
api_uploader Upload über API, ohne Dokumente lesen zu dürfen
admin vollständige Verwaltung

Für Sonderfälle können einzelne Permissions wie documents.read, documents.webdav.read, documents.upload, documents.edit, documents.delete und documents.structure kombiniert werden. Die vollständige Matrix steht unter Benutzer und Rechte.