Gehostet in Deutschland · Kein Sprachmodell zur Textgenerierung
Die Dokumentenfunktion für euer Produkt.
Ihr baut eure Fachanwendung. annibox übernimmt den Teil, den ihr sonst zweimal bauen müsstet: Upload, Texterkennung, versionierte Ablage und Suche – mandantengetrennt, über eine API, die euer Produkt selbst aufruft.
curl -X POST \
$API/stores/$STORE/documents \
-H "X-API-Key: $KEY" \
-F file=@niederschrift.pdf
{"job_id":"8f3c…","status":"pending"}
# Abholen, sobald der Job durch ist
GET /documents/{id} → Markdown
POST /stores/{id}/search → Treffer
Ein Schlüssel je Mandant, Scopes je Schlüssel. Wer was verarbeitet.
Was ihr euch spart
Vier Baustellen, die ihr nicht selbst aufmacht
OCR läuft lokal im selben Container, deutsch und englisch, und nur dann, wenn ein PDF zu wenig Text liefert. Gemischte Dokumente – digital plus eingescannte Anlage – bleiben vollständig, weil vorhandener Text nicht überschrieben wird.
Die Isolation hängt nicht am
Anwendungscode, sondern an PostgreSQL: die Anwendungsrolle hat kein
BYPASSRLS. Ein vergessenes WHERE liefert keine
fremden Daten, sondern gar keine.
Die hochgeladene Datei liegt vor der Verarbeitung dauerhaft, nicht im Arbeitsspeicher. Ein harter Abbruch verzögert einen Job – er verliert ihn nicht.
AVV, TOMs und ein Subprozessorenverzeichnis liegen vor und beschreiben ausschließlich, was tatsächlich läuft. Ihr reicht sie an eure Kunden durch, statt sie zu verfassen.
Schnittstelle
Was die API kann
Datei rein
PDF, Word, Excel,
PowerPoint, Bilder, HTML, Text. Die Antwort ist ein Job; der Status kommt
über /api/v1/jobs/{id}. Ein leeres Ergebnis ist ein Fehler,
keine leere Antwort.
Markdown raus
Standard-Markdown mit Metadaten, versioniert. Dubletten erkennt annibox am Quell-Hash: gleiche Bytes erzeugen eine neue Version, keinen zweiten Datensatz.
Treffer statt Volltext
Bedeutung und Volltext zusammen, verrechnet über die Ränge. Fällt die Vektorseite aus, antwortet die Suche weiter über den Volltext und sagt, dass sie es tut.
Die Ausgabe ist Standard-Markdown und die Vektoren liegen in PostgreSQL. Wer annibox wieder ausbaut, nimmt beides mit – das ist ausdrücklich vorgesehen.
Für wen
Wer damit arbeitet
Fachanwendungen, in denen Dokumente bisher als Anhang liegen und niemand durchsuchen kann.
Wo der Betriebsstandort Deutschland keine Auslegungsfrage ist, sondern eine Vergabebedingung.
Die den Datenlayer für ihre Kundenprojekte nicht jedes Mal neu bauen wollen.
Das Angebot
Bezahlte Pilotintegration
- Mandant, Stores und Schlüssel für euer Produkt
- Integration gemeinsam bis zum ersten echten Dokument
- Abnahme an eurem Formatmix, nicht an unseren Beispieldateien
- AVV und TOMs zur Weitergabe an eure Kunden
- Festes Verarbeitungskontingent je Mandant
- Kontingente sind im System hinterlegt, nicht im Vertrauen
- Ansprechpartner für Störungen, kein Ticketsystem
- Mehrverbrauch und rechenintensive Texterkennung nach Aufwand
Eine Partnerverwaltung mit automatischer Verbrauchsabrechnung und ein fertiges Integrationspaket sind nicht gebaut. Mandanten legen wir für euch an, abgerechnet wird nach Vereinbarung. Das ist der ehrliche Stand: die erste Integration entsteht gemeinsam, und was sie braucht, bauen wir daran – nicht vorher ins Blaue.
Kontakt
Pilotintegration anfragen
Schreib uns, welches Produkt ihr baut und welche Dateien darin anfallen. Wir melden uns mit einer Einschätzung, was die Integration kostet und woran wir sie abnehmen – vor einem Angebot, nicht danach.