KI und Sprache
- Vertex AI mit Gemini für Dialog, Klassifikation und Extraktion
- Document AI für OCR auf Mietverträgen und Rechnungen
- Cloud Translation v3 für Ticket-Übersetzungen am EU-Endpunkt
Architektur
Diese Seite richtet sich an technische Prüfer, Partner und Investoren. Sie beschreibt die eingesetzten Dienste, den Weg einer Meldung durch das System und die Grenzen, die wir uns gesetzt haben. Der Stand ist ein durchgängig lauffähiges Produkt in Pilotvorbereitung.
Durchgängig lauffähig.
Jede hier beschriebene Funktion läuft heute im Produkt – auf Google Cloud in der Region europe-west1.
Plattform
Alle Umgebungen entstehen aus Terraform. Es gibt keine manuell angelegten Produktionsressourcen, und jede Änderung ist versioniert nachvollziehbar.
Der Weg einer Meldung
Jeder Schritt ist ein eigener, prüfbarer Übergang. Nichts davon läuft im Browser des Nutzers.
Der Messenger-Webhook trifft auf Cloud Run. Authentifizierung über geteiltes Geheimnis und IP-Prüfung, bevor irgendetwas verarbeitet wird.
Ein Zustandsautomat führt durch die Aufnahme, Gemini übernimmt Absichtserkennung und die Prüfung, ob die Beschreibung ausreicht.
Der Vorgang wird in Firestore geschrieben. Fotos landen in Cloud Storage, erreichbar ausschließlich über signierte, rollengeprüfte URLs.
Ein Firestore-Trigger startet Haftungsklassifikation, Fristenberechnung, Übersetzung und die Bewertung passender Betriebe.
Die Verwaltung entscheidet. Betriebe antworten über einen sicheren Einmal-Link, ohne Konto, mit atomarer Konfliktauflösung beim Zuschlag.
Geplante Jobs eskalieren überfällige Vorgänge. Abgeschlossene Tickets wandern samt Verlauf in ein Archiv.
Entwurfsentscheidungen
Gas, Strom, Wasseraustritt und Einbruchgefahr eskalieren über eine feste Regel. Ein Modell darf diese Einstufung nach oben ergänzen, aber nie aufheben.
Die Rangfolge der Betriebe entsteht aus einer offengelegten Formel – Nähe, Bewertung und abgeschlossene Vorgänge – und nicht aus einem Modell. Vertrauensbetriebe der Verwaltung stehen immer vor dem Netzwerk.
Vor der Annahme sieht ein Betrieb nur Kategorie, Dringlichkeit, groben Bereich und Zeitfenster. Vollständige Adresse und Kontakte werden erst nach der Annahme freigegeben.
Rolle, Aktivstatus und Verknüpfungen sind für Clients gesperrt. Jeder sensible Ablauf läuft über eine serverseitige Funktion.
Einladungs- und Auftrags-Links werden ausschließlich als SHA-256-Hash gespeichert und nie im Klartext protokolliert.
Jeder Modellaufruf schreibt seinen Token-Verbrauch mit. Kosten pro Ticket und pro Vertrag sind dadurch bekannte Größen, keine Schätzungen.
Skalierung
Der Ressourcenbedarf hängt fast vollständig an der Zahl der verwalteten Einheiten. Diese Größen bestimmen den Cloud-Verbrauch:
Weil jeder Modellaufruf seinen Verbrauch protokolliert, lässt sich der Bedarf je zusätzlicher Einheit hochrechnen, statt ihn zu schätzen.
Stand
Partnern und technischen Prüfern zeigen wir das System gern im Detail.