Normy
Alle Beiträge
Künstliche IntelligenzDatenschutzKostenschätzung

Was das Modell aus Ihren Abrechnungen lernt, und was nicht

Landen unsere Unternehmerpreise im Modell? Die Frage ist berechtigt und die Antwort hängt davon ab, ob ein Sprachmodell Dokumente liest oder aus ihnen trainiert wird. Der Unterschied, erklärt.

Pascal MüngerPascal Münger4 Min. Lesezeit

Wer ein Kostenarchiv aus eigenen Schlussabrechnungen aufbauen will, muss diese Abrechnungen irgendwo hochladen. In den Gesprächen dazu kommt fast immer dieselbe Frage, meist in der ersten Viertelstunde: Lernt das Modell dann aus unseren Zahlen? Und kann ein anderes Büro später von unseren Unternehmerpreisen profitieren?

Die Frage ist berechtigt. In einer Schlussabrechnung stehen Dinge, die man nicht beiläufig aus der Hand gibt: die Preise der eigenen Unternehmer, das Honorar, die Nachträge, die Bauherrschaft. Die Antwort hängt von einer technischen Unterscheidung ab, die in der öffentlichen Diskussion über KI oft verschwimmt.

Zwei Arten, wie ein Modell mit einem Dokument in Kontakt kommt

Ein Sprachmodell ist eine grosse Menge an Zahlen, die Gewichte. Sie entstehen im Training, wenn das Modell über Monate Milliarden von Texten verarbeitet und dabei seine Gewichte anpasst. Was im Training war, ist danach im Modell, verteilt über diese Gewichte, ohne dass man ein einzelnes Dokument je wieder sauber herauslösen könnte. Das ist der Zustand, den man meint, wenn man sagt, ein Modell habe etwas gelernt.

Der zweite Weg ist das Lesen. Wenn Sie einem Modell ein PDF vorlegen und eine Frage stellen, wird das Dokument in den Arbeitsspeicher der Anfrage geladen, das sogenannte Kontextfenster. Das Modell verarbeitet es, gibt eine Antwort, und mit dem Ende der Anfrage ist der Inhalt aus diesem Speicher wieder weg. Die Gewichte haben sich nicht verändert. Die nächste Anfrage startet mit demselben Modell wie vor dem Upload.

Der Unterschied ist derselbe wie zwischen einer Person, die über Jahre an tausend Abrechnungen ausgebildet wurde, und einer, die eine einzelne Abrechnung durchliest, um eine Frage zu beantworten. Nur ist er bei einer Maschine schärfer: Ohne einen ausdrücklichen Trainingsschritt gibt es beim Lesen keinen Weg, auf dem ein Dokument in die Gewichte gelangt.

Wo das Training trotzdem stattfinden kann

Die Sorge kommt nicht aus dem Nichts. Bei den frei zugänglichen Varianten der bekannten Chat-Werkzeuge behalten sich die Anbieter in den Standardbedingungen vor, Eingaben zu speichern und für die Weiterentwicklung ihrer Modelle zu verwenden. Dort führt vom Lesen ein Weg zum Training: nicht während der Anfrage, sondern später, wenn gespeicherte Gespräche in die nächste Trainingsrunde einfliessen.

Bei Geschäfts- und Schnittstellenverträgen derselben Anbieter ist dieser Weg in der Regel vertraglich geschlossen. Die Eingaben werden für die Beantwortung der Anfrage verarbeitet und nicht für das Training verwendet. Die Technik ist in beiden Fällen dieselbe. Was sich unterscheidet, ist die Vereinbarung darüber, was nach der Anfrage mit den Daten geschieht.

Für ein Büro heisst das: Die entscheidende Frage ist nicht, ob ein Modell im Spiel ist, sondern unter welchen Bedingungen es die Dokumente verarbeitet und was danach mit ihnen passiert.

Was in Normy mit einer Abrechnung geschieht

Beim Kostenrechner liest das Sprachmodell die Abrechnung. Es erkennt die Positionen, ordnet sie dem BKP zu und übergibt das Ergebnis als Tabelle. Damit ist seine Aufgabe erledigt. Die Kennwerte entstehen danach durch Arithmetik über diese Tabellen, ohne dass ein Modell daran beteiligt wäre.

Die Abrechnungen werden nicht zum Training von KI-Modellen verwendet, weder von uns noch von den Anbietern, deren Modelle wir einsetzen. Die strukturierten Daten, die daraus entstehen, sind pro Büro getrennt. Es gibt keinen Pool, in dem die Kennwerte mehrerer Büros zusammenfliessen. Ein Büro, das drei Jahre mit dem Kostenrechner arbeitet, hat am Ende ein Archiv aus seinen eigenen Objekten, nicht aus denen der anderen.

Aus einem Gespräch: "Ich würde unsere Abrechnungen niemandem geben, wenn ich nicht weiss, ob da am Schluss ein Mitbewerber unsere Preise sieht."

Genau diese Bedingung gehört vor dem ersten Upload geklärt, bei uns wie bei jedem anderen Anbieter. Wer darauf keine klare Antwort bekommt, sollte die Abrechnungen behalten.

Was wir daraus mitnehmen

Dass ein Modell ein Dokument liest, bedeutet nicht, dass es daraus lernt. Der Weg vom Lesen zum Training existiert, aber er ist eine Entscheidung des Anbieters und steht in den Vertragsbedingungen, nicht in der Technik. Für Schlussabrechnungen, in denen das kommerzielle Wissen eines Büros steckt, ist diese Bedingung die erste Frage, die man stellen sollte. Die Antwort muss vor dem Upload vorliegen und nicht nach ihm.


Wenn Sie den Kostenrechner mit eigenen Abrechnungen ausprobieren möchten, melden Sie sich für den Beta-Zugang an.