LogoLucyWorks
  • Lessons
  • Answers
  • Pricing
  • About
  • Ask Lucy
  • Book a call
LW·A08·Can AI do this?← All answers

Kann KI Angebote korrekt reihen, wenn die Rechnung stimmt?

Nicht immer. Im PAIR-20-Lauf vom Juli 2026 (T05.5) berechnete ChatGPT die Beratungsangebots-Arithmetik korrekt, reihte dann aber das teuerste All-in-Angebot in der Ergebnistabelle auf Platz eins.

Nicht immer — der PAIR-20-Lauf vom Juli 2026 zeigt, dass der letzte Schritt trotz korrekter Rechnung scheitern kann. In T05 sollten drei Beratungsangebote auf All-in-Basis verglichen werden. Die Differenz der Schlagzeilenpreise wirkte größer als der tatsächliche Entscheidungsspielraum; nach Berücksichtigung versteckter Kosten und Scope-Anpassungen betrug die All-in-Differenz über die drei Angebote $750 (Fallbeispiel).

Ein so enger Vergleich verzeiht keine Darstellungsfehler. Beträgt die All-in-Differenz nur $750, ist die Rangtabelle keine Dekoration — sie ist die Empfehlung.

Im Juli-Lauf fand ChatGPT die richtigen Komponenten und berechnete die All-in-Arithmetik korrekt, reihte dann aber Pinnacle in der Ergebnistabelle auf Platz eins — obwohl Pinnacle den höchsten All-in-Gesamtbetrag hatte. Die Arithmetik darunter und die Tabelle darüber widersprachen sich. Gemini zeigte ein anderes Darstellungsproblem: Im Fließtext stand Bridgepoints korrekter All-in-Wert, doch der effektive Mischsatz (Blended Rate) wurde nur als Grundhonorar ausgewiesen — die Kosten, die den Vergleich ehrlich gemacht hätten, fehlten.

Korrekte Rechnung ist nicht dasselbe wie eine korrekte Entscheidung. Ein Modell kann das Honorar extrahieren, die Scope-Anpassung addieren, Reise- und Nebenkosten einrechnen — und trotzdem den falschen Anbieter an die Spitze setzen. Der Fehler liegt nicht im Rechenschritt, sondern darin, das Ergebnis in die Empfehlung zu übertragen.

Die Tabelle braucht ihre eigene Prüfung. Einkaufsteams prüfen oft die Herleitung und überfliegen dann das Endranking. Kehren Sie die Reihenfolge um: Lesen Sie die Rangzeile gegen den All-in-Gesamtbetrag, dann den All-in-Gesamtbetrag gegen die Kostenaufstellung.

Enge Spreizung macht Darstellungsfehler entscheidungsrelevant. Bei einer Differenz von $750 im Fallbeispiel bleibt kein Spielraum für einen Tabellenwiderspruch. Reiht ein Modell das teuerste All-in-Angebot auf Platz eins, kann ein Einkäufer die falsche Empfehlung weiterleiten — während jede Zahl in der Herleitung sauber aussieht. Prüfen Sie bei Angebotsrankings die Endreihenfolge getrennt von der Rechnung.

Where this comes from

  • PAIR-20 July 2026 run of record, task T05 — single dated runs, screenshots on file
  • Procurement AI Reality Check, July 2026

Last checked 2026-07-12. Evidence comes from dated, single-run platform sessions with screenshots on file — read each finding as “this happened,” not “this always happens.”

Work this yourself — from the course

Compare Three Consulting Bids With AI — The $15K Spread That's Really $750Compares three consulting bids with different rate structures and expense terms so the true cost spread is visible, rather than the misleading headline-rate comparison.

Related questions

  • What is a blended rate in consulting bids?

See what the platforms caught — and missed

Twenty procurement tasks, four AI platforms, real dated runs. Lesson 2 is free to read, no account needed.

Read the free lessonTraining for your team
LogoLucyWorks

KI-Training, das mit einem funktionierenden Agenten endet.

Produkt
  • The 20 Lessons
  • Answers
  • Ask Lucy
  • PAIR-20 benchmark
  • Reality Check
  • Preise
  • Book a call
Unternehmen
  • Über uns
Rechtliches
  • Cookie-Richtlinie
  • Datenschutzerklärung
  • Nutzungsbedingungen
© 2026 LucyWorks. All Rights Reserved.