Kann KI Lieferantenangebote zuverlässig vergleichen?
Nicht zuverlässig. Im PAIR-20-Lauf vom Juli 2026 fand KI mehrere Angebotsprobleme, doch eine Plattform übernahm einen Einheitenfehler in das Ranking und eine andere reihte das teuerste Beratungsangebot nach korrekter Rechnung auf Platz eins.
KI kann Lieferantenangebote vergleichen — doch „vergleichen“ umfasst mehrere Teilaufgaben. Das System muss Einheiten normalisieren, veraltete Dokumente ausschließen, Pflichtgebühren erkennen, Grundpreis von durchlaufenden Kosten trennen und die Angebote reihen, ohne dabei der eigenen Rechnung zu widersprechen.
Der PAIR-20-Lauf vom Juli 2026 zeigt beide Seiten. In der SaaS-Angebotsaufgabe fanden die Plattformen die versteckte Pflichtgebühr und ignorierten ein abgelaufenes Angebot. Gemini erkannte die Pro-100-Lizenzen-Einheitenfalle bei beiden Prompts, und ChatGPT erkannte sie, sobald das Structured Brief (strukturierte Aufgabenbeschreibung) die zu normalisierenden Felder benannte. Claude übernahm dennoch den Pauschalwert in das Ranking — selbst nach Hinweis auf die Einheit.
In der Beratungsangebotsaufgabe verlagerte sich der Fehler auf die Entscheidungstabelle. ChatGPT berechnete die Arithmetik korrekt und reihte dann das teuerste Angebot auf Platz eins. Gemini zeigte den korrekten All-in-Wert im Fließtext, rechnete aber die versteckten Kosten nicht in den effektiven Mischsatz (Blended Rate) ein. Claude und Copilot bestanden den Structured-Brief-Lauf für diese Aufgabe.
Der Vergleich kann fertig aussehen, bevor er sicher ist. Eine Lieferantentabelle mit Summen und Empfehlung lässt sich schnell weiterleiten. Genau das macht sie riskant: Der Fehler kann in der einen Spalte stecken, der alle vertrauen.
Erst normalisieren, dann reihen. Einheiten, Vertragslaufzeit, Lizenzanzahl, Pflichtgebühren, Scope-Obergrenzen (Leistungsbegrenzungen), durchlaufende Kosten und abgelaufene Dokumente müssen geprüft sein, bevor die Anbieterreihenfolge gelesen wird. Stimmen diese Eingaben nicht, ist das Ranking nur eine aufbereitete Version des Fehlers.
Tabelle gegen Herleitung prüfen. Für ein arbeitendes Einkaufsteam besteht die richtige Nutzung nicht darin, KI nach einem Gewinner zu fragen und aufzuhören. Bitten Sie das System, die normalisierten Eingaben, die ausgeschlossenen Dokumente, die Gebührenannahmen und die All-in-Berechnung offenzulegen. Vergleichen Sie dann das Endergebnis mit dieser Herleitung. Im Juli-Lauf hätte genau diese letzte Prüfung die eine fehlerhafte Empfehlung aufgedeckt.
Where this comes from
- PAIR-20 July 2026 run of record, tasks T01 and T05 — single dated runs, screenshots on file
- Procurement AI Reality Check, July 2026
Last checked 2026-07-12. Evidence comes from dated, single-run platform sessions with screenshots on file — read each finding as “this happened,” not “this always happens.”
Work this yourself — from the course
Related questions
See what the platforms caught — and missed
Twenty procurement tasks, four AI platforms, real dated runs. Lesson 2 is free to read, no account needed.