Zum Hauptinhalt springen
Wir haben Tendergate auf Haiku 5.5 umgestellt: Die Lesekosten sanken um 75%, und die Bewertungen desselben Angebots wurden strenger
08. Oktober 2026

Wir haben Tendergate auf Haiku 5.5 umgestellt: Die Lesekosten sanken um 75%, und die Bewertungen desselben Angebots wurden strenger

Zwischen dem 10. September und dem 8. Oktober haben wir dieselbe öffentliche Ausschreibung achtmal analysiert: 53 prüfbare Anforderungen, 22 Zuschlagskriterien, mehrere Versionen eines echten Angebots. Ausschreibung, Auftraggeber und Bieter bleiben ungenannt. In den ersten sieben Läufen übernahm Haiku 4.5 das Lesen Punkt für Punkt, und diese Stufe kostete jedes Mal $14,39 bis $16,04. Am 8. Oktober, einen Tag nachdem Anthropic Haiku 5.5 veröffentlicht hatte, haben wir Tendergate darauf umgestellt. Dieselbe Stufe kostete danach $3,96, 75% weniger — passend zu Anthropics Ankündigung, der Betrieb koste „rund 75% weniger“ als Haiku 4.5.

−75%
Kosten der Lesestufe beim selben Angebot, von $16,04 auf $3,96
17 Min.
Dauer der Lesestufe, gegenüber 24–38 Minuten mit Haiku 4.5
14 / 53
Anforderungen, deren Bewertung sich beim identischen Angebot geändert hat

Unsere Angebotsanalyse nutzt Modelle auf drei Stufen. Das schnelle liest Punkt für Punkt: ein kleiner Agent pro Anforderung, Kriterium und Los, bei dieser Ausschreibung 76.

1. Die Rechnung

Kosten der Lesestufe pro Analyse, dieselbe Ausschreibung
Läufe 1–7 mit Haiku 4.5 (10.–24. September), Lauf 8 mit Haiku 5.5 (8. Oktober).
Lauf 1 · 4.5 $14,39
Lauf 2 · 4.5 $14,67
Lauf 3 · 4.5 $16,01
Lauf 4 · 4.5 $15,22
Lauf 5 · 4.5 $15,43
Lauf 6 · 4.5 $15,06
Lauf 7 · 4.5 $16,04
Lauf 8 · 5.5 $3,96

Die sieben Haiku-4.5-Läufe lagen höchstens $1,65 auseinander, der Rückgang ist also kein Zufall. Die gesamte Analyse sank von $36,27 auf rund $18, und das Hauptmodell ist mit $8,64 jetzt ihr größter Kostenposten.

2. Mehr Denken pro Schritt

Klügere Modelle sollen mit weniger Schritten auskommen — das sagte Anthropic beim Start von Opus 4.5. Die Anforderungen brauchten so viele Schritte — Modellaufrufe — wie zuvor, die Zuschlagskriterien etwa halb so viele. In jedem Schritt dachte das Modell deutlich mehr.

11,1
Aufrufe pro Anforderung mit Haiku 5.5, gegenüber 9,8–17,8 mit Haiku 4.5
6,0
Aufrufe pro Zuschlagskriterium, gegenüber 11,0–18,1
13×
mehr Denken pro Aufruf beim selben Angebot

Auch die Prompts wuchsen, auf 80.000 Token statt 52.000, zum Teil weil Haiku 5.5 denselben Text als rund 30% mehr Token zählt. Das zählt wegen einer Preisgrenze: Unter 100.000 Token pro Anfrage kostet Haiku 5.5 ein Zehntel von Haiku 4.5; darüber kostet die gesamte Anfrage das Fünffache. 187 unserer 724 Aufrufe lagen darüber: ein Viertel der Aufrufe, 68% der Rechnung dieser Stufe.

3. Strenger beim selben Angebot

Die Läufe 7 und 8 haben dieselbe Angebotsversion gelesen:

Bewertung der AnforderungHaiku 4.5, 24. SeptemberHaiku 5.5, 8. Oktober
Erfüllt4935
Teilweise erfüllt06
Nicht überprüfbar18
Nicht anwendbar34

Alle 14 Änderungen gingen weg von „erfüllt“. Manche sind bessere Treffer, etwa eine Einreichungsanforderung, die der ältere Lauf als erfüllt wertete, obwohl das Angebot keine Upload-Bestätigung enthält. Manche sind zu streng, etwa zwei Ausschlussgründe, die der Auftraggeber selbst in öffentlichen Registern prüft und die ungeprüft blieben. Bei den Zuschlagskriterien war es umgekehrt: Drei der vier Änderungen hoben eine Teilbewertung auf „erfüllt“.

Nicht alles davon ist das Modell. Zwischen den Läufen haben wir eine Anweisung ergänzt, nach der nur die eigenen Angaben des Bieters als Nachweis zählen, das Modell, das Feststellungen nachprüft, von Sonnet 4.6 auf Sonnet 5.5 umgestellt und geändert, wie Dokumente in Text umgewandelt werden. Der größte Teil des Kostenrückgangs ist der Preis des Modells; die Bewertungsänderungen gehören zur gesamten Pipeline, und ein einzelner Lauf kann sie nicht trennen.

4. Was wir daraus mitnehmen

Halten Sie den Prompt jedes Agenten unter 100.000 Token, und lassen Sie Ihre eigenen Dokumente erneut laufen, bevor Sie einem Modellwechsel vertrauen, wie es auch Anthropics Prompting-Leitfaden für Haiku 5.5 empfiehlt.

Jede Bewertung in Tendergate trägt das Zitat und die Fundstelle im Dokument, auf denen sie beruht. So lässt sich jede Bewertung, die sich nach einem Modellwechsel ändert, direkt an der Quelle prüfen.

Wie wir gezählt haben: acht Produktionsanalysen; Hauptmodell Opus 4.8 in den Läufen 1–6 und Opus 5.5 in den Läufen 7–8. Die Kosten beruhen auf Anthropics veröffentlichten Preisen, einschließlich des höheren Satzes über 100.000 Token.

Sehen Sie, wie KI bei Ihren Vergabeverfahren helfen kann.
Testen Sie Ihre erste KI-Analyse kostenlos.
Kostenlos registrieren

Quellen

  1. Introducing Claude Haiku 5.5 (Anthropic, 7. Oktober 2026). Veröffentlichungsdatum und die Aussage, der Betrieb koste „rund 75% weniger“.
  2. Claude-API-Preise (Anthropic). Die Preise von Haiku 5.5 und Haiku 4.5, einschließlich des höheren Haiku-5.5-Satzes über 100.000 Token.
  3. Migration zu Claude Haiku 5.5 (Anthropic). Derselbe Text ergibt bei Haiku 5.5 rund 30% mehr Token.
  4. Prompting für Claude Haiku 5.5 (Anthropic). Die Empfehlung, Effort-Einstellungen an eigenen Evaluierungen zu vergleichen.
  5. Introducing Claude Haiku 4.5 (Anthropic, 15. Oktober 2025). Der Haiku-4.5-Preis von $1 und $5 pro Million Token.
  6. Introducing Claude Opus 4.5 (Anthropic, 24. November 2025). Die Aussage, klügere Modelle lösten Aufgaben in weniger Schritten.
  7. Introducing Claude Opus 5.5 (Anthropic, 22. September 2026). Das Hauptmodell in den Läufen 7 und 8.
  8. Introducing Claude Sonnet 5.5 (Anthropic, 28. September 2026). Das Modell, das in Lauf 8 die Feststellungen nachprüfte.
  9. Introducing Sonnet 4.6 (Anthropic, 17. Februar 2026). Das Modell, das in den Läufen 1 bis 7 die Feststellungen nachprüfte.
Wie dieser Beitrag entstanden ist

Wir bauen KI für die Beschaffung, da wäre es ein wenig seltsam, sie hier nicht zu nutzen. Dieser Beitrag ist gemeinsam entstanden: KI für das unermüdliche Lesen und die ersten Entwürfe, Menschen für das Urteil, die Korrekturen und das letzte Ja.

Zurueck zum Blog