Vergleichskriterien festlegen
Der Arbeitsauftrag lautet, Modelle nach Qualität, Geschwindigkeit, Kosten und Aufgabe einzuordnen. Dafür werden Zweck, Owner und zulässiger Betriebsrahmen vor dem ersten Test festgelegt.
Für die fachliche Prüfung werden folgende Punkte dokumentiert: eine feste Teststichprobe und aktuell verifizierte Modell- und Preisdaten. Annahmen und fehlende Informationen bleiben im Ergebnis sichtbar.
Mit derselben Aufgabe vergleichen
- Eine feste Stichprobe aus den vorgesehenen Aufgaben und fachliche Bewertungskriterien auswählen.
- Verfügbare Modelle und relevante Preisinformationen anhand offizieller Quellen mit Prüfdatum erfassen.
- Die Kandidaten mit denselben Eingaben testen und Qualität, Geschwindigkeit sowie Kostenannahmen dokumentieren.
- Die Auswahl für den konkreten Zweck begründen und einen Anlass zur erneuten Prüfung festlegen.
Die Auswahl nachvollziehbar begründen
Ein Vergleichsprotokoll enthält dieselben Eingaben je Kandidat, die fachliche Bewertung der Antworten, gemessene Bearbeitungszeiten und die datierte Kostenannahme. Die Gewichtung der Kriterien ist nachvollziehbar.
Zu vermeiden: alte Modellnamen oder Benchmarkwerte als dauerhafte Wahrheit. Ohne aktuelle Modell- und Preisdaten oder eine repräsentative Arbeitsprobe lässt sich kein belastbarer Gewinner für den betrieblichen Einsatz bestimmen.
Modellauswahl: Stand September 2026
Die aktuelle Anthropic-Modellübersicht führt Fable 5.1 neben Opus 5, Sonnet 5 und Haiku 4.5. Die passende Wahl ergibt sich aus Aufgabe, erreichbarer Qualität, Nacharbeit, Laufzeit und Kosten. Der separate Beitrag zu Fable 5.1 beschreibt, wie ein anspruchsvoller Teilprozess gegen die bestehende Lösung getestet wird. Ein Modellname allein ist keine allgemeine Beschaffungsempfehlung.
Entscheidungsmatrix
| Prüfpunkt | Weiter, wenn | Stoppen, wenn |
|---|---|---|
| Vergleichsgrundlage | Dokumentiert: eine feste Teststichprobe und aktuell verifizierte Modell- und Preisdaten. | Scope, Daten oder Verantwortung sind noch ungeklärt. |
| Aufgabentest | Ein Vergleichsprotokoll enthält dieselben Eingaben je Kandidat, die fachliche Bewertung der Antworten, gemessene Bearbeitungszeiten und die datierte Kostenannahme. Die Gewichtung der Kriterien ist nachvollziehbar. | Es liegt nur eine unbewertete Demo ohne Abnahmenachweis vor. |
| Entscheidungsgrenze | Owner, Freigabe, Ersatzweg und nächster Prüftermin sind festgelegt. | Zu vermeiden: alte Modellnamen oder Benchmarkwerte als dauerhafte Wahrheit. Ohne aktuelle Modell- und Preisdaten oder eine repräsentative Arbeitsprobe lässt sich kein belastbarer Gewinner für den betrieblichen Einsatz bestimmen. |
Nachvollziehbar bleiben
Primärquellen
- Claude SonnetQuellenstand:
- Claude EnterpriseQuellenstand:
- Anthropic: commercial data and trainingQuellenstand:
- Anthropic: Remote MCP connectorsQuellenstand:
- Anthropic: Claude model overviewQuellenstand:
- Anthropic: Claude API pricingQuellenstand:
- Claude Fable 5.1 model overviewQuellenstand:
- Claude models overviewQuellenstand:



