Wie man ein Modell wählt — und warum das nicht die erste Entscheidung ist
Die richtige Richtung
Scheitert selbst das starke Modell, haben Sie günstig entdeckt, dass das Problem nicht die Modellwahl ist, sondern Aufgabendefinition, Daten oder Prompt. Gelingt es, haben Sie eine Qualitätsbasis, und nun kann man absteigen und den Punkt finden, an dem die Qualität unter Ihre Latte fällt.
Vier Achsen
Qualität bei Ihrer Aufgabe — nicht bei öffentlichen Tabellen, die andere Aufgaben testen.
Kosten je Vorgang — vor allem vom eingehenden Text getrieben, nicht vom ausgehenden.
Geschwindigkeit — kritisch in einer Live-Oberfläche, fast irrelevant bei Hintergrundverarbeitung.
Wo die Daten laufen — eine Frage von Regulierung und Risiko, nicht von Qualität.
Wann trainieren
Fast immer nicht, und nicht am Anfang. Prompt-Verbesserung, gute Beispiele und die Anbindung an die richtige Informationsquelle lösen die meisten Lücken. Feinabstimmung lohnt sich, wenn Sie tausende Qualitätsbeispiele haben und das Ziel ist, Kosten oder Antwortzeit zu senken.
Im Detail
Umhüllen Sie den Modellaufruf mit einer Schicht, die Sie kontrollieren, damit ein Anbieterwechsel eine Konfigurationsänderung ist. Und halten Sie ein Protokoll je Aufruf — Modell, Prompt-Version, Textmengen und Zeit — sonst werden Fragen wie „wann fiel die Qualität“ unbeantwortbar.