Frag BIKI
ChatGPT 5.6 Modelle von OpenAI / Zugriff auf an der Techfak betriebene Modelle für alle Mitarbeitenden
Seit heute stehen in BIKI zwei Modelle der aktuellsten Sprachmodellfamilie 5.6 von OpenAI zur Auswahl: ChatGPT 5.6 Terra und Luna. OpenAI beschreibt diese Modelle selbst so:
- Terra: Ein ausgewogenes Modell für alltägliche Arbeit
- Luna: Das kosteneffizienteste Modell (der 5.6 Modellfamilie)
Das als Sol-bezeichnete Modell dieser Reihe haben wir wegen seiner hohen Kosten nicht in BIKI eingebunden. Die neuen Modelle sind auf Trainingsdaten erzeugt worden, die einen Wissensstand bis zum 16. Februar 2026 haben. Damit sind sie deutlich aktueller, als die bisher verfügbaren OpenAI Modelle. Trotzdem neigt wenigstens das kleine Luna-Modell durchaus zu Halluzinationen:
Das größere Terra-Modell ist hier möglicherweise 'ehrlicher', wenn es nicht über Wissen verfügt, zumindest kann man Antworten wie diese vielleicht so interpretieren:
Trotzdem gilt bei Wissensfragen an Sprachmodelle weiterhin, dass man sich im Zweifel nicht darauf verlassen darf, und die Antworten mit weiteren Quellen verifizieren muss.
Kosten steigen weiter
Bei den neuen Modellen zeigt sich der allgemeine Trend, dass die Nutzung von KI-Diensten allmählich teurer wird. So ist das günstigere Luna-Modell, welches man als Nachfolger der Mini-Modelle der vorherigen Modellfamilien einstufen kann, für uns im Vergleich teurer. Wer also schon bisher sein BIKI Monatskontingent nahezu aufgebraucht hat sollte beim Wechsel auf die neuen Modelle einmal im Blick behalten, wie sich der eigene Verbrauch entwickelt und ob der Qualitätsunterschied in den Antworten groß genug ist, einen Mehrverbrauch zu rechtfertigen.
Zugriff auf von der Techfak betriebene Sprachmodelle für alle Mitarbeitenden freigeschaltet
Als Alternative zu den kostenpflichtigen Modellen haben wir in BIKI von Anfang an die von der GWDG betriebenen, offenen Modelle angeboten. Nun stehen allen Mitarbeitenden zwei weitere Modelle zur Verfügung, die innerhalb der Universität von der Technischen Fakultät betrieben werden!
Der Zugriff auf den Inferenzserver der AG Wissensrepräsentation und Maschinelles Lernen der Technischen Fakultät unter Leitung von Prof. Dr. Benjamin Paaßen befindet sich aktuell in der Experimentalphase, aber nachdem die ersten Tests sehr gute Ergebnisse gezeigt haben, ist der Zugriff nur für alle Mitarbeitenden möglich. Hier stehen aktuell diese Modelle zur Verfügung: Qwen 3.6 und Gemma 4.
Die Antwortzeiten des Techfak Servers sind nach unseren Erfahrungen sehr schnell und die Modelle für die tägliche Arbeit gut nutzbar.
Offene Modelle ganz oben im MÖWE Ranking
Gemma 4 ist dabei aktuell das Top Modell im MÖWE Ranking der Bundesdruckerei. MÖVE steht für „Modelle für die öffentliche Verwaltung evaluieren" und die Bundesdruckerei hat es sich hier zum Ziel gesetzt einen großen Katalog an Modellen nach ihrer Performance in unterschiedlichen Einsatzbereichen zu bewerten.
Eine interessante Erkenntnis ist daraus: Es gibt nicht das eine Modell, welches in allen Kategorien eine überragende Leistung liefert. Und offene Modelle können in vielen Bereichen mit den kostenpflichtigen Modellen mithalten, oder werden sogar besser bewertet.