OpenModels-Vergleich
Diese Version veröffentlicht keinen zusammengesetzten Intelligenzscore. Sie priorisiert Quellenzuordnung, getrennte Konfigurationen, ausdrücklich gekennzeichnete Datenlücken und eine nachvollziehbare Änderungshistorie.
Die kanonischen Modell-YAML-Dateien liefern Namen, Beschreibungen, Funktionen, ältere Modalitätsangaben, Kontextgrenzen, Lizenzen und Zeitstempel der Registerpflege. Anbieterzuordnungen liefern Bereitstellungsnamen, Regionen, Kontextüberschreibungen und veröffentlichte Preise. Registerzeitstempel sind Wartungsdaten — keine Veröffentlichungs- oder Messdaten eines Modells.
Unbekannte Werte bleiben unbekannt und werden niemals zu null. Kontextkapazität ist kein Qualitätsmaß. Anbieterangaben bleiben an eine Bereitstellung gebunden. Jede Preiszeile nennt Anbieter und Gültigkeitsdatum. Abgeleitete Entwickler- oder Familienzuordnungen werden gekennzeichnet, bis das Register kanonische Felder bereitstellt.
Die Standardansicht wählt die aktive Bereitstellung mit dem niedrigsten verfügbaren Eingabepreis, anschließend dem niedrigsten Ausgabepreis, und zeigt diesen Anbieter an. Ändert sich ein Registerpreis, wird der vorherige Datensatz mit effectiveTo beendet und eine neue Version angefügt. Währung sowie optionale Cache-, Batch-, Reasoning-, Bild- und Audiofelder bleiben getrennt.
Die Kosten pro Anfrage ergeben sich aus nicht zwischengespeicherten Eingabe-Tokens mal Eingaberate, plus zwischengespeicherten Tokens mal Cache-Leserate oder regulärer Eingaberate, plus Ausgabe-Tokens mal Ausgaberate, geteilt durch eine Million. Die Monatskosten multiplizieren diesen Wert mit der Anfragezahl. Gebühren für Werkzeuge, Bilder, Audio und nicht angegebene Reasoning-Tokens sind ausgeschlossen. Voreinstellungen sind anpassbare Workload-Annahmen, keine Benchmarks.
Ein Ergebnis wird nur mit exakter Modell- und Benchmarkversion, Wert und Einheit, Evaluationsmodus, Reasoning-Aufwand, Werkzeugkonfiguration, Quelle, Veröffentlichungs- und Prüfdatum sowie Methodikversion aufgenommen. Offizielle, unabhängige, Community- und gemessene Ergebnisse bleiben unterscheidbar. Unterschiedliche Konfigurationen werden nie stillschweigend zusammengeführt.
Vergleichbare Messungen müssen Modell und Anbieterbereitstellung nennen und Metrik, Einheit, Region, Prompttyp und -version, Stichprobengröße, Verteilungsstatistiken, Messdatum, Quelle, Methodikversion und Speicherort der Rohdaten erfassen. Die aktuelle Übersicht zeigt „Nicht gemessen“, bis diese Anforderungen erfüllt sind.
TTFT bezeichnet die Zeit vom Senden der Anfrage bis zum ersten gestreamten Token. Die Zeit bis zum ersten Antwort-Token schließt verborgenes Reasoning aus. Reasoning-Zeit, Eingabeverarbeitung, Anbieter-Overhead und Ende-zu-Ende-Antwortzeit werden als getrennte Metriken gespeichert. Sie sind nicht austauschbar und werden nur für vergleichbare Prompt- und Bereitstellungskonfigurationen gezeigt.
Fehlend, nicht bewertet, nicht gemessen, teilweise, veraltet und nicht verfügbar sind getrennte Zustände. Die Aktualität des Registers wird anhand einer Sieben-Tage-Anzeigerichtlinie geprüft; Preise sollten mindestens wöchentlich und bei Ankündigungen der Anbieter verifiziert werden. Veraltete Angaben bleiben mit Warnung und Datum sichtbar, statt erfunden oder gelöscht zu werden.
Korrekturen bewahren Verlauf und Quellenbelege. OpenModels veröffentlicht derzeit keinen zusammengesetzten Intelligenzscore. Dafür wäre eine öffentliche, versionierte Methodik für Aufnahme, Gewichtung, Normalisierung, Ausschlüsse und den Umgang mit Datenlücken erforderlich; Rohdaten müssten erhalten bleiben.
Das öffentliche Register enthält noch Lücken bei kanonischen Entwickler- und Familienangaben, Modalitätsrichtungen, Veröffentlichungsdaten, Lebenszyklus, kommerzieller Nutzung, strukturierten Ausgaben und lokaler Bereitstellung. Benchmarks und Anbieterleistungsdaten sind ebenfalls noch nicht ausreichend befüllt. Die Übersicht startet deshalb mit verlässlichen Registerdaten, Anbieterpreisen und Kontextangaben — nicht mit künstlichen Qualitätsbehauptungen.