LLMBUS Pilotplatz vormerken

Belege · Stand 25. Juli 2026

Benchmarks & Belege

Auf der Startseite steht, dass auf dem Bus ein offenes Modell der Spitzenklasse läuft. Das ist eine nachprüfbare Aussage — hier stehen die Zahlen dahinter, mit Datum und Quelle, samt der Disziplinen, in denen das Modell verliert. Wenn eine dieser Zahlen veraltet ist, sagen Sie uns bitte Bescheid: kontakt@llm-bus.de.

Kimi K2.6 gegen das geschlossene Spitzenmodell

Beide Modelle im Stand April 2026. K2.6 ist das Modell, das auf dem Starter-Bus läuft; GPT-5.5 war zu diesem Zeitpunkt OpenAIs Spitzenmodell.

BenchmarkWas er misstKimi K2.6GPT-5.5Ergebnis
SWE-bench Pro reale Software-Aufgaben, agentisch gelöstProgrammieren58,658,6gleichauf
DeepSearchQA Recherche über viele Quellen hinwegRecherche92,578,6K2.6 vorn
HLE, mit Werkzeugen schwere Fachfragen, Tool-Nutzung erlaubtFachwissen54,052,2K2.6 vorn
GPQA Diamond Naturwissenschaft auf PromotionsniveauFachwissen90,593,6GPT-5.5 vorn
HLE, ohne Werkzeuge dieselben Fragen, ohne HilfsmittelFachwissen34,741,4GPT-5.5 vorn

Was diese Zahlen nicht sagen

Modellgröße gegen die On-Prem-Appliance

Der Vergleich, der auf der Startseite steht — hier mit den konkreten Angaben. Beide laufen auf derselben GPU-Familie.

SystemModellParameterGPUs
Fujitsu Private GPT die bekannteste On-Prem-Appliance am deutschen MarktMistral Small 3.224 Mrd.1× RTX PRO 6000
LLM BUS StarterKimi K2.61.000 Mrd. davon 32 Mrd. pro Anfrage aktiv (MoE)8× RTX PRO 6000

Dieselbe Hardware-Familie, rund das 40-fache Modell. Angaben zu Fujitsu aus dem öffentlichen Private-GPT-Whitepaper; Preise veröffentlicht Fujitsu nicht.

Geschwindigkeit — was gemessen ist und was gerechnet

Wir trennen das bewusst, weil der Unterschied im Verkaufsgespräch regelmäßig verwischt wird.

AngabeKonfigurationDurchsatzStatus
Referenz-Benchmark veröffentlichte Messung auf fremder HardwareKimi K2.5 auf 8× NVIDIA B300~1.900 Tok/s aggregiertgemessen — aber nicht unsere Konfiguration
Starter-Bus unsere KonfigurationKimi K2.6 INT4 auf 8× RTX PRO 6000~20–40 Tok/s je Nutzer
~400–1.000 Tok/s bei 32–64 Sitzungen
gerechnet, noch nicht gemessen

Modelle und Lizenzen

Quellen

Diese Seite lädt nichts von Drittservern; die Links öffnen erst, wenn Sie sie anklicken. Letzte Aktualisierung: 25. Juli 2026.

Pilotplatz vormerken