Unsere Wahl
Unser IT-Support-Assistent läuft auf Qwen3.5-35B-A3B, einem offenen Modell (Apache-2.0-Lizenz), das wir selbst auf Schweizer Infrastruktur betreiben, statt es als Blackbox aus einer fremden Cloud zu beziehen. Wir kontrollieren das Modell, seine Konfiguration und den Ort der Verarbeitung.
Warum nicht das grösste Frontier-Modell von OpenAI oder Anthropic? Weil unsere Entscheidung auf Dingen beruht, die für einen Support-Assistenten zählen – und «am teuersten» keines davon ist.
Worauf es ankam – und wie wir gemessen haben
Wir haben einen wiederholbaren Benchmark auf unseren echten Support-Aufgaben gebaut, nicht auf generischen Leaderboards: für jedes Modell dieselben Fälle, vier Achsen.
- Werkzeug-Treffsicherheit – 23 Fälle in Deutsch, Französisch, Italienisch und Englisch: wählt das Modell die richtige Aktion mit gültigen Parametern, in der Sprache des Nutzers?
- Antwortqualität – bewertet durch ein unabhängiges, starkes Schiedsrichter-Modell (GPT-5.4).
- Verlässlichkeit – Anteil leerer oder fehlerhafter Antworten.
- Kosten (CHF pro 1 Mio. Tokens, Stand Juni 2026).


