AI on Demandpowered by Swiss AI Initiative

Apertus — das vollständig offene Sprachmodell der Swiss AI Initiative: entwickelt von ETH Zürich, EPFL und CSCS, 8 Milliarden Parameter, über 1000 Sprachen. Modellgewichte, Trainingsdaten und Methoden sind vollständig dokumentiert — betrieben von stepping stone auf Schweizer Infrastruktur.

Apertus ist ein Sprachmodell, das im Rahmen der Schweizer KI-Initiative von ETH Zürich, EPFL und dem Swiss National Supercomputing Centre (CSCS) entwickelt wurde. Es ist vollständig offen — nicht nur die Modellgewichte, sondern auch die Trainingsdaten, der Code und die Methoden sind dokumentiert und reproduzierbar.

Mit 8 Milliarden Parametern und Unterstützung für über 1000 Sprachen ist Apertus ein vielseitiges Allzweckmodell für Text, Analyse und agentische Workflows. Es wurde gezielt so trainiert, dass es die Anforderungen des EU AI Act erfüllt: Opt-out-Wünsche werden respektiert, persönliche Daten entfernt, Memorierung vermieden. stepping stone betreibt Apertus auf Schweizer Infrastruktur — Schweizer KI, betrieben in der Schweiz.

Unternehmen, Behörden und Organisationen, die ein leistungsfähiges Sprachmodell brauchen und Wert auf maximale Transparenz, Compliance und digitale Souveränität legen. Besonders geeignet für regulierte Branchen und den öffentlichen Sektor.

Typische Einsatzbereiche: Textgenerierung, Zusammenfassung und Analyse in über 1000 Sprachen, agentische Workflows mit Tool-Anbindung, Assistenzsysteme für mehrsprachige Organisationen, KI-Anwendungen mit erhöhten Compliance-Anforderungen (EU AI Act, Datenschutz).

Vollständig offen (Apache 2.0). Schweizer Forschung. Schweizer Rechenzentren. EU AI Act-konform.

Apertus ist das einzige vollständig offene Sprachmodell aus Schweizer Forschung — entwickelt von ETH Zürich, EPFL und CSCS. Über 1000 Sprachen, 65'536 Token Kontextfenster, Tool-Unterstützung für agentische Workflows. Trainiert auf 15 Billionen Tokens mit vollständig dokumentierten Daten und Methoden. Persönliche Beratung und Betrieb durch stepping stone aus Bern.

 

Legende

  • Successful requests: Erfolgreiche Prompt Anfragen
  • Failed requests: Nicht erfolgreiche Prompts
  • Maximum request concurrency: Wie viele Anfragen verarbeitet das Model gleichzeitig.
  • Benchmark duration (s): Die Dauer des Benchmarkdurchlaufs in Sekunden.
  • Total input tokens: Die Gesamtanzahl der eingegeben Tokens.
  • Total generated tokens: Die Summe der vom Modell generierten Tokens.
  • Request throughput (req/s): Die Anzahl Anfragen welche pro Sekunde verarbeitet werden.
  • Output token throughput (tok/s): Die durchschnittliche Anzahl der Tokens, welche pro Sekunde generiert werden.
  • Peak output token throughput (tok/s): Die maximale gemessene Anzahl der Output tokens pro Sekunde.
  • Peak concurrent requests: Die maximale gemessene Anzahl der gleichzeitig verarbeiteten Anfragen.
  • Total token throughput (tok/s): Der Durchschnitt aller verarbeiteten Tokens während der Messung.
  • Mean End-to-End Latency (E2EL) (ms): Die durchschnittliche Zeit, in Millisekunden, die eine vollständiger Request-Response-Zyklus von Eingabe bis Antwort dauert.
  • Median E2EL (ms): Die zuerwartende Zeit zwischen um eine Antwort vollständig zu generieren und zurückzugeben.
  • p99 E2EL (ms): Der p99 E2EL ist die langsamste 99 % der Antwortzeiten.
  • Tokenizer: Der Tokenizer wird benutzt, um dem gemessenen Modell während einem Benchmark Anfragen zu übermitteln. Das sind in der Regel öffentliche kleine Modelle, wie zum Beispiel Qwen/Qwen2.5-7B-Instruct.

Einsatzgebiete

Compliance & Regulierung

Apertus ist das einzige vollständig offene Sprachmodell, das von Grund auf für EU AI Act-Konformität entwickelt wurde.

Behörden und regulierte Unternehmen setzen es dort ein, wo Transparenz, Nachvollziehbarkeit und Datenschutz nicht verhandelbar sind. Opt-out-Wünsche werden respektiert, persönliche Daten entfernt, Memorierung aktiv vermieden.

Mehrsprachige Anwendungen

Mit über 1000 Sprachen und 65'536 Token Kontextfenster deckt Apertus nahezu jeden mehrsprachigen Einsatz ab.

Organisationen mit internationalen Teams oder mehrsprachigen Dokumentenbeständen nutzen es für Textgenerierung, Zusammenfassung und Analyse. Tool-Unterstützung ermöglicht agentische Workflows — vollständig offen, reproduzierbar und auf Schweizer Infrastruktur betrieben.

Preise

ModellKontextlängeInput/MTokOutput/MTok
Apertus-v1.5-8B256k0.12000.5800
Alle Preise in CHF/MTok exkl. Mehrwertsteuer.