Zum Inhalt springen

Die Plattform

Von Ihren Dokumenten zu einem System in Produktion.

Kein Modell, das in einem Notebook übergeben wird — ein gewartetes Produktivsystem. Jeder Schritt der Pipeline läuft in Ihrer Jurisdiktion, von der Datenaufbereitung bis zum Monitoring.

Pipeline

Sieben Schritte, eine Jurisdiktion.

01

Discovery & Compliance-Scoping

Wir kartieren den Use Case, die Datenquellen und den regulatorischen Rahmen (DSG/revDSG, DSGVO, EU AI Act) und definieren Erfolgsmetriken und Guardrail-Anforderungen von Anfang an.

02

Private, in-jurisdiktionale Datenaufbereitung

Dokumente werden dedupliziert, formatiert und in Trainings- und Evaluationssets aufgeteilt — dort, wo sie bereits liegen, mit einem dokumentierten Herkunftsnachweis. Nichts wird an einen externen Dienst gesendet. Die PII-Behandlung wird von Beginn an mitgeplant.

03

Fine-Tuning auf Apertus

Wir stimmen das offene Schweizer Apertus-Modell auf Ihrem Korpus fein ab, um Ihre Domäne, Terminologie, Formate und Aufgaben zu vermitteln — validiert gegen eine reine Retrieval-Baseline, mit voller Transparenz über Gewichte und Datenherkunft.

04

Agenten- & RAG-Orchestrierung

Agenten, Retrieval-Augmented Generation und Tool-Aufrufe in Ihre Systeme, damit Antworten in Ihren aktuellen Dokumenten verankert sind — mit Fundstellen — und das System Aufrufe gegen Ihre internen APIs ausführt.

05

Evaluation & Guardrails

Ein Use-Case-spezifisches Eval-Set, Sicherheits- und PII-Guardrails sowie Ausgabe-Constraints. Wir melden die Qualität gegen vereinbarte Metriken vor dem Go-live. Derselbe Harness erzeugte unsere öffentliche FINMA-Ablation.

06

Souveränes Deployment

Containerisiertes Deployment in Ihre Schweizer Cloud, auf Ihre eigene Hardware oder in Confidential-Compute-VMs (AMD SEV-SNP / Intel TDX mit Remote Attestation).

07

Monitoring & Iteration

Kontinuierliches Monitoring von Qualität, Drift und Nutzung, mit einer Wartungskadenz und einem Supportvertrag.

Architektur

Ihre Daten verlassen nie Ihre Jurisdiktion.

Eine einzige Vertrauensgrenze umschliesst alles — Daten, Modell und Orchestrierung. Es gibt keinen Round-Trip zu einer externen API.

  • Apertus-Kern
    Feinabgestimmtes offenes Schweizer LLM — offene Gewichte, auditierbar, Ihres zum Ausführen.
  • Agenten-Orchestrierung
    Zustandsbehaftete Agenten, Routing und Tool-Nutzung über Ihre Systeme (LangChain + LangGraph, produktionsgehärtet).
  • RAG-Schicht
    Retrieval über Ihre Wissensbasen, verankert und mit Fundstellen versehen.
  • Guardrails & Eval
    Sicherheits-, PII- und Qualitätsprüfungen, in der Produktion überwacht.
  • Souveräne Laufzeitumgebung
    On-Premise, Swiss Cloud oder Confidential Computing.

Modellagnostisch by design: standardmässig das vollständig schweizerische Apertus, oder eine europäische (Mistral) bzw. internationale (Llama, Qwen) Open-Weight-Basis, wo Ihre Compliance es erlaubt — was auch immer Ihre Evaluation gewinnt, alles auf Ihrer eigenen Infrastruktur. Siehe das Basismodell-Spektrum.

Wollen Sie die Tiefe hinter jeder Schicht? Die Konzeptseiten behandeln kleine Modelle, Quantisierung, Evaluation und die souveräne Laufzeitumgebung im Detail.

Architektur: Ihre Daten bleiben in Ihrer Jurisdiktion. sysf.io stimmt Apertus fein ab und orchestriert Agenten, Retrieval und Tools — ohne Daten an US-LLM-APIs von Drittanbietern zu senden.
US-LLM-API von Drittanbietern
Ihre Jurisdiktion
  • 01
    Ihre Daten
    Dokumente, Datensätze, Systeme — verlassen nie das Haus
  • 02
    Feinabgestimmtes Apertus
    Offenes Schweizer Modell, auf Ihrem Korpus trainiert
  • 03
    Agenten-Orchestrierung
    Agenten · RAG · Tools · Guardrails
  • 04
    Ihr Produkt
    Copiloten & Workflows — Ihres zum Ausführen

On-Premise · Swiss Cloud · Confidential Computing — kein Datenabfluss

Compliance

Compliance ist eine Architektur, kein Häkchen.

Schweizer DSG / revDSG

In-jurisdiktionale Verarbeitung und klare Datenherkunft halten personenbezogene Daten unter Schweizer Recht und Kontrolle.

EU-DSGVO

Datenminimierung, Zweckbindung und Datenresidenz sind für EU-Betriebe by design gelöst.

EU AI Act

Der Act klassifiziert nach Anwendungsrisiko und legt Transparenzpflichten dem Anbieter des Modells auf — er beschränkt eine Basis nicht nach Herkunftsland. Apertus geht am weitesten, mit öffentlich dokumentierten Trainingsdaten, die kein geschlossenes Modell bietet; welche Basis Sie auch wählen, wir ergänzen das Arbeitsblatt zur Risikoklassifizierung und die technische Dokumentation, die der Act verlangt.

Jedes Engagement wird mit dem Evaluationsbericht geliefert; das vollständige Compliance- & Audit-Paket — Model Card, Herkunftsnachweis der Trainingsdaten, AVV-Vorlage, TOM, Arbeitsblatt zur EU-AI-Act-Risikoklassifizierung — wird dort umrissen, wo Ihre Pflichten es verlangen. Dies ist keine Rechtsberatung — wir arbeiten mit Ihren Compliance- und Rechtsteams zusammen, um Ihre Pflichten zu erfüllen.

Was uns unterscheidet

Drei Wege zu souveräner KI — und was Sie tatsächlich erhalten.

sysf.io (Studio) Souveräne Plattform (gehosteter Endpunkt) US-Cloud-API (Schweizer Region)
Wo die Daten liegen Ihre Infrastruktur — on-prem, Ihre Tenancy oder air-gapped Das Schweizer Rechenzentrum des Anbieters Region des Anbieters, im US-Rechtszugriff
Modellgewichte Offen, auf Ihrem Korpus feinabgestimmt, auditierbar Geteiltes Basismodell, offen oder geschlossen Geschlossen, undurchsichtig
Wer Ihr Produkt baut Wir — umrissener Use Case, Eval-Plan, Lieferung Ihr Team, auf dessen Endpunkt Ihr Team, auf dessen API
Genauigkeit auf Ihrer Aufgabe Vor dem Go-live gegen Ihr Eval-Set gemessen Unbekannt, bis Sie bauen und testen Unbekannt, bis Sie bauen und testen
Eigentum & Exit Das Modell gehört Ihnen; Übergabe ist ein Lieferergebnis Abonnement — Zugang endet mit dem Vertrag Gemieteter Zugang
Compliance-Dokumentation Mit dem System geliefert Auf Plattformebene; Use-Case-Compliance liegt bei Ihnen Geteilte Verantwortung — grösstenteils bei Ihnen

Fairerweise gegenüber den Alternativen: Eine Managed-Plattform ist die richtige Antwort, wenn Sie ein KI-Engineering-Team haben und nur Infrastruktur wollen, und eine US-Cloud-API ist die richtige Antwort, wenn Ihre Daten das Haus verlassen dürfen. Wir sind die Antwort, wenn die Daten nicht weg dürfen und Sie das System gebaut, gemessen und übergeben haben wollen.

FAQ

Fragen zur Plattform.

Was ist der technische Stack?
Ein feinabgestimmtes Apertus-Modell im Kern, orchestriert mit LangChain und LangGraph für Agenten, Retrieval-Augmented Generation (RAG) über Ihr Wissen und Tool-Aufrufe in Ihre Systeme. Wir ergänzen Evaluations-Harnesses und Guardrails und deployen über Container in Ihre Schweizer Cloud, auf On-Premise-Hardware oder in ein Confidential-Compute-Enclave.
Machen Sie Fine-Tuning oder nur RAG?
RAG zuerst; Fine-Tuning dort, wo es sich lohnt. Retrieval verankert Antworten in Ihren aktuellen Dokumenten und liefert den grössten Teil der Genauigkeit. Fine-Tuning vermittelt die Terminologie, Formate und das Task-Verhalten Ihrer Domäne — es memoriert Fakten nicht zuverlässig, deshalb nutzen wir es nie als Ersatz für Retrieval. Jeder Pilot wird mit einer Ablation auf Ihrem Evaluationsset geliefert — Basismodell vs. RAG vs. Fine-Tune vs. beides — damit Sie genau sehen, was jede Komponente bringt, bevor Sie in die Produktion investieren.
Was erfordert On-Premise tatsächlich?
Weniger, als Sie denken. Ein quantisiertes, feinabgestimmtes Apertus-8B läuft mit interaktiver Geschwindigkeit auf einem einzelnen GPU-Server der Workstation-Klasse (grob 24–48 GB VRAM), der in Ihrem bestehenden Rack steht. Das 70B braucht einen Multi-GPU-Knoten oder eine Confidential-Compute-Instanz. Wir dimensionieren das Deployment beim Scoping und verpflichten uns auf Durchsatzzahlen — und ein Pilot kann auf Hardware laufen, die wir mitbringen, sodass Sie vor dem Wertnachweis nichts für Infrastruktur ausgeben.
Wie handhaben Sie Evaluation und Guardrails?
Das Evaluationsset wird aus Ihren Dokumenten erstellt und mit Ihren Fachleuten verifiziert — das FINMA-Set ist die Vorlage: 183 menschlich verifizierte Fragen, deterministisch bewertet, kein LLM als Richter. Guardrails (Sicherheit, PII, Ausgabe-Constraints) erhalten eigene Testfälle im selben Harness, mit vor dem Go-live gemeldeten und in der Produktion überwachten Erfolgsquoten.
Wo läuft es?
Wo immer Ihre Data-Governance es verlangt — Ihrer Schweizer oder EU-Cloud-Tenancy, Ihrem eigenen Rechenzentrum oder einer air-gapped Umgebung mit Confidential Computing (AMD SEV-SNP oder Intel TDX mit Remote Attestation). Was das bringt und den GPU-Vorbehalt dazu finden Sie auf der Seite zur souveränen Laufzeitumgebung. Nichts hängt von externen US-LLM-APIs ab.

Sehen Sie es auf Ihrem Use Case.

Bringen Sie einen wertvollen Workflow mit. Wir zeigen Ihnen die Pipeline end-to-end — auf Ihren Daten, in Ihrer Jurisdiktion.