Vai al contenuto

La piattaforma

Dai vostri documenti a un sistema in produzione.

Non un modello consegnato in un notebook — un sistema in produzione mantenuto. Ogni passo della pipeline viene eseguito nella vostra giurisdizione, dalla preparazione dei dati al monitoraggio.

Pipeline

Sette passi, una giurisdizione.

01

Discovery & definizione della conformità

Mappiamo il caso d'uso, le fonti di dati e il quadro normativo (LPD/nLPD, GDPR, AI Act), e definiamo fin dall'inizio le metriche di successo e i requisiti dei guardrail.

02

Preparazione dei dati, privata e in giurisdizione

I documenti vengono deduplicati, formattati e suddivisi in set di addestramento e valutazione dove già risiedono, con un registro documentato di tracciabilità. Nulla viene inviato a un servizio esterno. Il trattamento delle PII è progettato fin dal principio.

03

Ottimizzazione su Apertus

Ottimizziamo il modello aperto svizzero Apertus sul vostro corpus per insegnare il vostro dominio, terminologia, formati e compiti — validato rispetto a una baseline con solo retrieval, con piena trasparenza su pesi e tracciabilità dei dati.

04

Orchestrazione di agenti & RAG

Agenti, generazione aumentata dal retrieval e chiamate di strumenti verso i vostri sistemi, così le risposte sono ancorate ai vostri documenti attuali — con citazioni — e il sistema esegue chiamate verso le vostre API interne.

05

Valutazione & guardrail

Un set di valutazione specifico per il caso d'uso, guardrail di sicurezza e PII, e vincoli di output. Riportiamo la qualità rispetto alle metriche concordate prima del go-live. Lo stesso harness ha prodotto la nostra ablazione FINMA pubblica.

06

Deployment sovrano

Deployment containerizzato nel vostro cloud svizzero, sul vostro hardware, o su VM di confidential computing (AMD SEV-SNP / Intel TDX con attestazione remota).

07

Monitoraggio & iterazione

Monitoraggio continuo di qualità, drift e utilizzo, con una cadenza di manutenzione e un contratto di supporto.

Architettura

I vostri dati non lasciano mai la vostra giurisdizione.

Un unico confine di fiducia racchiude tutto — dati, modello e orchestrazione. Non c'è alcun round-trip verso un'API esterna.

  • Nucleo Apertus
    LLM aperto svizzero ottimizzato — pesi aperti, verificabili, vostri da eseguire.
  • Orchestrazione di agenti
    Agenti con stato, routing e uso di strumenti sui vostri sistemi (LangChain + LangGraph, irrobustiti per la produzione).
  • Livello RAG
    Retrieval sulle vostre basi di conoscenza, ancorato e citato.
  • Guardrail & valutazione
    Controlli di sicurezza, PII e qualità, monitorati in produzione.
  • Runtime sovrano
    On-premise, cloud svizzero, o confidential computing.

Agnostico rispetto al modello by design: l'Apertus interamente svizzero di default, o una base aperta europea (Mistral) o internazionale (Llama, Qwen) dove la vostra conformità lo consente — quella che vince la vostra valutazione, tutto sulla vostra infrastruttura. Vedi lo spettro dei modelli di base.

Volete la profondità dietro ogni livello? Le pagine dei concetti trattano in dettaglio i modelli piccoli, la quantizzazione, la valutazione e il runtime sovrano.

Architettura: i vostri dati restano nella vostra giurisdizione. sysf.io ottimizza Apertus e orchestra agenti, retrieval e strumenti, senza inviare dati ad API LLM statunitensi di terze parti.
API LLM statunitense di terze parti
La vostra giurisdizione
  • 01
    I vostri dati
    Documenti, archivi, sistemi — non escono mai
  • 02
    Apertus ottimizzato
    Modello aperto svizzero, addestrato sul vostro corpus
  • 03
    Orchestrazione di agenti
    Agenti · RAG · strumenti · guardrail
  • 04
    Il vostro prodotto
    Copiloti & workflow — vostro da eseguire

On-premise · Cloud svizzero · Confidential computing — nessuna fuoriuscita di dati

Conformità

La conformità è un'architettura, non una casella da spuntare.

LPD / nLPD svizzera

Il trattamento in giurisdizione e una chiara tracciabilità dei dati mantengono i dati personali sotto il diritto e il controllo svizzeri.

GDPR europeo

Minimizzazione dei dati, limitazione delle finalità e residenza, gestite by design per le operazioni nell'UE.

AI Act europeo

Il regolamento classifica in base al rischio d'uso e impone doveri di trasparenza al fornitore del modello — non limita una base in base al paese d'origine. Apertus va oltre tutti, con dati di addestramento documentati pubblicamente che nessun modello chiuso offre; qualunque base scegliate, aggiungiamo il foglio di classificazione del rischio e la documentazione tecnica che l'Act richiede.

Ogni ingaggio è consegnato con il rapporto di valutazione; il pacchetto completo di conformità & audit — model card, registro di tracciabilità dei dati di addestramento, modello di DPA, MTO, foglio di classificazione del rischio AI Act — è definito dove i vostri obblighi lo richiedono. Questo non è un parere legale — collaboriamo con i vostri team di conformità e legali per soddisfare i vostri obblighi.

Cosa ci distingue

Tre modi per ottenere un'IA sovrana — e cosa ricevete davvero.

sysf.io (studio) Piattaforma sovrana (endpoint gestito) API cloud statunitense (regione svizzera)
Dove risiedono i dati La vostra infrastruttura — on-prem, il vostro cloud, o air-gapped Il data center svizzero del fornitore Regione del fornitore, sotto la portata legale statunitense
Pesi del modello Aperti, ottimizzati sul vostro corpus, verificabili Modello di base condiviso, aperto o chiuso Chiusi, opachi
Chi costruisce il vostro prodotto Noi — caso d'uso definito, piano di valutazione, consegna Il vostro team, sul loro endpoint Il vostro team, sulla loro API
Accuratezza sul vostro compito Misurata rispetto al vostro set di valutazione prima del go-live Ignota finché non costruite e testate Ignota finché non costruite e testate
Proprietà & uscita Il modello è vostro; il passaggio di consegne è un deliverable Abbonamento — l'accesso finisce con il contratto Accesso in affitto
Documentazione di conformità Consegnata con il sistema A livello di piattaforma; la conformità del caso d'uso è vostra Responsabilità condivisa — perlopiù vostra

Per essere onesti verso le alternative: una piattaforma gestita è la risposta giusta se avete un team di ingegneria IA e volete solo l'infrastruttura, e un'API cloud statunitense è la risposta giusta se i vostri dati possono uscire. Noi siamo la risposta quando i dati non possono uscire e volete il sistema costruito, misurato e consegnato.

FAQ

Domande sulla piattaforma.

Qual è lo stack tecnico?
Un modello Apertus ottimizzato al centro, orchestrato con LangChain e LangGraph per gli agenti, la generazione aumentata dal retrieval (RAG) sulle vostre conoscenze, e la chiamata di strumenti verso i vostri sistemi. Aggiungiamo harness di valutazione e guardrail, e distribuiamo tramite container nel vostro cloud svizzero, su hardware on-premise, o in un'enclave di confidential computing.
Fate ottimizzazione o solo RAG?
Prima il RAG; l'ottimizzazione dove si ripaga. Il retrieval àncora le risposte ai vostri documenti attuali ed è da lì che proviene la maggior parte dell'accuratezza. L'ottimizzazione insegna la terminologia, i formati e il comportamento di compito del vostro dominio — non memorizza i fatti in modo affidabile, quindi non la usiamo mai come sostituto del retrieval. Ogni Pilot è consegnato con un'ablazione sul vostro set di valutazione — modello di base vs. RAG vs. ottimizzazione vs. entrambi — così vedete esattamente cosa apporta ogni componente prima di investire in produzione.
Cosa richiede davvero l'on-premise?
Meno di quanto pensiate. Un Apertus-8B ottimizzato e quantizzato viene eseguito a velocità interattiva su un singolo server GPU di classe workstation (all'incirca 24–48 GB di VRAM) che risiede nel vostro rack esistente. Il 70B richiede un nodo multi-GPU o un'istanza di confidential computing. Dimensioniamo il deployment durante la definizione del perimetro e ci impegniamo su cifre di throughput — e un Pilot può girare su hardware che portiamo noi, così non spendete nulla in infrastruttura prima che il valore sia dimostrato.
Come gestite valutazione e guardrail?
Il set di valutazione è costruito dai vostri documenti e verificato con i vostri esperti — il set FINMA è il modello: 183 domande verificate da esseri umani, valutate in modo deterministico, nessun giudice LLM. I guardrail (sicurezza, PII, vincoli di output) ottengono i propri casi di test nello stesso harness, con tassi di superamento riportati prima del go-live e monitorati in produzione.
Dove viene eseguito?
Ovunque lo richieda la vostra data governance — il vostro cloud svizzero o UE, il vostro data center, o un ambiente air-gapped con confidential computing (AMD SEV-SNP o Intel TDX con attestazione remota). Cosa apporta, e la relativa riserva sulla GPU, è sulla pagina del runtime sovrano. Nulla dipende da API LLM statunitensi esterne.

Vedetelo sul vostro caso d'uso.

Portate un workflow ad alto valore. Vi mostreremo la pipeline end-to-end — sui vostri dati, nella vostra giurisdizione.