SMT 6.1 — Private AI Power für Unternehmen, die Kontrolle, Leistung und Skalierung brauchen.
Eine skalierbare Enterprise-KI-Infrastruktur für private Cloud, agentische Workflows, lange Kontextverarbeitung und hochperformante LLM-Anwendungen — betrieben auf dedizierter GPU-Leistung statt limitierten Standard-Abos.
Individuelle technische Prüfung gemäss AGB
Swiss Modern Technologies.
SMT ist der Technologie-Arm von Swiss Marketer. Unsere Überzeugung: Schweizer Unternehmen sollen moderne KI nicht auf Dauer mieten müssen wie ein fremdes Abo — sie sollen sie als eigene Infrastruktur betreiben und kontrollieren. Daran bauen wir: Schritt für Schritt, Werkzeug für Werkzeug, mit Schweizer Anspruch an Präzision, Datenschutz und Verlässlichkeit. SMT 6.1 ist der aktuelle Stand dieser Arbeit — nicht ihr Ende.
Standard-KI ist stark. Aber nicht für jedes Unternehmen genug.
Begrenzte Kontrolle
Infrastruktur, Modellverhalten und Datenflüsse liegen beim Anbieter — nicht bei Ihnen.
Begrenzte Skalierung
Token-Limits, Rate-Limits und geteilte Kapazität bremsen genau dann, wenn Last entsteht.
Begrenzte Integration
CRM, Telefonie, Datenbanken und interne Systeme bleiben aussen vor — KI arbeitet isoliert.
Begrenzter Datenschutz
Sensible Unternehmensdaten in geteilten Umgebungen — Standort und Optionen oft nicht wählbar.
Private Cloud statt Standard-Abo.
- Zugang: geschützter Workspace mit Zugriffskontrollen, Rollen und Logging.
- Transport: durchgehend verschlüsselt (TLS); private Datenräume pro Kunde.
- Freischaltung: jede Instanz durchläuft vor Übergabe ein Security-Audit.
- Training: Ihre Daten werden nicht für Modelltraining verwendet — vertraglich zugesichert (Details in den AGB).
Advanced Protection ist projektabhängig und gegen Aufpreis auf Anfrage verfügbar.
Eigene GPU-Instanzen statt geteilter Kapazität — Leistung, die für Sie reserviert ist.
Datenstandort nach Projektanforderung — abhängig von Verfügbarkeit und Region.
Ihr Unternehmenswissen als privater, durchsuchbarer Datenraum.
Agenten und Automationen, die exakt auf Ihre Prozesse zugeschnitten sind.
Kosten und Kapazität folgen dem Bedarf — nicht künstlichen Nutzungslimits.
Mehr Transparenz darüber, wohin Daten fliessen und wie sie verarbeitet werden.
Anbindung an CRM, Website, Datenbanken und Telefonie möglich.
Erweiterte Schutzmassnahmen als optionales, projektabhängiges Modul.
Dedizierte Infrastruktur ausschliesslich für Ihr Unternehmen — kein Shared-Tenant, keine Vermischung.
Standortwahl nach DSG, revDSG und Ihren Compliance-Anforderungen — mehrere EU-Rechenzentren wählbar.
Feingranulare Berechtigungen pro Nutzer, Team und Mandant — Principle of Least Privilege.
RBAC mit definierbaren Rollen — wer was sehen, ändern oder freigeben darf, legen Sie fest.
TLS 1.3 in Transit, AES-256 at Rest — durchgängig verschlüsselt bis auf die Datenbank.
Ihre firmeneigenen Dokumente und Daten bleiben isoliert — kein Einfluss in fremde Modelle.
Strikte Trennung auf Mandanten- oder Prozessebene — relevant für Multi-Team-Setups.
Vollständige Audit-Trails, Zugriffs- und Nutzungsprotokolle für Nachvollziehbarkeit.
Pentests, Audits und QS-Massnahmen nach Absprache — dokumentiert und zertifizierbar.
SSO/SAML, dedizierte SLAs, Zero-Trust-Stack und individuelle Härtung auf Anfrage.
Betriebsmodelle — von dedizierter Instanz bis AI Factory
SMT 6.1 lässt sich in verschiedensten Betriebsmodellen deployen: von einer einzelnen dedizierten Instanz über Multi-Region-Setups bis hin zu air-gapped Private Cloud oder hybriden Umgebungen. Mit Load Balancing, Auto-Scaling, Backup, Disaster Recovery und dedizierten SLAs.
Eine dedizierte GPU-Instanz für einen Mandanten — einfach, isoliert, schnell verfügbar.
Verteilung über mehrere Regionen — inklusive mehrerer EU-Standorte nach Verfügbarkeit.
Vollständig isolierte Infrastruktur für maximale Kontrolle und Datenschutz.
Kombinationen aus On-Premise und Cloud nach Ihren Compliance-Anforderungen.
Automatische Lastverteilung und Skalierung je nach Workload und Anfrage-Last.
Regelmässige Backups, Disaster Recovery und dedizierte Service-Level-Agreements. SLA gemäss AGB nur bei ausdrücklicher schriftlicher Vereinbarung.
Eine Infrastruktur. Viele Unternehmensprozesse.
Leads bewerten, Follow-ups vorbereiten, Pipeline-Aktionen priorisieren.
Anfragen verstehen, Antworten entwerfen, Fälle strukturieren und eskalieren.
Kampagnen-Assets, Varianten und Analysen in Serie produzieren.
Grosse Dokumentenbestände lesen, extrahieren, vergleichen und zusammenfassen.
Gespräche transkribieren, auswerten und mit Aktionen verknüpfen.
Firmenwissen als privater Assistent — Antworten aus eigenen Datenräumen.
Belege strukturieren, Berichte vorbereiten, Verwaltungsprozesse entlasten.
Exposés, Analysen und Beratungsunterlagen datenbasiert erstellen.
// SMT 6.1 Workspace — angemeldet · Instanz: dediziert · Standort: EU Sie: Analysiere die 12 angehängten Verträge und markiere alle Abweichungen von unserem Standard-Rahmenvertrag. SMT 6.1: Verarbeite 12 Dokumente parallel … 4 Abweichungen gefunden — Details mit Fundstellen: …
Alle Code- und Konfigurationsbeispiele sind illustrativ und können vom finalen Produkt abweichen.
KI-Agenten in Echtzeit skalieren — mit Kontrolle.
Mit SMT 6.1 können mehrere KI-Agenten parallel arbeiten: analysieren, schreiben, prüfen, strukturieren, klassifizieren, priorisieren, antworten und Aktionen vorbereiten. SMT 6.1 ermöglicht parallel skalierbare Agenten-Workflows für komplexe Unternehmensaufgaben — mit flexibler Multi-GPU-Rechenleistung für hohe Lastspitzen.
Wie viele Agenten gleichzeitig arbeiten können, hängt von Hardware, Modellkonfiguration, Datenstruktur, Workload und Antwortzeit-Ziel ab und wird pro Projekt ausgelegt. *Details gemäss AGB und individueller technischer Prüfung.
SMT 6.1 orchestriert spezialisierte KI-Agenten parallel — jeder mit definiertem Aufgabenbereich, festen Guardrails und rollenbasierter Tool-Zugriffssteuerung. Hochriskante Aktionen lösen einen Human-in-the-Loop-Freigabeprozess aus; alle Schritte landen im Audit-Trail. Budget- und Parallelitäts-Limits verhindern Kosten- und Lastspitzen.
Guardrails & Rollen
Jeder Agent darf nur seine freigegebenen Tools und Daten nutzen — definiert über Rollen.
Human-in-the-Loop
Kritische Aktionen werden vor der Ausführung zur Freigabe vorgelegt — nie ohne Kontrolle.
Audit Trail
Alle Agenten-Aktionen, Tool-Aufrufe und Entscheidungen werden nachvollziehbar protokolliert.
Budget & Limits
Kosten- und Parallelitäts-Kontingente pro Team oder Agent schützen vor Überlastung.
Heute angefragt — in Tagen produktiv.
Kein monatelanges Infrastrukturprojekt: Wir provisionieren Ihre dedizierte SMT-6.1-Instanz, härten sie und übergeben den geschützten Zugang — Sie legen direkt los.
Sizing-Gespräch
Anwendungsfall, Datenlage, Sicherheitsanforderungen — daraus definieren wir GPU-Stufe, Betriebsmodus und Standort (EU).
Provisionierung & Härtung
Dedizierte Instanz, TLS, Zugriffskontrollen, Security-Audit — komplett done-for-you. Kein Bastelset, kein eigenes Ops-Team nötig.
Loslegen & skalieren
Geschützter Workspace ab Tag 1. Mehr GPUs, mehr Agenten, mehr Kontext — jederzeit zubuchbar, ohne Migration.
*Abhängig von GPU-Verfügbarkeit, Region und Projektumfang.
So arbeiten Sie mit Ihrer Instanz.
Wir richten Ihre private Instanz ein und übergeben Ihnen die Zugangsschlüssel. Danach sprechen Ihre Systeme direkt mit Ihrer KI — über eine Schnittstelle, die dem Standard von OpenAI entspricht. Das heisst: bestehende Programme und Werkzeuge funktionieren meist ohne Umbau, es ändert sich nur die Adresse und der Schlüssel.
Schnittstelle für Ihre Systeme
Ihre Software fragt die KI direkt an — laufend mitlesende Antworten, Anbindung eigener Funktionen, Antworten in festem Datenformat und ein Modus, in dem die KI mehrere Arbeitsschritte selbst abarbeitet.
Übersicht im Kundenportal
In Ihrem Portal sehen Sie den Zustand Ihrer Instanz: ob sie läuft, welches Sicherheits-Niveau eingestellt ist und wie viele Anfragen pro Minute möglich sind.
Schlüssel & Grenzen
Wir legen die Zugangsschlüssel an, vergeben pro Schlüssel nur die nötigen Rechte, setzen Tages-Kontingente und können jeden Schlüssel sofort sperren. Jeder Schlüssel gilt ausschliesslich für Ihre Instanz.
Einrichtung, Schlüsselvergabe und Rechte laufen als betreute Leistung über Swiss Marketer — es gibt bewusst keine Selbstbedienung, damit Zugänge nachvollziehbar bleiben. Eine Desktop-Anwendung (SMT Studio) wird derzeit intern eingesetzt und ist noch nicht Teil des Kundenangebots.
Von einzelner GPU-Maschine bis skalierbarer AI Factory.
H100 SXM
Für performante LLM-Anwendungen, interne Assistenten, Automationen und produktive Workloads.
H100 NVL
Für grössere Modelle, stärkere Inferenzleistung und anspruchsvollere Multi-User-Systeme.
H200
Für speicherintensive Workloads, lange Kontexte, grössere Modelle und datenintensive Anwendungen.
B200
Für sehr hohe Parallelisierung, Multi-Agent-Systeme, grosse Enterprise-Modelle und komplexe Workloads.
B300
Für maximale Enterprise-Skalierung, agentische Parallelverarbeitung, grosse Kontextarchitekturen und leistungsintensive AI-Factories.
Verfügbarkeit, Standort, Preise und konkrete Leistungswerte können je nach Provider, Region, Kapazität und Projektanforderung variieren.
Mehrere GPU-Maschinen können kombiniert werden, um parallele Agenten, verteilte Inferenz, RAG-Pipelines, hohe Nutzerlast und punktuelle Rechenleistung abzudecken.
Kosten nach Rechenleistung — nicht nach künstlichen Nutzungslimits.
Inference Setup
- Interne Assistenten
- Chatbots
- Einfache Automationen
- Produktive LLM-Anwendungen
Agentic Business Setup
- Mehrere Agenten & Workflows
- Knowledge Bases
- RAG-Systeme
- Operative Automationen
Enterprise AI Factory
- GPU-Cluster & mehrere Maschinen
- Grosse Nutzerlast
- Agentische Parallelverarbeitung
- Dedizierte Schutzarchitektur
Preise auf Anfrage. EU-Hosting je nach Standort und Verfügbarkeit wählbar. Advanced Protection gegen Aufpreis auf Anfrage.
Preis auf AnfrageSetup + Rechenleistung — Kosten und Kapazität folgen dem Bedarf.
Setup anfragenSMT 6.1 im Detail — die Architektur hinter der Leistung.
SMT 6.1 ist ein grosses Sprachmodell der neuesten Generation, agentisch optimiert und als private Infrastruktur betrieben — mit hybrider Reasoning-Architektur, effizientem Expertenrouting und zwei umschaltbaren Betriebsmodi.
Direkt antworten
Die KI antwortet ohne vorgeschalteten Denkschritt — passend für Assistenten, Automationen und alles, was schnell zurückkommen soll.
Erst denken, dann antworten
Die KI arbeitet die Aufgabe sichtbar in mehreren Schritten durch, bevor sie antwortet — für komplexe Analysen, grosse Dokumentbestände und mehrstufige Agenten-Ketten. Umschaltbar bei jeder einzelnen Anfrage.
*Orientierungswerte — abhängig von Hardware, Modellkonfiguration, Workload und Verfügbarkeit. Details gemäss AGB und individueller technischer Prüfung.
- Modellklasse
- Frontier-Klasse LLM der neuesten Generation — für Analyse, Code, Agenten und Automation.
- Architektur
- Mixture-of-Experts-Transformer — hunderte Milliarden Parameter gesamt, pro Token ist nur ein Bruchteil aktiv: Frontier-Leistung bei effizienter Inferenz.
- Reasoning
- Denken zuschaltbar: pro Anfrage wählbar zwischen direkter Antwort und sichtbarem, mehrstufigem Denken für komplexe Analysen.
- Kontext
- Rund 262'000 Token pro Gespräch* bei vier gleichzeitigen Gesprächen — für einzelne, sehr lange Gespräche entsprechend mehr. Darüber hinaus erweiterbar durch Vektorindex, Memory Layer und Chunking.
- Agenten
- Natives Tool-Calling, Multi-Step-Planung, Selbstkorrektur — parallel skalierbare Agenten-Workflows*.
- Sprachen
- Deutsch, Englisch, Französisch, Italienisch u. a. — plus Code (SQL, Python, TypeScript, …).
- Ausgabe
- Text, strukturierte Daten (JSON), Funktionsaufrufe, Automationen — direkt in Ihre Systeme.
- Hardware
- Dedizierte NVIDIA-GPU-Instanzen — H100 bis B300, einzeln oder als Cluster, EU-Hosting wählbar.
- Datenschutz
- Keine Nutzung Ihrer Daten für Modelltraining. Verschlüsselter Transport, Zugriff erst nach Security-Audit.
- API
- OpenAI-kompatible REST-API auf Ihrer Instanz — Chat mit laufend mitlesender Antwort, Anbindung eigener Funktionen, Antworten in festem Datenformat, Agent-Modus.
Sehr viel Text auf einmal — und darüber hinaus.
Ein KI-Modell kann nur so viel gleichzeitig überblicken, wie in sein Kontextfenster passt — vereinfacht: sein Arbeitsgedächtnis. In der heutigen Auslegung sind das rund 262'000 Token (grob gerechnet Wortteile) pro Gespräch, bei vier gleichzeitig laufenden Gesprächen. Legt man eine Instanz auf ein einzelnes, sehr langes Gespräch aus, ist deutlich mehr möglich — beides zugleich geht auf derselben Maschine nicht. Für Datenbestände, die auch das übersteigen, kommen Vektorindex, Memory Layer und Aufteilung in Teilstücke dazu.
Kontextlänge, Geschwindigkeit und Qualität hängen von Modellkonfiguration, Hardware-Setup, Datenstruktur, Workload und Verfügbarkeit ab. Details gemäss AGB, Datenschutzbestimmungen und individueller technischer Prüfung.
Kommerzielle KI-Modelle vs. SMT 6.1 Private Infrastructure
Die grossen kommerziellen Modelle sind herausragend — jedes mit eigenem Profil. Der Unterschied liegt nicht in „besser oder schlechter", sondern im Betriebsmodell: geteilte SaaS-Plattform oder eigene, private Infrastruktur.
| Faktor | Kommerzielle KI-AbosOpenAI · Gemini · Claude · Perplexity | SMT 6.1Private Infrastructure |
|---|---|---|
| Betriebsmodell | Externes SaaS / API — Sie mieten Zugang zu einer geteilten Plattform. Preise, Limits und Funktionen setzt der Anbieter | Private Cloud oder dedizierte GPU-Infrastruktur — Sie betreiben eine eigene KI-Schicht. Hardware, Standort und Setup projektbezogen wählbar |
| Modellqualität allgemein | Frontier-Modelle setzen Massstäbe bei genereller Modellqualität und Breite | Spezialisiert konfigurierbar auf Ihre Prozesse und Daten — Qualität abhängig von Setup und Konfiguration |
| Datenkontrolle & Standort | Verarbeitung und Standort gemäss Anbieter, Vertrag und Region | Projektbezogen kontrollierbar — EU-Hosting wählbar, private Datenräume |
| Skalierung unter Last | Rate-Limits, Tarifstufen und geteilte Kapazität — Spitzenlast gemäss Anbieter | Elastische Multi-GPU-Leistung — Skalierung nach Rechenbedarf, von einer Maschine bis zum Cluster |
| Agenten-Parallelität | Parallelität über API möglich, begrenzt durch Limits und Kostenlogik des Anbieters | Parallel skalierbare Agenten-Workflows — bis zu Hunderten Agenten, je nach Infrastruktur und Workload* |
| Kostenlogik & Nutzungslimits | Pro Token, pro Nutzer oder pro Abo — laufend, nutzungsabhängig. Token-, Raten- und Fair-Use-Limits gemäss Tarif | Nach Setup, Hardware, Standort und bezogener Rechenleistung. Keine künstlichen Nutzungslimits — die Grenze ist die gebuchte Rechenleistung* |
| Integrationstiefe & Anpassbarkeit | Über offizielle Schnittstellen und Konnektoren des Anbieters. Prompts, teils Projekte/GPTs und API-Funktionen — im Rahmen der Plattform | Direkte Integration in CRM, Website, Datenbanken und Telefonie möglich. Prompts, RAG, private Knowledge Bases, eigene Workflows und optional Fine-Tuning |
| Sicherheitsoptionen | Enterprise-Optionen gemäss Anbieter und Vertragsstufe | Zugriffskontrollen, Verschlüsselung, optionale Datenisolation — Advanced Protection auf Anfrage |
Alle Anbieter im Direktvergleich
| Kriterium | SMT 6.1 | OpenAI · GPT | Google · Gemini | Anthropic · Claude | Meta · Llama | Mistral | DeepSeek | Perplexity |
|---|---|---|---|---|---|---|---|---|
| Dedizierte Private-Instanz, done-for-you | ✓ | teils¹ | teils¹ | teils¹ | teils² | teils² | teils² | — |
| Wählbarer Datenstandort (EU) | ✓ | teils | teils | teils | teils² | teils | teils² | — |
| Vertraglich keine Trainingsnutzung Ihrer Daten | ✓ | teils | teils | teils | teils² | teils | teils² | teils |
| Agentische Kontextarchitektur (RAG/Memory) inklusive | ✓ | separat | separat | separat | separat | separat | separat | — |
| Betriebsmodi Speed / Deep auf eigener Hardware | ✓ | — | — | — | teils² | teils² | teils² | — |
| Agenten-Parallelität ohne Anbieter-Rate-Limits | ✓* | — | — | — | teils² | teils² | teils² | — |
| Kosten nach Rechenleistung statt Token-Metering | ✓ | — | — | — | teils² | teils² | teils² | — |
| Anpassung auf Firmendaten inkl. Betrieb (RAG/Fine-Tuning) | ✓ | teils | teils | teils | teils² | teils | teils² | — |
| Integrierte Business-Plattform (CRM · Telefonie · Website) | ✓ | — | — | — | — | — | — | — |
| Security-Audit vor Freischaltung inklusive | ✓ | — | — | — | — | — | — | — |
| Öffentliche API | ✓ (auf Ihrer Instanz) | ✓ | ✓ | ✓ | teils³ | ✓ | ✓ | ✓ |
| Web-Suche mit Quellen-Grounding | teils (RAG + optional) | teils | teils | teils | — | teils | teils | ✓ |
Legende: ✓ = Bestandteil des Angebots · teils = möglich mit Einschränkungen oder Zusatzaufwand · separat = als eigenes Projekt aufzubauen · — = nicht Kern des Angebots.
¹ über Enterprise-/Cloud-Programme des jeweiligen Anbieters · ² Self-Host / offene Gewichte in Eigenregie — Betrieb, Härtung und Skalierung selbst zu leisten · ³ über Drittanbieter-Hosting. Einordnung nach typischen, öffentlich kommunizierten Betriebsmodellen (Stand 2026), ohne Anspruch auf Vollständigkeit; keine Aussage über Modellqualität.
Fair eingeordnet: Die kommerziellen Frontier-Modelle sind für viele Aufgaben die richtige Wahl und setzen Massstäbe bei genereller Modellqualität. SMT 6.1 tritt nicht als „besseres Modell" an — sondern als private, kontrollierbare Infrastruktur für Unternehmen, bei denen Datenkontrolle, Standort, Integrationstiefe und Skalierung nach Rechenleistung entscheidend sind. Beides lässt sich kombinieren.
*Orientierungswerte — abhängig von Hardware, Modellkonfiguration, Workload und Verfügbarkeit; Details gemäss AGB und individueller technischer Prüfung. Angaben zu Drittanbietern beschreiben typische Betriebsmodelle ohne Anspruch auf Vollständigkeit; Konditionen gemäss jeweiligem Anbieter. Alle Marken- und Produktnamen sind Eigentum der jeweiligen Inhaber; es besteht keine Partnerschaft oder Empfehlung.
Die SMT 6.1 API — Ihre KI, programmierbar.
OpenAI-kompatible REST-API auf Ihrer dedizierten Instanz: gleiche SDKs, gleiche Muster — aber Ihre private Infrastruktur dahinter. Wir richten Ihre Instanz ein und übergeben die Zugangsschlüssel.
curl https://portal.swiss-marketer.ch/api/smt/v1/i/IHRE-INSTANZ/chat/completions \ -H "Authorization: Bearer $SMT_API_KEY" \ -d '{ "model": "smt-6.0", "messages": [{ "role": "user", "content": "Analysiere den Q3-Report …" }], "stream": true }'
Alle Code- und Konfigurationsbeispiele sind illustrativ und können vom finalen Produkt abweichen.
Verbinden Sie SMT 6.1 über eine OpenAI-kompatible API, Webhooks und native Konnektoren mit Ihrem Stack. Über Make, Zapier oder n8n stehen 2000+ Tools bereit — ergänzt um direkte Anbindungen an ERP, CRM, DMS, BI und Identity-Provider.
Echtzeit-Trigger für Workflows, Benachrichtigungen und Automationen.
Direkte Anbindung an ERP, CRM, DMS, BI und weitere Unternehmenssysteme.
2000+ Tools ohne Coding verknüpfen — ideal für Citizen Integrators.
Rollen, Zugriff und Provisionierung zentral über Ihren Identity-Provider.
Die vollständige technische Dokumentation erhalten Kunden mit dem Onboarding.
Sie stehen auf der Warteliste 🎉
Wir melden uns mit Ihrem privaten SMT 6.1 API-Zugang, sobald Ihre Instanz startklar ist.
KI als eigene Infrastruktur — nicht als fremdes Abo.
Im Gespräch klären wir Anwendungsfall, Datenlage, Sicherheitsanforderungen und die passende GPU-Stufe — und definieren ein Setup, das mit Ihrem Unternehmen skaliert.
Leistungswerte, Kontextlängen, Parallelisierung, Verfügbarkeit, Datenschutzoptionen und Schutzmassnahmen sind abhängig von Hardware, Standort, Modellkonfiguration, Workload, Datenstruktur und Vertragsumfang. Details gemäss AGB, Datenschutzbestimmungen und individueller technischer Prüfung.