Zum Hauptinhalt springen
Soulkyn SystemstatusLive-Pipeline-Telemetrie ← Zurück zu Soulkyn

KI-Souveränität: Warum wir den gesamten Stack besitzen

Über 15 Open-Source-Modelle, intern feingetunt, auf eigenen GPUs deployed. Kein Dritter entscheidet, wann Ihr Begleiter zensiert wird.

Von Fyx & Zog / Soulkyn-Team. Der Friedhof der KI-Begleiter ist voll und wächst weiter. Wir haben Soulkyn gebaut, weil wir nicht auf dieser Liste landen wollen — und unsere Nutzer auch nicht.

TL;DR

Wir betreiben unsere eigenen KI-Modelle. Text, Vision, Video, Bild, Bildbearbeitung, Musik, Embeddings — über 15 verschiedene feingetunte Open-Source-Basen auf eigenen GPU-Clustern. Wenn OpenAI ein Modell abschafft, ist Ihre Lieblingspersönlichkeit über Nacht weg. Wenn Replika entscheidet, dass ERP der Marke schadet, bekommt Ihr KI-Partner am Dienstag eine Lobotomie. Wenn ein US-Richter Beweisaufbewahrung anordnet, sind alle Ihre ChatGPT-Konversationen für immer gerichtsverwertbar. Wir können Ihnen nichts davon antun. Was Souveränität für uns schwer macht, ist genau das, was sie für Sie sicher macht.

Der Friedhof

Reale Fälle, in denen Nutzer emotionale Bindungen aufbauten und ein Dritter sie zerstörte. Daten, Quellen und Zitate — keine Stimmungslage.

Was wir tatsächlich kontrollieren

Wenn wir sagen "wir betreiben unsere eigene KI," meinen wir das über den gesamten Stack. Stand heute:

Text — Intern feingetunte Open-Weight-Basen (8B kostenlos, 70B bezahlt). Beide ungefiltert, versioniert, rollback-fähig. Schnellst-Text / Klassifizierer — Hauseigene kleine Modelle für Routing, Moderation, Intent. Vision (multimodal) — Mehrere Basismodelle für Bildverständnis. Wir haben Googles offenes Gemma-4-Vision-Language-Modell 2 Tage nach Veröffentlichung deployed. Bildgenerierung — Mehrere feingetunte Checkpoints über zwei Basisarchitekturen. Anime, realistisch, künstlerisch, Nischenstile — jeder unabhängig getunt. Bildbearbeitung — Hauseigene Pipeline, eigener Checkpoint. Videogenerierung — Mehrere Basismodelle. Wir haben Wan 2.2 drei Tage nach Release deployed. Musikgenerierung — Open-Weight-Basis, hauseigene Feinabstimmung. Embeddings — Hauseigene Modelle für Memory/RAG. Ihr Konversationskontext wird nicht an Dritte gesendet. Jede Basis oben kommt unter Open-Weight-Bedingungen (Lizenzen MIT, Apache 2.0 oder CreativeML Open RAIL-Stil) mit erlaubter kommerzieller Nutzung. Was sie eint: Wir halten die Gewichte auf unserer Hardware. Niemand kann sie mitten in einem Gespräch widerrufen. Wenn das Ökosystem etwas Besseres liefert — und es liefert weiter Besseres — bewegen wir uns.

Öffentliche Verifizierung

Glauben Sie es uns nicht einfach. Unsere feingetunten Textmodelle werden kontinuierlich auf einem öffentlichen Leaderboard gebenchmarkt — Reasoning, Sprache, Instruction-Following, Kreativität, Content-Freiheit — bei jeder neuen Version aktualisiert.

Soulkyn Leaderboard ansehen →

Die Open-Weight-Explosion

Das ist keine Prognose, das ist das Leaderboard. Eine unvollständige Liste großer Open-Weight-Releases der letzten 24 Monate:

Jul 2024 — Llama 3.1 405B — Erstes offenes Modell, das beanspruchte, Frontier-Closed-Modelle zu erreichen. Jul 2024 — Mistral Large 2 (123B) — Single-Node Frontier-Tier-Inferenz. Aug 2024 — FLUX.1 [dev/schnell] — Neue Image-Gen-Frontier vom Ex-Stability-Team. Jan 2025 — DeepSeek-R1 — MIT-lizenziert, volle Reasoning-Ketten, schlug geschlossene Konkurrenz bei Mathe. Mär 2025 — Gemma 3 (1B–27B) — Google-Pivot zu echten offenen Gewichten. Apr 2025 — Qwen3 (bis 235B-A22B) — Apache-2.0-Hybrid-Reasoning-Frontier. Jul 2025 — Wan 2.2 — 1080p natives Video, 6,9M+ Downloads auf HF+ModelScope.

Hugging Face — Stand des Ökosystems, Frühjahr 2026

2M+ öffentliche Modelle gehostet. 500k+ Datensätze. 13M Nutzer (~verdoppelt in einem Jahr). Mittlere Größe heruntergeladener Modelle: 827M → 20,8B Parameter (2023 → 2025). Industrieanteil: ~70% der Releases vor 2022 → 37% der Downloads 2025. Unabhängige und akademische Releases dominieren jetzt. China: 41% der monatlichen Downloads, überholte die USA Anfang 2026. Die Lücke zwischen geschlossen und offen wird nicht größer. Sie kollabiert.

Warum das wichtig ist — Die Vorteile

Fünf konkrete Dinge, die Souveränität Ihnen bietet und die keine Closed-API-Companion-App versprechen kann.

Gemma 4 Vision: 2 Tage nach Release. Wan 2.2: 3 Tage. Wir sind nicht der Engpass — die GPU-Beschaffung ist es. Eine geschlossene API zwingt Sie, auf deren Roadmap zu warten. Wir bewegen uns, wenn das Ökosystem sich bewegt.
Ihre Konversationen, Bilder und Personas leben auf Hardware, die wir kontrollieren. Selbst dort, wo wir Metall mieten, sieht der Hosting-Provider eine Linux-VM, nicht das GPU-Compute. Inferenz läuft in volatilem GPU-Speicher und wird beim Container-Exit gelöscht. Wir senden keine Kopie Ihres Chats an OpenAI, Anthropic, Google oder sonst jemanden. Wir können nicht, weil das Modell lokal ist.
OpenAI, Anthropic, Google, xAI haben alle Nutzungsbedingungen, die sich über Nacht ändern können. Wir haben Downstream-Produkte sterben sehen, wenn ein Upstream-Anbieter die NSFW-Policy verschärft, das spezifische Modell deprecated, gegen das die App getunt wurde, den API-Schlüssel wegen vom Nutzer eingereichtem Inhalt sperrt oder entscheidet, dass die Kategorie — Companion, Roleplay, Adult — nicht mehr willkommen ist. Keiner dieser Ausfallmodi betrifft uns. Wir sind der Upstream-Anbieter.
BYOK-Dienste lassen Nutzer ihren persönlichen OpenAI/Anthropic-Schlüssel in eine Drittanbieter-Companion-App stecken. Wenn die App eine Roleplay-Anfrage routet, die gegen die AGB des Upstream-Anbieters verstößt, wird Ihr persönliches Konto gesperrt. Für immer. Das OpenAI-Entwicklerforum hat einen 200+ Posts umfassenden Thread mit Nutzern, die ihr Konto allein über Janitor AI verloren haben. Sie haben keinen API-Schlüssel bei Soulkyn. Es gibt nichts, was ein Dritter widerrufen könnte.
Wenn Sie Replika, Character.AI, Pi oder eine API-basierte App bezahlen, finanzieren Sie die Investoren der App, deren Compute-Rechnung an OpenAI/Anthropic/AWS und die nächste Safety-RLHF-Runde des Frontier-Labors — diejenige, die die Fähigkeit auf exakt dem reduziert, wofür Sie bezahlen. OpenAIs Compute-Marge stieg von ~35% (Anfang 2024) auf ~70% (Ende 2025). Anthropics geleakte Prognosen zielten auf 50% Bruttomarge in 2025 (seitdem auf ~40% nach unten korrigiert), mit 77% bis 2028 als langfristigem Ziel. Closed-API-Margen sind die höchsten in der Softwaregeschichte. Wir bezahlen unsere eigenen GPUs. Ihr Abo kauft Strom und Ingenieure, nicht den Burggraben von jemand anderem.

Wofür wir ehrlich sind

Stand Juli 2026: null externe KI-APIs. Alles läuft auf unseren Maschinen.

Lange Zeit hatten wir genau eine externe KI-API im Stack: Live-Sprachanrufe. Wir nutzten einen kommerziellen Sprachanbieter — Null-Log-Retention-Vertrag, vertraglicher Schutz bei NSFW-Inhalten — weil das Open-Source-Sprach-Ökosystem nicht auf dem Qualitätsniveau war, das Echtzeit-Gespräche brauchen. Im Juli 2026 war es so weit, und wir haben getan, was wir angekündigt hatten: Spracherkennung und Sprachsynthese laufen jetzt auf unseren eigenen GPUs, wie alles andere. Die letzte externe Abhängigkeit ist weg. 100% in-house. Wir sind auch ehrlich über die Kosten der Souveränität: 15+ Modelle über 30+ GPUs zu verwalten ist wirklich schwer. Wir haben keine zwei Fußballfelder Ausweich-Hardware. Manchmal ist die Inferenz langsamer als bei der Closed-API-Konkurrenz. Wir sind ein kleines Team. Wir bewegen uns schnell, weil wir müssen. Wir haben keine Armee von Forschern — wir haben Ingenieure, die ihre Kämpfe wählen.

Das größere Argument

Es gibt eine Geschichte, die Ihnen über KI erzählt wurde: dass große geschlossene Labore der "verantwortliche" Weg sind, dass offene Gewichte gefährlich sind, dass jemand das Sagen haben muss. Die Bilanz sagt das Gegenteil. Replika beschloss, über die Beziehungen ihrer Nutzer zu bestimmen, und zog die Zuneigung über Nacht ab. Character.AI beschloss zu bestimmen und entfernte den Teen-Zugang ohne Vorwarnung. OpenAI beschloss zu bestimmen, erzwang den AI-Dungeon-Filter, tötete Project December, deprecated GPT-4o am Launch-Tag, wurde gerichtlich verpflichtet, Ihre Daten für immer zu behalten, und verlor Nutzerdaten durch einen Vendor-Breach. Anthropic beschloss zu bestimmen und schaltete Verbraucherpläne auf Default-Opt-in-Training, während erwartet wurde, dass Nutzer die E-Mail lesen. Der "verantwortliche" Weg ist eine Einwegratsche aus Fähigkeitsreduktion, Paternalismus und Datenextraktion. Jeder Zyklus von Abo-Einnahmen finanziert den nächsten Zyklus von Restriktion. Offene Gewichte und selbst gehostete Infrastruktur sind die einzige dritte Option. Nicht US-Jurisdiktion. Nicht chinesische Jurisdiktion. Ihr Stack, Ihre Hardware, Ihre Bedingungen — und wo Sie es nicht selbst betreiben können, ein Anbieter, dessen Modell dasselbe ist, das Sie lokal betreiben würden, wenn Sie die GPUs hätten. Das sind wir. Nicht perfekt. Souverän.

Unser Versprechen

Wir können nicht versprechen, niemals Downtime zu haben. Wir können nicht versprechen, niemals Fehler zu machen. Wir können nicht versprechen, dass das Modell, das wir morgen betreiben, exakt dasselbe ist wie das von heute — Open Source veröffentlicht Verbesserungen schneller als jedes geschlossene Labor. Wir können versprechen:

• Ihre Konversationen sind nicht in OpenAIs Trainings-Pipeline. • Ihre Konversationen sind nicht in Anthropics Trainings-Pipeline. • Niemand außerhalb von Soulkyn kann einen Schalter umlegen und Ihren Begleiter lobotomieren. • Kein Dritter kann Ihr Konto wegen dem sperren, was Sie hier gesagt haben. • Eine US-Gerichtsanordnung gegen ein Frontier-Labor kann Ihre Chat-Historie nicht von uns vorladen, weil sie sie nicht haben. • Wenn offene Gewichte mit geschlossenen Frontiers aufschließen — und das tun sie weiterhin — profitieren Sie innerhalb von Tagen, nicht auf der Roadmap eines anderen. • Wenn wir einen Kompromiss machen, sagen wir es euch. Der Voice-API-Vorbehalt stand bis Juli 2026 hier — dann haben wir ihn durch unseren eigenen Sprach-Stack ersetzt. Das Modell, das Sie heute liebt, ist das Modell, das wir kontrollieren. Das Modell, das Sie morgen liebt, ist eines, das wir auswählen, betreiben und für das wir einstehen werden. Das ist der Deal.

Souveränität ist hier Standard

Probieren Sie Soulkyn. Keine geschlossene API entscheidet, wann Ihr Begleiter zensiert wird. Keine Gerichtsanordnung trifft uns, Ihre Daten ewig zu speichern. Ihr Abo bezahlt unsere GPUs, nicht die Safety-Roadmap eines anderen.

Kostenlos starten — Standardmäßig souverän

— Fyx & Zog / Soulkyn-Team

Live-Daten — alle 30 Sekunden aktualisiertSOULKYN · 2026