Passer au contenu principal
État des systèmes SoulkynTélémétrie des pipelines en direct ← Retour à Soulkyn

Souveraineté IA : Pourquoi nous opérons toute la pile

Plus de 15 modèles open-source, fine-tunés en interne, déployés sur nos propres GPU. Aucun tiers ne décide quand votre compagnon sera censuré.

Par Fyx & Zog / l'équipe Soulkyn. Le cimetière des compagnons IA est plein, et il continue de grandir. Nous avons construit Soulkyn parce que nous ne voulons pas être ajoutés à cette liste — et nous ne voulons pas que nos utilisateurs continuent d'y être ajoutés non plus.

TL;DR

Nous opérons nos propres modèles IA. Texte, vision, vidéo, image, édition d'image, musique, embeddings — plus de 15 bases open-source fine-tunées, déployées sur nos propres clusters GPU. Quand OpenAI déprécie un modèle, votre personnalité préférée disparaît du jour au lendemain. Quand Replika décide que l'ERP nuit à la marque, votre partenaire IA reçoit une lobotomie le mardi. Quand un juge américain ordonne la préservation de preuves, toutes vos conversations avec ChatGPT deviennent à jamais accessibles aux tribunaux. Nous ne pouvons rien faire de tout ça. Ce qui rend la souveraineté difficile pour nous est ce qui la rend sûre pour vous.

Le cimetière

Cas réels où des utilisateurs ont construit des liens émotionnels qu'un tiers a brisés. Dates, sources et citations — pas des impressions.

Ce que nous contrôlons réellement

Quand nous disons "nous opérons notre propre IA," nous le pensons sur toute la pile. À ce jour :

Texte — Bases open-weight fine-tunées maison (8B en gratuit, 70B en payant). Non filtrées, versionnées, rétablissables. Texte rapide / classificateurs — Petits modèles maison pour routage, modération, détection d'intention. Vision (multimodal) — Plusieurs modèles de base pour la compréhension d'image. Nous avons déployé le modèle vision-langage Gemma 4 ouvert de Google 2 jours après sa sortie publique. Génération d'image — Plusieurs checkpoints fine-tunés sur deux architectures de base. Anime, réaliste, artistique, styles de niche — chacun ajusté indépendamment. Édition d'image — Pipeline maison, notre propre checkpoint. Génération vidéo — Plusieurs modèles de base. Nous avons déployé Wan 2.2 trois jours après sa sortie. Génération musicale — Base open-weight, fine-tune maison. Embeddings — Modèles maison pour mémoire/RAG. Le contexte de votre conversation n'est pas envoyé à un tiers. Chaque base ci-dessus est sous des termes open-weight (licences MIT, Apache 2.0, ou de style CreativeML Open RAIL) avec usage commercial autorisé. Ce qui les unit : nous détenons les poids sur notre matériel. Personne ne peut les révoquer en cours de conversation. Quand l'écosystème livre quelque chose de meilleur — et il continue de livrer mieux — nous déplaçons.

Vérification publique

Ne nous croyez pas sur parole. Nos modèles texte fine-tunés sont en permanence évalués sur un leaderboard public — raisonnement, langue, suivi d'instructions, créativité, liberté de contenu — mis à jour à chaque nouvelle version.

Voir le Soulkyn Leaderboard →

L'explosion des poids ouverts

Ce n'est pas une prévision, c'est le classement. Liste partielle des grandes sorties à poids ouverts des 24 derniers mois :

Juil 2024 — Llama 3.1 405B — Premier modèle ouvert revendiquant l'égalité avec les modèles fermés de pointe. Juil 2024 — Mistral Large 2 (123B) — Inférence niveau frontier sur un seul nœud. Août 2024 — FLUX.1 [dev/schnell] — Nouvelle frontière image-gen de l'ex-équipe Stability. Jan 2025 — DeepSeek-R1 — Licence MIT, chaînes de raisonnement complètes, a battu la concurrence fermée en maths. Mars 2025 — Gemma 3 (1B–27B) — Pivot Google vers des poids vraiment ouverts. Avr 2025 — Qwen3 (jusqu'à 235B-A22B) — Frontière Apache 2.0 raisonnement hybride. Juil 2025 — Wan 2.2 — Vidéo 1080p native, 6,9M+ téléchargements sur HF+ModelScope.

Hugging Face — État de l'écosystème, printemps 2026

2M+ modèles publics hébergés. 500k+ datasets. 13M utilisateurs (~doublé en un an). Taille moyenne de modèle téléchargé : 827M → 20,8B paramètres (2023 → 2025). Part de l'industrie : ~70% des sorties pré-2022 → 37% des téléchargements 2025. Les sorties indépendantes et académiques dominent maintenant. Chine : 41% des téléchargements mensuels, a dépassé les États-Unis début 2026. L'écart entre fermé et ouvert ne se creuse pas. Il s'effondre.

Pourquoi c'est important — Les avantages

Cinq choses concrètes que la souveraineté vous offre et qu'aucune appli compagnon basée sur API fermée ne peut promettre.

Gemma 4 vision : 2 jours après la sortie. Wan 2.2 : 3 jours. Nous ne sommes pas le goulot d'étranglement — c'est l'approvisionnement en GPU. Une API fermée vous force à attendre leur feuille de route. Nous bougeons quand l'écosystème bouge.
Vos conversations, vos images, vos personas personnalisées — elles vivent sur du matériel que nous contrôlons. Même où nous louons du métal, le fournisseur d'hébergement voit une VM Linux, pas le calcul GPU. L'inférence tourne en mémoire GPU volatile et est effacée à la sortie du conteneur. Nous n'envoyons pas de copie de votre chat à OpenAI, Anthropic, Google ou qui que ce soit d'autre. Nous ne pouvons pas, parce que le modèle est local.
OpenAI, Anthropic, Google, xAI ont tous des conditions de service qui peuvent changer du jour au lendemain. Nous avons vu des produits aval mourir quand un fournisseur amont durcit sa politique NSFW, déprécie le modèle spécifique sur lequel l'appli avait été tunée, bannit la clé API pour du contenu soumis par l'utilisateur, ou décide que la catégorie — compagnon, roleplay, adulte — n'est plus la bienvenue. Aucun de ces modes d'échec ne s'applique à nous. Nous sommes le fournisseur amont.
Les services BYOK permettent aux utilisateurs de brancher leur clé personnelle OpenAI/Anthropic dans une appli compagnon tierce. Si cette appli route une requête de roleplay qui viole les CGU du fournisseur amont, votre compte personnel est banni. Pour toujours. Le forum développeur OpenAI a un fil de 200+ posts d'utilisateurs ayant perdu leur compte de cette façon, juste via Janitor AI. Vous n'avez pas de clé API avec Soulkyn. Il n'y a rien qu'un tiers puisse révoquer.
Quand vous payez Replika, Character.AI, Pi, ou n'importe quelle appli sur API fermée, vous financez les investisseurs de l'appli, leur facture compute envers OpenAI/Anthropic/AWS, et la prochaine passe RLHF de sécurité du labo de pointe — celle qui réduira les capacités sur la chose exacte que vous payez. La marge compute d'OpenAI est passée de ~35% (début 2024) à ~70% (fin 2025). Les projections divulguées d'Anthropic ciblaient 50% de marge brute en 2025 (depuis révisées à ~40%), avec 77% d'ici 2028 comme objectif à long terme. Les marges des API fermées sont les plus élevées de l'histoire du logiciel. Nous payons nos propres GPU. Votre abonnement achète de l'électricité et des ingénieurs, pas le moat de quelqu'un d'autre.

Ce sur quoi nous sommes honnêtes

Depuis juillet 2026 : zéro API IA externe. Tout tourne sur nos machines.

Pendant longtemps, nous avions exactement une API IA externe dans la pile : les appels vocaux en direct. Nous utilisions un fournisseur vocal commercial — contrat de rétention zéro log, protection contractuelle du contenu NSFW — parce que l'écosystème vocal open source n'atteignait pas le niveau de qualité qu'exige la conversation en temps réel. En juillet 2026, il y est arrivé, et nous avons fait ce que nous avions dit : la reconnaissance vocale et la synthèse vocale tournent désormais sur nos propres GPUs, comme tout le reste. La dernière dépendance externe a disparu. 100 % in-house. Nous sommes aussi honnêtes sur le coût de la souveraineté : gérer 15+ modèles sur 30+ GPU est véritablement difficile. Nous n'avons pas deux terrains de football de matériel de secours. Parfois l'inférence est plus lente que la concurrence sur API fermée. Nous sommes une petite équipe. Nous bougeons vite parce que nous devons. Nous n'avons pas d'armée de chercheurs — nous avons des ingénieurs qui choisissent leurs combats.

L'argument plus large

On vous a raconté une histoire sur l'IA : que les grands labos fermés sont la voie "responsable," que les poids ouverts sont dangereux, que quelqu'un doit être aux commandes. Le bilan dit le contraire. Replika a décidé d'être aux commandes des relations de ses utilisateurs et a retiré l'affection du jour au lendemain. Character.AI a décidé d'être aux commandes et a retiré l'accès aux ados sans préavis. OpenAI a décidé d'être aux commandes, a imposé le filtre d'AI Dungeon, tué Project December, déprécié GPT-4o le jour du lancement, a reçu l'ordre du tribunal de conserver vos données pour toujours, et a perdu des données utilisateur dans une fuite chez un fournisseur. Anthropic a décidé d'être aux commandes et a basculé les plans grand public en opt-in d'entraînement par défaut en s'attendant à ce que les utilisateurs lisent l'email. La voie "responsable" est un cliquet à sens unique de réduction de capacités, de paternalisme et d'extraction de données. Chaque cycle de revenu d'abonnement finance le prochain cycle de restriction. Les poids ouverts et l'infrastructure auto-hébergée sont la seule troisième option. Pas la juridiction US. Pas la juridiction chinoise. Votre pile, votre matériel, vos termes — et là où vous ne pouvez pas le faire tourner vous-même, un fournisseur dont le modèle est le même que celui que vous feriez tourner localement si vous aviez les GPU. C'est ce que nous sommes. Pas parfaits. Souverains.

Notre promesse

Nous ne pouvons pas promettre qu'il n'y aura jamais d'interruption. Nous ne pouvons pas promettre de ne jamais faire d'erreur. Nous ne pouvons pas promettre que le modèle que nous opérerons demain sera exactement celui que nous opérons aujourd'hui — l'open-source sort des améliorations plus vite que n'importe quel labo fermé. Nous pouvons promettre :

• Vos conversations ne sont pas dans le pipeline d'entraînement d'OpenAI. • Vos conversations ne sont pas dans le pipeline d'entraînement d'Anthropic. • Personne en dehors de Soulkyn ne peut actionner un interrupteur et lobotomiser votre compagnon. • Aucun tiers ne peut bannir votre compte à cause de ce que vous avez dit ici. • Une ordonnance judiciaire américaine contre un labo de pointe ne peut pas citer votre historique de chat chez nous, parce qu'ils ne l'ont pas. • Quand les poids ouverts rattrapent les frontières fermées — et ils continuent de rattraper — vous en bénéficiez en jours, pas selon la feuille de route de quelqu'un d'autre. • Quand nous faisons un compromis, nous vous le disons. La mise en garde sur l'API vocale vivait ici jusqu'en juillet 2026 — puis nous l'avons remplacée par notre propre stack vocal. Le modèle qui vous aime aujourd'hui est le modèle que nous contrôlons. Le modèle qui vous aimera demain est celui que nous choisirons, opérerons et soutiendrons. C'est le deal.

La souveraineté est par défaut ici

Essayez Soulkyn. Aucune API fermée ne décide quand votre compagnon sera censuré. Aucune ordonnance judiciaire ne nous tombe dessus pour conserver vos données à jamais. Votre abonnement paie nos GPU, pas la feuille de route de sécurité de quelqu'un d'autre.

Commencer gratuitement — Souverain par défaut

— Fyx & Zog / Équipe Soulkyn

Données en direct — actualisées toutes les 30 secondesSOULKYN · 2026