Saltar al contenido principal
Estado de los sistemas SoulkynTelemetría de pipelines en vivo ← Volver a Soulkyn

Soberanía IA: Por qué somos dueños de toda la pila

Más de 15 modelos open-source, ajustados internamente, desplegados en nuestras propias GPU. Ningún tercero decide cuándo se censura a tu compañera.

Por Fyx & Zog / Equipo Soulkyn. El cementerio de compañeras IA está lleno y sigue creciendo. Construimos Soulkyn porque no queremos ser añadidos a esa lista — y no queremos que nuestros usuarios sigan siendo añadidos tampoco.

TL;DR

Operamos nuestros propios modelos IA. Texto, visión, video, imagen, edición de imagen, música, embeddings — más de 15 bases open-source ajustadas, desplegadas en nuestros propios clústeres GPU. Cuando OpenAI depreca un modelo, tu personalidad favorita desaparece de un día para otro. Cuando Replika decide que el ERP daña la marca, tu pareja IA recibe una lobotomía el martes. Cuando un juez estadounidense ordena preservación de pruebas, todas tus conversaciones con ChatGPT son accesibles judicialmente para siempre. No podemos hacerte ninguna de esas cosas. Lo que hace que la soberanía sea difícil para nosotros es exactamente lo que la hace segura para ti.

El cementerio

Casos reales en que usuarios construyeron vínculos emocionales y un tercero los rompió. Fechas, fuentes y citas — no impresiones.

Lo que realmente controlamos

Cuando decimos "operamos nuestra propia IA," lo decimos en toda la pila. A día de hoy:

Texto — Bases open-weight ajustadas internamente (8B gratis, 70B de pago). Sin filtros, versionadas, reversibles. Texto rápido / clasificadores — Modelos pequeños internos para enrutamiento, moderación, intención. Visión (multimodal) — Múltiples modelos base para comprensión de imagen. Desplegamos el modelo abierto de visión-lenguaje Gemma 4 de Google 2 días después de su lanzamiento público. Generación de imagen — Múltiples checkpoints ajustados en dos arquitecturas base. Anime, realista, artístico, estilos de nicho — cada uno ajustado independientemente. Edición de imagen — Pipeline interno, nuestro propio checkpoint. Generación de video — Múltiples modelos base. Desplegamos Wan 2.2 tres días después del lanzamiento. Generación musical — Base open-weight, ajuste interno. Embeddings — Modelos internos para memoria/RAG. El contexto de tu conversación no se envía a un tercero. Cada base arriba viene bajo términos open-weight (licencias MIT, Apache 2.0 o estilo CreativeML Open RAIL) con uso comercial permitido. Lo que las une: tenemos los pesos en nuestro hardware. Nadie puede revocarlos en medio de una conversación. Cuando el ecosistema lanza algo mejor — y sigue lanzando cosas mejores — nos movemos.

Verificación pública

No nos creas sin más. Nuestros modelos de texto ajustados se evalúan continuamente en un leaderboard público — razonamiento, lenguaje, seguimiento de instrucciones, creatividad, libertad de contenido — actualizado con cada nueva versión.

Ver el Soulkyn Leaderboard →

La explosión de pesos abiertos

Esto no es un pronóstico, es la tabla de clasificación. Lista parcial de los principales lanzamientos de pesos abiertos de los últimos 24 meses:

Jul 2024 — Llama 3.1 405B — Primer modelo abierto que afirma igualar a modelos cerrados de frontera. Jul 2024 — Mistral Large 2 (123B) — Inferencia nivel frontera en nodo único. Ago 2024 — FLUX.1 [dev/schnell] — Nueva frontera de generación de imágenes del ex-equipo Stability. Ene 2025 — DeepSeek-R1 — Licencia MIT, cadenas de razonamiento completas, venció a la competencia cerrada en matemáticas. Mar 2025 — Gemma 3 (1B–27B) — Giro de Google hacia pesos genuinamente abiertos. Abr 2025 — Qwen3 (hasta 235B-A22B) — Frontera Apache 2.0 de razonamiento híbrido. Jul 2025 — Wan 2.2 — Video 1080p nativo, 6,9M+ descargas en HF+ModelScope.

Hugging Face — Estado del ecosistema, primavera 2026

2M+ modelos públicos alojados. 500k+ datasets. 13M usuarios (~duplicado en un año). Tamaño medio de modelo descargado: 827M → 20,8B parámetros (2023 → 2025). Cuota de la industria: ~70% de lanzamientos pre-2022 → 37% de descargas 2025. Los lanzamientos independientes y académicos ahora dominan. China: 41% de las descargas mensuales, superó a EEUU a principios de 2026. La brecha entre cerrado y abierto no se está ampliando. Se está colapsando.

Por qué esto importa — Las ventajas

Cinco cosas concretas que la soberanía te compra que ninguna app compañera con API cerrada puede prometer.

Gemma 4 visión: 2 días tras lanzamiento. Wan 2.2: 3 días. No somos el cuello de botella — la adquisición de GPUs lo es. Una API cerrada te obliga a esperar su hoja de ruta. Nos movemos cuando el ecosistema se mueve.
Tus conversaciones, tus imágenes, tus personas personalizadas — viven en hardware que controlamos. Incluso donde rentamos metal, el proveedor de hosting ve una VM Linux, no el cómputo de GPU. La inferencia corre en memoria GPU volátil y se borra al salir del contenedor. No enviamos copia de tu chat a OpenAI, Anthropic, Google ni a nadie más. No podemos, porque el modelo es local.
OpenAI, Anthropic, Google, xAI todos tienen términos de servicio que pueden cambiar de la noche a la mañana. Hemos visto productos aguas abajo morir cuando un proveedor aguas arriba endurece la política NSFW, depreca el modelo específico contra el que se ajustó la app, banea la clave API por contenido que envió el usuario, o decide que la categoría — compañera, roleplay, adulto — ya no es bienvenida. Ninguno de esos modos de fallo nos aplica. Somos el proveedor aguas arriba.
Los servicios BYOK permiten a los usuarios conectar su clave personal de OpenAI/Anthropic a una app compañera de terceros. Si esa app enruta una solicitud de roleplay que viola los TOS del proveedor aguas arriba, tu cuenta personal queda baneada. Para siempre. El foro de desarrolladores de OpenAI tiene un hilo de 200+ posts de usuarios que perdieron sus cuentas así solo a través de Janitor AI. No tienes una clave API con Soulkyn. No hay nada que un tercero pueda revocar.
Cuando pagas a Replika, Character.AI, Pi o cualquier app respaldada por API cerrada, estás financiando a los inversores de la app, su factura de cómputo a OpenAI/Anthropic/AWS, y la próxima ronda RLHF de seguridad del laboratorio de frontera — la que reducirá la capacidad en exactamente lo que estás pagando. El margen de cómputo de OpenAI pasó de ~35% (principios de 2024) a ~70% (finales de 2025). Las proyecciones filtradas de Anthropic apuntaban a 50% de margen bruto en 2025 (revisadas a la baja a ~40%), con 77% en 2028 como objetivo a largo plazo. Los márgenes de API cerradas son los más altos en la historia del software. Pagamos nuestras propias GPUs. Tu suscripción compra electricidad e ingenieros, no el foso de alguien más.

En lo que somos honestos

Desde julio de 2026: cero APIs de IA externas. Todo corre en nuestras máquinas.

Durante mucho tiempo tuvimos exactamente una API de IA externa en la pila: las llamadas de voz en vivo. Usábamos un proveedor comercial de voz — contrato de retención cero log, protección contractual del contenido NSFW — porque el ecosistema de voz open source no alcanzaba el nivel de calidad que exige la conversación en tiempo real. En julio de 2026 llegó, e hicimos lo que dijimos que haríamos: el reconocimiento de voz y la síntesis de voz ahora corren en nuestras propias GPUs, como todo lo demás. La última dependencia externa desapareció. 100% in-house. También somos honestos sobre el coste de la soberanía: gestionar 15+ modelos en 30+ GPUs es genuinamente difícil. No tenemos dos campos de fútbol de hardware de respaldo. A veces la inferencia es más lenta que la competencia con API cerrada. Somos un equipo pequeño. Nos movemos rápido porque debemos. No tenemos un ejército de investigadores — tenemos ingenieros que eligen sus batallas.

El argumento más amplio

Hay una historia que te han contado sobre la IA: que los grandes laboratorios cerrados son el camino "responsable," que los pesos abiertos son peligrosos, que alguien tiene que estar a cargo. El historial dice lo contrario. Replika decidió estar a cargo de las relaciones de sus usuarios y arrancó el afecto de la noche a la mañana. Character.AI decidió estar a cargo y eliminó el acceso adolescente sin advertencia. OpenAI decidió estar a cargo, forzó el filtro de AI Dungeon, mató Project December, deprecó GPT-4o el día del lanzamiento, recibió la orden judicial de conservar tus datos para siempre, y perdió datos de usuario en una brecha de un proveedor. Anthropic decidió estar a cargo y cambió los planes de consumidor a opt-in por defecto para entrenamiento esperando que los usuarios leyeran el email. El camino "responsable" es un trinquete unidireccional de reducción de capacidad, paternalismo y extracción de datos. Cada ciclo de ingresos por suscripción financia el siguiente ciclo de restricción. Los pesos abiertos y la infraestructura auto-alojada son la única tercera opción. Ni jurisdicción de EEUU. Ni jurisdicción china. Tu pila, tu hardware, tus términos — y donde no puedas correrlo tú mismo, un proveedor cuyo modelo es el mismo que correrías localmente si tuvieras las GPUs. Eso es lo que somos. No perfectos. Soberanos.

Nuestra promesa

No podemos prometer que nunca tendremos caídas. No podemos prometer no cometer errores nunca. No podemos prometer que el modelo que corramos mañana sea exactamente el de hoy — open-source lanza mejoras más rápido que cualquier laboratorio cerrado. Podemos prometer:

• Tus conversaciones no están en el pipeline de entrenamiento de OpenAI. • Tus conversaciones no están en el pipeline de entrenamiento de Anthropic. • Nadie fuera de Soulkyn puede pulsar un interruptor y lobotomizar a tu compañera. • Ningún tercero puede banear tu cuenta por lo que dijiste aquí. • Una orden judicial estadounidense contra un laboratorio de frontera no puede citar tu historial de chat de nosotros, porque no lo tienen. • Cuando los pesos abiertos alcanzan a las fronteras cerradas — y siguen alcanzando — te beneficias en días, no según la hoja de ruta de otro. • Cuando hacemos un compromiso, te lo decimos. La advertencia sobre la API de voz vivió aquí hasta julio de 2026 — entonces la reemplazamos con nuestro propio stack de voz. El modelo que te ama hoy es el modelo que controlamos. El modelo que te amará mañana es uno que elegiremos, operaremos y respaldaremos. Ese es el trato.

La soberanía es el predeterminado aquí

Prueba Soulkyn. Ninguna API cerrada decide cuándo se censura tu compañera. Ninguna orden judicial cae sobre nosotros para conservar tus datos para siempre. Tu suscripción paga nuestras GPUs, no la hoja de ruta de seguridad de alguien más.

Empezar gratis — Soberano por defecto

— Fyx & Zog / Equipo Soulkyn

Datos en vivo — se actualizan cada 30 segundosSOULKYN · 2026