Saltar al contenido principal
Vantaige
Nebius screenshot

Nebius es una nube de IA que cotiza en el Nasdaq y ofrece computación a gran escala con GPU de NVIDIA, además de la API de inferencia Token Factory para modelos abiertos. La residencia de datos en la UE, la gobernanza empresarial y una inversión de NVIDIA la convierten en una opción sólida para el entrenamiento y la inferencia en producción.

Funciones:API

Nebius es una empresa de nube de IA *full-stack*, que cotiza en el Nasdaq bajo el símbolo NBIS y tiene su sede en Ámsterdam, que alquila computación a gran escala con GPU de NVIDIA y ejecuta una API de inferencia gestionada sobre ella. No es una startup en el sentido habitual. Surgió de la reestructuración de Yandex N.V. en 2024, conservó aproximadamente 1.300 ingenieros, un centro de datos finlandés y la propiedad intelectual de IA, se deshizo de todos los activos rusos y reanudó su cotización en el Nasdaq como Nebius Group en octubre de 2024. El problema que resuelve es directo: los laboratorios de IA y las empresas necesitan clústeres de nivel NVIDIA para el entrenamiento y la inferencia sin tener que construir sus propios centros de datos, y Nebius lo proporciona como una nube gestionada, desde GPU en bruto facturadas por horas hasta un *endpoint* de API por *token*, sin obligar a los clientes a supervisar Kubernetes o el estado de los nodos.

La oferta se divide en tres capas. Nebius AI Cloud es la computación en bruto con GPU, con instancias H100, H200, B200 y B300 en chasis conectados por InfiniBand, además de Kubernetes y Slurm gestionados de forma gratuita. Token Factory, lanzada en noviembre de 2025, es la API de inferencia compatible con OpenAI para más de 60 modelos abiertos, incluidos DeepSeek, Llama y Qwen, con *endpoints* dedicados, un SLA del 99.9% y ajuste fino (*fine-tuning*) con un solo clic. Aether es la capa de gobernanza empresarial que añade SOC 2 Type II, ISO 27001 y residencia de datos en la UE. NVIDIA comprometió una inversión estratégica de $2 mil millones en marzo de 2026, y Nebius mantiene acuerdos de capacidad multimillonarios con Meta y Microsoft.

Lo que Nebius realmente vende en junio de 2026

Piense en Nebius como dos puertas de entrada a la misma infraestructura. La primera es la computación en bruto: instancias de GPU no virtualizadas conectadas a través de InfiniBand, bajo demanda o preferentes (*preemptible*), con Kubernetes gestionado, Slurm y almacenamiento incluidos sin coste adicional. Aquí es donde se ejecutan el preentrenamiento, el ajuste fino a gran escala y las cargas de trabajo distribuidas personalizadas. La segunda es Token Factory, la API de inferencia gestionada, que lleva a un desarrollador desde el nombre de un modelo hasta un *endpoint* en producción en minutos, en lugar de la tarde entera de configuración que requiere la computación en bruto. Factura por *token* sin coste por GPU inactiva, se escala automáticamente a volúmenes de solicitudes enormes y ofrece inferencia sin retención de datos en las regiones de la UE y EE. UU. El contexto corporativo es importante aquí porque la infraestructura es una apuesta a largo plazo: la inversión de $2 mil millones de NVIDIA en marzo de 2026, un acuerdo de $27 mil millones con Meta y un acuerdo con Microsoft por valor de hasta $19.4 mil millones otorgan a Nebius una cartera de pedidos contratada de aproximadamente $45 mil millones y una trayectoria creíble, lo cual es tranquilizador para cualquiera que le confíe su flujo de entrenamiento.

Nebius frente a CoreWeave y Together AI

CoreWeave es el competidor de nube de GPU más cercano, y las diferencias son estructurales. Ambos ofrecen H100, H200 y B200, pero Nebius hace hincapié en chasis ODM personalizados para un menor coste total de propiedad y, lo que es crucial, incluye una API de inferencia gestionada (Token Factory) que CoreWeave no iguala. CoreWeave tiene una mayor presencia en Norteamérica y Europa y se apoya en contratos multianuales con *hyperscalers*, mientras que Nebius ofrece GPU por horas totalmente de autoservicio sin compromiso mínimo y fue rentable en 2025, mientras que CoreWeave registró grandes pérdidas. Frente a Together AI, el contraste radica en la profundidad de la infraestructura: Together es principalmente una API de inferencia con *endpoints* dedicados opcionales, mientras que Nebius posee centros de datos físicos y puede servir tanto clústeres multinodo de nivel de entrenamiento como inferencia desde una sola cuenta, con residencia explícita de datos en la UE que Together, centrado en EE. UU., no enfatiza. Para un equipo europeo sujeto al RGPD, esa residencia suele ser el factor decisivo, y las necesidades de GPU más ligeras también pueden satisfacerse con alternativas en vivo como Crusoe o RunPod.

Cuánto cuestan la nube de GPU y Token Factory

Los precios de las GPU son transparentes y competitivos: una H100 cuesta $3.85 por hora bajo demanda o $2.15 preferente (*preemptible*), una H200 cuesta $4.50 o $2.45, y una B200 cuesta $7.15 o $3.95, con descuentos de hasta el 35% en clústeres reservados para compromisos de varios meses. La inferencia de Token Factory va desde unos $0.08 por millón de *tokens* para modelos pequeños hasta aproximadamente $1.93 para los *premium*, con descuentos por lotes y grandes ahorros de caché en contextos repetidos. No hay prueba gratuita de GPU, y un depósito mínimo de $25 activa la facturación.

"Al aprovechar los *endpoints* dedicados, aseguramos un rendimiento garantizado. El escalado automático marcó la diferencia, permitiéndonos manejar 200 mil millones de *tokens* por día sin intervención manual". Zulkuf Genc, Director de IA en Prosus, noviembre de 2025.

Hay créditos disponibles, pero están restringidos en lugar de ser abiertos: las startups de NVIDIA Inception pueden solicitar hasta $150,000 a través del programa AI Lift, y los investigadores académicos pueden solicitar subvenciones. Para la mayoría de los equipos, el punto de entrada es simplemente un depósito y el medidor por hora o por *token*.

La fricción de operar en Nebius

El problema más reportado son las sorpresas en la facturación. No hay un botón único para pausar la cuenta ni un apagado automático por inactividad, por lo que los recursos que se dejan en ejecución acumulan cargos silenciosamente, y un experimento nocturno puede convertirse en una factura de meses si olvida eliminar cada máquina virtual, disco y *bucket*. El propio tono de la plataforma invita a ello.

"La interfaz parece construida para desplegar primero y optimizar después". Reseña de Automateed, 2026.

Más allá de la facturación, Nebius reconoció que su hardware B300 más reciente fue menos estable hasta mediados de 2025 mientras implementaba mejoras de autorrecuperación; los tiempos de respuesta del soporte de autoservicio de 24 a 48 horas van por detrás de los *hyperscalers*, la documentación está por detrás de AWS y GCP en funciones avanzadas, y no hay región de Asia-Pacífico a mediados de 2026, lo cual es un obstáculo insalvable para las cargas de trabajo de baja latencia en APAC en lugar de una simple preferencia.

Para quién es adecuado Nebius y para quién no

Nebius es una excelente opción para los equipos con sede en la UE que necesitan inferencia compatible con el RGPD con residencia real de datos, para los laboratorios de IA que ejecutan entrenamiento multinodo o ajuste fino a gran escala en clústeres InfiniBand, para los equipos que desean un solo proveedor tanto para la computación de entrenamiento como para una API de inferencia en producción, y para las empresas que necesitan SOC 2 Type II, ISO 27001 o HIPAA. Las startups de NVIDIA Inception que califican para los créditos de AI Lift obtienen una generosa vía de acceso.

No es la opción adecuada para los equipos que necesitan cobertura en la región APAC, para los principiantes que tal vez no supervisen y apaguen activamente los recursos, para las cargas de trabajo que requieren modelos fundacionales propietarios como GPT o Claude (Token Factory es solo para modelos abiertos), o para cualquiera que desee la profunda comunidad, los tutoriales y la documentación madura de un *hyperscaler*. El producto es potente, pero aún está madurando en algunos aspectos.

Reseñas de usuarios

Aún no hay reseñas. ¡Sé el primero en compartir tu experiencia!

Inicia sesión para escribir una reseña.

Artículos relacionados

Guías y artículos relacionados con Nebius.