SiliconFlow es una plataforma de inferencia con sede en China que ofrece una API compatible con OpenAI para más de 200 modelos, incluidas las familias DeepSeek, Qwen, GLM y Kimi. Es económica y amplia, pero la residencia de datos en China y el requisito de verificación con nombre real la convierten en una opción que los equipos occidentales deben evaluar con cuidado.
SiliconFlow es una empresa de infraestructura de IA con sede en China cuyo producto estrella, SiliconCloud, ofrece a los desarrolladores una única API compatible con OpenAI para más de 200 modelos de texto, imagen, video, audio, incrustaciones (embeddings) y reclasificación (reranking). Fue fundada en 2023 por Yuan Jinhui, ex director ejecutivo del marco de aprendizaje profundo OneFlow, y Pan Yang, y es conocida principalmente como el principal proveedor comercial de las familias de modelos de código abierto chinos: DeepSeek, Qwen, GLM, Kimi, MiniMax y Step. La plataforma funciona con su propio motor de inferencia SiliconLLM tanto en GPU de NVIDIA como en chips Huawei Ascend, y cerró una ronda de financiación Serie A liderada por Alibaba Cloud en 2025. Si alguna vez ha intentado acceder a un modelo de frontera chino desde fuera de China y se ha topado con un muro, SiliconFlow suele ser la plataforma que lo soluciona.
Una sola clave permite acceder a modelos de razonamiento y chat como DeepSeek y Qwen, modelos de imagen que incluyen FLUX y el gratuito Kolors, video a través de Wan2.2, voz con CosyVoice2 y Fish-Speech, y un conjunto completo de modelos de incrustación y reclasificación para la recuperación de información. Las cuentas nuevas obtienen un dólar de crédito gratuito además de varios modelos que son permanentemente gratuitos; los precios parten de aproximadamente $0.10 por millón de tokens para los modelos pequeños, y un flujo de trabajo gestionado permite ajustar (fine-tune) variantes de Qwen2.5. Dado que la API es compatible con OpenAI, la mayoría de los equipos simplemente apuntan un cliente existente a la URL base de SiliconFlow y ejecutan su código sin cambios. La advertencia importante va de la mano con su atractivo: la inferencia se realiza en infraestructura china, la verificación con nombre real se volvió obligatoria en mayo de 2026 y no existe documentación SOC2 ni GDPR, por lo que la residencia de los datos es una decisión crítica y no un simple detalle.
Un vistazo a SiliconFlow, junio de 2026
SiliconCloud es una plataforma de modelo como servicio (MaaS), no una aplicación de chat ni un IDE. Usted se registra, obtiene una clave API y llama a los modelos a través de HTTP. Su principal atractivo es la amplitud: más de 200 modelos bajo una sola cuenta. El catálogo de lenguajes es donde realmente destaca, incluyendo DeepSeek V4, la familia Qwen 3.5 desde 9B hasta grandes variantes de mezcla de expertos (MoE), GLM 5.x, Kimi de Moonshot AI, MiniMax y Step, muchos de los cuales son difíciles o imposibles de alcanzar a través de un proveedor occidental. Junto a los modelos de lenguaje se encuentran las incrustaciones de BAAI y Qwen, los reclasificadores de Qwen3, FLUX y Kolors para imágenes, Wan2.2 para video, y CosyVoice2 y Fish-Speech para audio.
Dos detalles operativos definen cómo se utiliza. Primero, hay dos puntos de enlace (endpoints) de API: uno internacional en el dominio .com y otro para China continental en .cn, y la plataforma ha estado dirigiendo a los usuarios hacia el .cn. Segundo, la misma interfaz compatible con OpenAI significa que el costo de migración desde otro proveedor se reduce, en su mayor parte, a cambiar una URL base y una clave. Están disponibles tanto la opción sin servidor (serverless) de pago por uso como los puntos de enlace dedicados y reservados, y se ofrece ajuste fino (fine-tuning) para varias variantes de instrucción de Qwen2.5.
En qué destaca realmente SiliconFlow
La verdadera ventaja competitiva de la plataforma es el acceso a modelos chinos a gran escala. Su gran salto se produjo en enero de 2025, cuando DeepSeek-R1 y V3 se volvieron virales en todo el mundo y SiliconFlow fue la primera plataforma en ofrecer ambos a gran escala en hardware Huawei Ascend, además de NVIDIA. Ese momento se tradujo en ingresos y validación.
"Nuestro negocio ha crecido de forma explosiva desde principios de este año con el auge de los grandes modelos de código abierto, incluidos Qwen de Alibaba y DeepSeek, así como por la creciente demanda de potencia de inferencia de IA". Yuan Jinhui, fundador de SiliconFlow, Yicai Global, 10 de junio de 2025.
Más allá de la variedad de modelos, SiliconFlow es genuinamente económico en sus modelos más pequeños, totalmente multimodal bajo una sola factura y amigable con el código existente gracias a su compatibilidad con OpenAI. Los equipos que ejecutan flujos de trabajo de recuperación de información pueden obtener chat, incrustaciones y reclasificación de un solo proveedor, y los modelos pequeños permanentemente gratuitos, junto con un dólar de crédito inicial, hacen que la evaluación sea casi sin fricciones. Para cualquiera que necesite específicamente inferencia de DeepSeek que no dependa del hardware de NVIDIA, la asociación de SiliconFlow con Huawei Cloud lo convierte en la opción principal documentada.
Dónde falla SiliconFlow: los límites con los que se topan los usuarios
El problema más práctico es la limitación de la tasa de solicitudes (rate limiting). Los límites del nivel gratuito son estrictos y se aplican con rigor, y los marcos de integración que envían solicitudes simultáneas pueden provocar bloqueos a nivel de cuenta con poco aviso.
"Para evitar ser baneado, establezca el máximo de solicitudes por segundo para las incrustaciones de siliconflow. El sistema no ha impuesto ninguna restricción y puedo ver una gran cantidad de solicitudes bloqueadas en los registros del backend". ukhack, problema en GitHub Dify, septiembre de 2024.
El mayor obstáculo para los usuarios no chinos es la identidad. Desde mayo de 2026, la verificación con nombre real es obligatoria, y las cuentas no verificadas no pueden agregar fondos ni solicitar facturas. La verificación acepta documentos de identidad chinos específicos, y los pasaportes extranjeros estándar no se aceptan en línea, por lo que muchos desarrolladores occidentales pueden evaluar con crédito gratuito pero no pueden escalar realmente sin contactar al soporte. Además de eso, la lista de modelos cambia agresivamente. A lo largo de 2025 y hasta 2026, las notas de la versión muestran frecuentes obsolescencias y varios modelos que antes eran gratuitos pasaron a ser de pago, lo cual es un riesgo si usted vincula un flujo de trabajo a un solo modelo. Las pruebas de rendimiento independientes también han señalado la falta del modo JSON en algunos modelos, un problema real para los flujos de trabajo de salida estructurada, y las afirmaciones de privacidad de la plataforma no están respaldadas por ninguna auditoría independiente. Nada de esto está oculto, pero todo requiere planificación.
SiliconFlow vs Together AI vs DeepInfra
Frente a Together AI, la diferencia radica en la geografía y el catálogo. Together ejecuta sus propios clústeres de GPU en los Estados Unidos, registra un sólido rendimiento de alrededor de 900 tokens por segundo, admite el ajuste fino y no presenta fricciones por nombre real o residencia de datos, pero no ofrece las exclusivas chinas. SiliconFlow es frecuentemente la única forma práctica de acceder a GLM, Kimi, MiniMax y Step a escala de API. Frente a DeepInfra, el contraste es precio versus características: DeepInfra tiene sede en EE. UU., se posiciona como un líder de bajo costo y puede superar a SiliconFlow en precio en modelos compartidos como DeepSeek y Qwen, pero no ofrece ajuste fino ni el catálogo de la familia china. Fireworks AI es un tercer punto de referencia, optimizado para un tiempo hasta el primer token (TTFT) muy bajo en modelos abiertos occidentales con almacenamiento en caché de prompts, pero nuevamente sin los modelos chinos ni la amplitud de imagen, video y audio de SiliconFlow. El patrón es consistente. Para modelos abiertos occidentales con baja fricción regulatoria, un proveedor estadounidense o una capa de enrutamiento como OpenRouter es más simple. Para modelos chinos y amplitud multimodal, SiliconFlow gana por defecto.
¿Es SiliconFlow realmente más barato?
Para sus modelos pequeños y medianos, sí. Qwen3.5-9B cuesta alrededor de $0.10 por millón de tokens de entrada, e incluso un modelo grande como DeepSeek-V4-Pro se sitúa en aproximadamente $1.60 de entrada y $3.14 de salida por millón, siendo la entrada en caché mucho más barata. La generación de imágenes comienza en medio centavo para Z-Image-Turbo y llega a cuatro centavos para FLUX 1.1 pro, y un video de Wan2.2 cuesta alrededor de $0.29. Los modelos gratuitos y el dólar de crédito inicial significan que la evaluación no cuesta nada, y los niveles de límite de tasa de L0 a L5 aumentan su rendimiento automáticamente a medida que crece el gasto mensual. La salvedad honesta es que, en los modelos exactos que también puede obtener en otros lugares, un competidor estadounidense como DeepInfra puede igualar o superar el precio combinado sin los gastos generales de verificación y residencia, por lo que el argumento del ahorro es más fuerte cuando realmente necesita el catálogo chino.
Mejores casos de uso (y cuándo evitarlo)
SiliconFlow es una opción predeterminada sólida para desarrolladores en China o que crean productos orientados a China, para cualquiera que evalúe o ejecute DeepSeek, Qwen, GLM, Kimi o MiniMax a escala de API, para flujos de trabajo multimodales que requieren texto, imagen, audio y recuperación de un solo proveedor, y para equipos que necesitan específicamente inferencia alojada en Ascend. Evítelo cuando la residencia de datos fuera de China sea un requisito, ya que toda la inferencia se ejecuta en infraestructura china sin documentación de cumplimiento occidental. Evítelo si no puede completar la verificación con nombre real, ya que eso limita la funcionalidad de la cuenta. Y si solo necesita modelos abiertos occidentales, un proveedor de EE. UU. o una capa de enrutamiento evita por completo las cuestiones regulatorias por un costo similar.
Primeros pasos con SiliconFlow
Regístrese en la consola de SiliconCloud, reclame el dólar de crédito gratuito y cree una clave API. Debido a que la API refleja la de OpenAI, por lo general solo necesita cambiar la URL base al punto de enlace de SiliconFlow e ingresar su clave, para luego llamar a un modelo por su nombre. Comience con los modelos permanentemente gratuitos o una variante económica de Qwen para validar su integración, agregue limitación de solicitudes (throttling) desde el principio para evitar activar los límites de tasa, y planifique la verificación con nombre real antes de intentar agregar fondos o pasar a un volumen de producción. Los equipos que se vinculan a un modelo específico deben estar atentos a las notas de la versión para ver las obsolescencias.
Reseñas de usuarios
Aún no hay reseñas. ¡Sé el primero en compartir tu experiencia!
Inicia sesión para escribir una reseña.
Artículos relacionados
Guías y artículos relacionados con SiliconFlow.

Grok 4.3 API for Agents (May 2026): Pricing, Benchmarks, Migration

Vantaige Launches the LLM VRAM Calculator: A Free GPU Compatibility Finder for Open-source and Open-Weight AI

Google Vision AI Explained (2026): Pricing Per 1,000 Units, Free Tier, and Alternatives

DeepSeek V4 Pro vs Claude Opus 4.7: 5-PR Refactor Test (2026)

OpenAI GPT-Realtime-2 (May 2026): Pricing, Latency & 30-Min Voice Agent
