DeepSeek sube los precios de su API tras colapsar su infraestructura de 20.000 GPU por un pico de demanda
por Edgar OteroLa startup china DeepSeek ha notificado a sus desarrolladores un próximo incremento sustancial en las tarifas de su API tras sufrir una saturación masiva de sus servicios. Es un movimiento habitual en el sector que recuerda la peligrosidad de la dependencia de las empresas con respecto a los proveedores de IA. El alud de peticiones recibido tras el lanzamiento de su modelo V4 Flash ha superado la capacidad de cómputo de la compañía. El cuello de botella ha obligado a la firma a encarecer el acceso a sus servidores para gestionar la carga.
Como recuerda WFFCTech, este movimiento se produce pocos días después de que OpenAI iniciara una agresiva rebaja comercial en su modelo GPT-5.6 Luna, recortando sus precios hasta un 80% para presionar a los laboratorios asiáticos. En respuesta, la firma china lanzó la versión actualizada V4 Flash 0731 con 284.000 millones de parámetros. La tarifa de 0,14 dólares por millón de tokens de entrada anuló de inmediato la ventaja competitiva planteada por la firma estadounidense.
La respuesta comercial que desbordó el clúster de NVIDIA H100
La propuesta de DeepSeek no solo igualó en rendimiento a modelos de gama alta como Claude Opus 4.8 o GPT-5.6, sino que lo hizo a una fracción de su coste operativo. Como se podía esperar, la diferencia abismal de precio generó una migración masiva de desarrolladores hacia la plataforma. La demanda multiplicó el tráfico hasta niveles insostenibles para la infraestructura actual del laboratorio de Hangzhou.
El principal problema radica en el volumen limitado de hardware que opera la compañía, estimado en un clúster de aproximadamente 20.000 tarjetas procesadoras NVIDIA H100. Esta limitación física provocó que la velocidad de inferencia del modelo decayera drásticamente durante las horas de mayor actividad. Las demoras en los tiempos de respuesta afectaron gravemente a las aplicaciones integradas a través de la interfaz de programación.
La estrategia de lanzar modelos de alto rendimiento a precios mínimos forma parte de la identidad que el laboratorio ha consolidado desde sus inicios. Como analizamos en su momento, la empresa ha redefinido los márgenes de la industria. Sin embargo, este último incremento demuestra las limitaciones de sostener precios reducidos ante volúmenes de uso masivos. La IA, hoy por hoy, sigue siendo cara, no solo en la fase de entrenamiento, sino en la inferencia.
Reajuste exclusivo para la API y continuidad de los modelos de código abierto
El aviso enviado a los clientes especifica que el encarecimiento afectará de forma directa a la infraestructura en la nube gestionada por la empresa. Asimismo, la compañía prevé implementar un sistema de precios por franjas horarias con recargos en horas punta. El ajuste tarifario no impactará a los usuarios que ejecuten los pesos abiertos de sus modelos en sus propias arquitecturas de servidores.
Este reajuste llega tras el lanzamiento de DeepSeek-V4, una familia de modelos optimizada para gestionar ventanas de contexto de hasta un millón de tokens. Aunque las versiones abiertas continúan estando disponibles de manera gratuita para la comunidad, la vía comercial a través de API deja de ser una opción de coste residual para convertirse en un servicio sujeto a la disponibilidad real de hardware.
La saturación experimentada por el laboratorio chino otorga un alivio temporal a los gigantes tecnológicos estadounidenses en la batalla por el coste de la inferencia. Sin embargo, la brecha de rendimiento por dólar sigue situando a las alternativas asiáticas entre las opciones más eficientes del mercado.
Fin del Artículo. ¡Cuéntanos algo en los Comentarios!




