SkyPilot y Hugging Face lanzaron almacenamiento sin cargos por tráfico de salida
Hugging Face y SkyPilot lanzaron el 7 de julio de 2026 una integración que elimina los cargos por tráfico de salida en el entrenamiento multicloud. Hugging Face Storage ($12-18/TB/mes) se monta en un job mediante una URL con formato hf:// — los datos se leen en streaming, sin copiarse por completo al disco. AWS S3, con una tarifa de $0,09/GB por tráfico, resulta más caro. En el fine-tuning de Qwen3.5-4B, la velocidad de escritura de checkpoints alcanzó 168 MB/s en una GPU L40S.
Procesado por IA desde Hugging Face Blog; editado por Hamidun News
Hugging Face y SkyPilot el 7 de julio de 2026 lanzaron integración de almacenamiento en la nube: los desarrolladores ahora pueden ejecutar cargas de trabajo de IA en cualquiera de 20+ servicios en la nube, leyendo pesos de modelos y conjuntos de datos directamente desde Hugging Face sin cargos de salida.
¿Por qué el tráfico de salida se convirtió en un problema?
Los equipos que entrenan modelos a menudo mantienen GPU con múltiples proveedores de nube simultáneamente—dondequiera que se encuentren recursos libres. Almacenar datos en cada nube es costoso e inconveniente, y transferir datos entre proveedores cuesta aproximadamente $0.09/GB en AWS. Con conjuntos de datos de cientos de gigabytes, los cargos de salida rápidamente superan los costos de cálculo.
Hechos clave sobre la integración:
- Anuncio – 7 de julio de 2026, desarrollo conjunto de equipos SkyPilot y Hugging Face
- Almacenamiento de Hugging Face: $12–18/TB/mes, tráfico de salida—gratis
- AWS S3: ~$23/TB más $0.09/GB por tráfico de salida
- Velocidad de carga del modelo cuando está montado: hasta 500 MB/s, inicio en frío ~30 segundos
- Instalación de una línea: `pip install "skypilot[huggingface]"`
¿Cómo funciona el montaje a través de hf://?
Nuevo backend `store: hf` en configuración de SkyPilot acepta direcciones en formato `hf://`—repositorios con modelos, conjuntos de datos o depósitos. La autorización pasa a través de la variable de entorno `HF_TOKEN`.
Se admiten dos modos de acceso. MOUNT—lectura de transmisión a través de FUSE: solo se cargan bytes solicitados, sin copiar el archivo completo. COPY—precarga a través de `huggingface_hub` con caché de disco. Los depósitos de Hugging Face están abiertos para lectura y escritura (para puntos de control), repositorios de modelos y conjuntos de datos—solo lectura con fijación de revisión opcional.
Hugging Face también agregó parches FUSE que permiten montar sin derechos de superusuario—un requisito estándar de Kubernetes donde root no está disponible.
¿Qué tan rápido se escriben los puntos de control?
Los equipos probaron el ajuste fino del modelo Qwen3.5-4B en el conjunto de datos Multilingual-Thinking en tres nubes simultáneamente: AWS con GPU L40S mostró ~168 MB/s, GCP con L4—~123 MB/s, Lambda con H100—~112 MB/s. La varianza entre proveedores es mínima y se ajusta dentro de rangos de carga de trabajo típicos.
Ganancias adicionales proporcionadas por deduplicación a través de tecnología Xet: los archivos se dividen en bloques ~64 KB por contenido, y la carga repetida omite bloques ya conocidos. En la práctica, agregar 10,000 filas a una tabla Parquet de 100,000 filas transfirió ~10 MB en lugar de ~106 MB, y recargar un blob de 8.43 GB llevó 8 segundos en lugar de 24.
Qué significa esto
Los cargos de salida fueron una barrera oculta que obligaba a los equipos a mantener datos y cálculo en una nube. La integración de SkyPilot y Hugging Face Storage elimina esta barrera: los equipos pueden elegir GPU por disponibilidad y precio de cualquier proveedor sin perder dinero en tráfico.
Preguntas frecuentes
¿Puedes escribir puntos de control de vuelta a Hugging Face?
Sí—los depósitos de Hugging Face admiten lectura y escritura. Los repositorios de modelos y conjuntos de datos son de solo lectura. Al escribir desde la nube a Hugging Face, se aplican cargos de salida estándar del proveedor de nube—solo la entrada desde Hugging Face es gratuita.
¿Qué infraestructuras admite SkyPilot?
SkyPilot funciona con 20+ proveedores de nube, clústeres de Kubernetes, Slurm e infraestructura local. La imagen base debe tener glibc 2.34+ y acceso a `/dev/fuse`.
¿Cuántas nubes admite la integración de
Hugging Face y SkyPilot? La integración admite 20+ proveedores de nube para ejecutar cargas de trabajo de IA.
¿Por qué el tráfico de salida es costoso al entrenar modelos?
La transferencia de datos entre proveedores de nube cuesta aproximadamente $0.09 por gigabyte en AWS. Con conjuntos de datos de cientos de gigabytes, los cargos de salida crecen rápidamente.
¿Necesitas IA funcionando dentro de tu empresa — no solo en tu feed de noticias?
Construyo IA en producción para empresas — CRM a medida, herramientas internas, agentes autónomos, automatización de procesos. Tuya, adaptada a tu proceso, sin coste por usuario. Creado por Zhemal Khamidun, CPO de AlpinaGPT (plataforma de IA, 6.000+ usuarios).
Lo esencial de la IA — una vez por semana
Siete historias que de verdad importaron, elegidas a mano. Sin ruido ni notas de prensa.
¡Listo! Revisa tu correo para la confirmación.