TNW→ original

Meituan entrenó modelo de IA LongCat-2.0 con 1,6 billones de parámetros enteramente en chips chinos

La empresa china Meituan anunció un modelo LongCat-2.0 con 1,6 billones de parámetros, que la empresa dice es el primer modelo de esta escala entrenado end-to-end enteramente en chips chinos nacionales. Meituan lo llama directamente una respuesta a las restricciones de exportación estadounidenses en chips de IA avanzados.

Procesado por IA desde TNW; editado por Hamidun News
Meituan entrenó modelo de IA LongCat-2.0 con 1,6 billones de parámetros enteramente en chips chinos
Fuente: TNW. Collage: Hamidun News.
◐ Escuchar artículo

La empresa china Meituan anunció que su nuevo modelo de IA LongCat-2.0 con 1,6 billones de parámetros se convirtió en el primer modelo de tal escala entrenado completamente en chips chinos domésticos, un movimiento que la empresa llama directamente una respuesta a las restricciones de exportación de EE.UU.

Qué se sabe sobre el modelo LongCat-2.0

El aspecto más notable del nuevo modelo de Meituan no es su tamaño, aunque es considerable, sino el hardware en el que fue entrenado. La empresa afirma que LongCat-2.0 se convirtió en el primer modelo de tal escala entrenado end-to-end en chips chinos domésticos, en lugar de en procesadores de fabricantes occidentales.

  • Nombre del modelo — LongCat-2.0, con 1,6 billones de parámetros.
  • El modelo, según la empresa, es el primero de esta escala que fue completamente entrenado en chips chinos domésticos.
  • Meituan vincula directamente este movimiento a las restricciones de exportación de EE.UU. en chips avanzados.

Por qué esto es una respuesta a las restricciones de exportación de EE.UU.

Entrenar un modelo con 1,6 billones de parámetros completamente en hardware doméstico es una tarea técnicamente compleja, que típicamente requiere chips optimizados para una arquitectura específica y volumen de cómputo. Que Meituan haya logrado completar todo el proceso end-to-end sin usar chips occidentales, la empresa lo presenta directamente como una demostración de que las restricciones de exportación de EE.UU. no detienen el desarrollo de grandes modelos de IA chinos. El marco del anuncio en sí—no como noticias técnicas rutinarias, sino como una "respuesta dirigida," es decir, una respuesta directa y dirigida a la política de control de exportación—muestra que Meituan ve esta noticia primero y principalmente en contexto geopolítico en lugar de puramente de producto.

Qué distingue a LongCat-2.0 de otros modelos grandes

La mayoría de los modelos de escala comparable en todo el mundo continúan siendo entrenados usando chips de fabricantes occidentales, que siguen siendo el estándar de la industria para entrenar grandes modelos de lenguaje. El reclamo de Meituan de que LongCat-2.0 es el primer modelo de tal tamaño entrenado completamente en chips domésticos lo distingue en esta base—la empresa enfatiza no las características arquitectónicas del modelo, sino más bien la independencia de infraestructura del proceso de entrenamiento.

Qué significa esto

El anuncio de Meituan no es simplemente noticias de otro modelo de lenguaje grande, sino una señal de que las empresas de tecnología chinas son capaces de escalar modelos de IA de parámetros en billones en su propia base de chips. Si tales afirmaciones son verificadas y repetidas por otros jugadores, la significancia de las restricciones de exportación de EE.UU. como herramienta para contener la IA china disminuirá gradualmente, y la competencia en el desarrollo de los modelos de lenguaje más grandes finalmente dejará de depender de un único ecosistema de chips.

ZK
Hamidun News
Noticias de AI sin ruido. Selección editorial diaria de más de 50 fuentes. Producto de Zhemal Khamidun, Head of AI en Alpina Digital.

¿Quieres dejar de leer sobre IA y empezar a usarla?

AI News es un feed curado de noticias de IA. Hamidun Academy te enseña a usar la IA en tu trabajo.

¿Qué te parece?
Cargando comentarios…