Editorial · verificada por la redacción

MarkTechPost

Fuente de noticias de IA. Los artículos son seleccionados y adaptados por la redacción de Hamidun News.

290 artículos en Hamidun·Último: 17 de julio· Activo·marktechpost.com ↗

Últimas publicaciones

StepFun lanzó StepAudio 2.5 Realtime, un modelo de voz con soporte para roleplay
LLMMarkTechPost

StepFun lanzó StepAudio 2.5 Realtime, un modelo de voz con soporte para roleplay

El laboratorio chino StepFun lanzó StepAudio 2.5 Realtime, un modelo de voz que supera a los competidores en naturalidad del habla y adapta la voz según el escenario del usuario.

25 may 2026·2 min
Langfuse para Ingenieros de LLM: Pipeline Completo de Trazado y Experimentos
LLMMarkTechPost

Langfuse para Ingenieros de LLM: Pipeline Completo de Trazado y Experimentos

Langfuse es una herramienta para depuración y optimización de aplicaciones LLM. Aprenda cómo configurar un pipeline completo de monitoreo, gestión de prompts y experimentos sin modelos pagos.

25 may 2026·2 min
WorkOS presenta auth.md — protocolo abierto para registro de agentes de IA
LLMMarkTechPost

WorkOS presenta auth.md — protocolo abierto para registro de agentes de IA

WorkOS lanzó auth.md — un estándar abierto que permite a los agentes de IA registrarse en aplicaciones a través de un archivo Markdown sin intervención humana.

25 may 2026·3 min
ByteDance presentó Lance: un modelo para comprensión, generación y edición de video
LLMMarkTechPost

ByteDance presentó Lance: un modelo para comprensión, generación y edición de video

ByteDance lanzó Lance, un modelo abierto que en un único marco trabaja con imágenes y video: comprende, genera y edita contenido utilizando solo 3B de parámetros activos.

25 may 2026·2 min
Cohere lanza Command A+: 218 mil millones de parámetros para agentes en dos GPUs
LLMMarkTechPost

Cohere lanza Command A+: 218 mil millones de parámetros para agentes en dos GPUs

Cohere presentó el modelo abierto Command A+ con 218 mil millones de parámetros y capacidades multimodales, ejecutándose en dos GPUs H100 y compatible con 48 idiomas.

25 may 2026·2 min
Perplexity Abre el Scanner Bumblebee para Proteger Sistemas de Desarrollo
LLMMarkTechPost

Perplexity Abre el Scanner Bumblebee para Proteger Sistemas de Desarrollo

Perplexity ha publicado el código fuente de Bumblebee, una herramienta para escanear vulnerabilidades en las dependencias de sistemas de desarrollo sin ejecutar ningún código.

25 may 2026·2 min
Alibaba presentó Qwen3.7-Max: un agente con contexto de un millón de tokens
LLMMarkTechPost

Alibaba presentó Qwen3.7-Max: un agente con contexto de un millón de tokens

Alibaba presentó Qwen3.7-Max, el modelo agente más avanzado de Qwen con contexto de 1M de tokens y modo de razonamiento para tareas complejas multietapa.

25 may 2026·3 min
CopilotKit redefine la arquitectura para agentes de IA en 2026
LLMMarkTechPost

CopilotKit redefine la arquitectura para agentes de IA en 2026

CopilotKit lanzó un nuevo stack para desarrolladores de IA agentic: protocolo AG-UI, plataforma de pruebas AIMock y servidor Pathfinder — una solución completa para entornos de producción.

25 may 2026·3 min
OpenMythos: construyendo transformers avanzados con MLA y GQA en Colab
LLMMarkTechPost

OpenMythos: construyendo transformers avanzados con MLA y GQA en Colab

OpenMythos permite construir transformers recurrentes en Google Colab comparando arquitecturas MLA y GQA. El tutorial verifica estabilidad mediante análisis de radios espectrales de matrices de inyección.

25 may 2026·2 min
Nous Research presentó CNA: gestión del comportamiento de LLM sin reentrenamiento
LLMMarkTechPost

Nous Research presentó CNA: gestión del comportamiento de LLM sin reentrenamiento

La empresa Nous Research presentó el método Contrastive Neuron Attribution (CNA), que permite gestionar el comportamiento de grandes modelos de lenguaje identificando y desactivando circuitos neuronales individuales sin

25 may 2026·3 min
Ocho mejores plataformas de autenticación para agentes de IA y MCP en 2026
LLMMarkTechPost

Ocho mejores plataformas de autenticación para agentes de IA y MCP en 2026

MCP alcanzó 97 millones de descargas de SDK al mes. Los agentes de IA están migrando masivamente de experimentos a entornos de producción, y elegir la plataforma de autenticación correcta se ha…

25 may 2026·2 min
SuperClaude Framework ayuda a estructurar workflows para Claude API
LLMMarkTechPost

SuperClaude Framework ayuda a estructurar workflows para Claude API

SuperClaude Framework proporciona a los desarrolladores componentes integrados para crear workflows de IA avanzados: comandos, agentes, modos de ejecución y memoria de sesión — todo en un único sistema.

25 may 2026·2 min
Tencent lanzó TencentDB Agent Memory, sistema de memoria local para agentes de IA
LLMMarkTechPost

Tencent lanzó TencentDB Agent Memory, sistema de memoria local para agentes de IA

Tencent abrió el código fuente de TencentDB Agent Memory, un sistema de memoria local para agentes de IA que reduce el consumo de tokens en un 61% y aumenta la precisión en un 28%.

25 may 2026·3 min
NVIDIA Presenta Gated DeltaNet-2: Atención Lineal con Compuertas de Memoria Separadas
LLMMarkTechPost

NVIDIA Presenta Gated DeltaNet-2: Atención Lineal con Compuertas de Memoria Separadas

NVIDIA ha creado un nuevo mecanismo de atención lineal, Gated DeltaNet-2, que mejora la gestión de memoria en grandes modelos de lenguaje mediante compuertas separadas de borrado y escritura en lugar de una única compuer

25 may 2026·3 min
Google presentó Gemini 3.5 Flash: un modelo rápido y económico para codificación y agentes de IA
LLMMarkTechPost

Google presentó Gemini 3.5 Flash: un modelo rápido y económico para codificación y agentes de IA

En I/O 2026, Google presentó Gemini 3.5 Flash, un modelo 75% más económico que la versión insignia, que funciona 4 veces más rápido y se desempeña mejor en codificación y automatización.

21 may 2026·3 min
Alibaba lanza un traductor con latencia de 2.8 segundos en 60 idiomas
LLMMarkTechPost

Alibaba lanza un traductor con latencia de 2.8 segundos en 60 idiomas

Alibaba presentó un modelo para traducir video y voz en tiempo real de forma simultánea en 60 idiomas, con latencia mínima y preservación de la voz del hablante.

21 may 2026·2 min
NVIDIA presentó Nemotron-Labs-Diffusion: un modelo con decodificación triple
LLMMarkTechPost

NVIDIA presentó Nemotron-Labs-Diffusion: un modelo con decodificación triple

NVIDIA lanzó el modelo de lenguaje Nemotron-Labs-Diffusion, que combina tres modos de decodificación y procesa tokens 6 veces más rápido que Qwen3-8B.

21 may 2026·2 min
Generación de grafos de conocimiento a partir de texto: guía práctica con kg-gen y NetworkX
LLMMarkTechPost

Generación de grafos de conocimiento a partir de texto: guía práctica con kg-gen y NetworkX

Tutorial sobre la extracción automática de entidades y relaciones a partir de texto con kg-gen, la construcción de grafos de conocimiento interactivos y su análisis con NetworkX.

21 may 2026·3 min
Turbovec: índice vectorial en Rust con el algoritmo TurboQuant de Google Research
LLMMarkTechPost

Turbovec: índice vectorial en Rust con el algoritmo TurboQuant de Google Research

Turbovec utiliza el algoritmo TurboQuant de Google para comprimir vectores 16x sin entrenamiento previo, lo que simplifica el despliegue de aplicaciones RAG.

21 may 2026·2 min
Las mejores plataformas para AI agéntica en 2026: clasificación de Salesforce, Microsoft y otras
LLMMarkTechPost

Las mejores plataformas para AI agéntica en 2026: clasificación de Salesforce, Microsoft y otras

Las empresas pasan de los pilotos a producción. MarkTechPost elaboró una clasificación de las 10 principales plataformas para AI agéntica: Salesforce Agentforce, Microsoft Copilot Studio, ServiceNow y otras. Precios veri

19 may 2026·3 min
NVIDIA desarrolló un método para entrenar redes neuronales con precisión de 4-bit
LLMMarkTechPost

NVIDIA desarrolló un método para entrenar redes neuronales con precisión de 4-bit

NVIDIA presentó NVFP4, una metodología para entrenar modelos grandes con precisión de 4-bit en lugar de la 8-bit estándar, reduciendo el uso de memoria a la mitad sin pérdida de calidad.

19 may 2026·3 min
OpenAI presenta el protocolo MRC para redes de supercomputadoras con millones de GPUs
LLMMarkTechPost

OpenAI presenta el protocolo MRC para redes de supercomputadoras con millones de GPUs

OpenAI creó un nuevo protocolo de red abierto, MRC, para grandes clústeres de AI. Distribuye datos por cientos de rutas y se recupera de fallos en microsegundos, lo que permite construir supercomputadoras con más de 100

17 may 2026·3 min
Meta AI presentó NeuralBench — framework para probar modelos de actividad cerebral
LLMMarkTechPost

Meta AI presentó NeuralBench — framework para probar modelos de actividad cerebral

Meta lanzó NeuralBench, un framework abierto para la evaluación estandarizada de modelos de AI basados en EEG, que reúne 36 tareas, 94 conjuntos de datos y 13,603 horas de registros cerebrales en una sola interfaz.

17 may 2026·2 min
Cómo comprimir un modelo de lenguaje 3x: guía de FP8, GPTQ y SmoothQuant
LLMMarkTechPost

Cómo comprimir un modelo de lenguaje 3x: guía de FP8, GPTQ y SmoothQuant

Los desarrolladores recibieron una guía paso a paso para comprimir grandes modelos de lenguaje con llmcompressor, comparando la eficacia de la cuantización FP8, GPTQ y SmoothQuant para reducir la carga sobre el hardware.

17 may 2026·3 min
OpenAI lanzó tres modelos de audio: traducción, transcripción y razonamiento en tiempo real
LLMMarkTechPost

OpenAI lanzó tres modelos de audio: traducción, transcripción y razonamiento en tiempo real

OpenAI amplió la Realtime API con tres nuevos modelos de audio para el procesamiento de voz: agentes de razonamiento, traducción multilingüe y transcripción en streaming.

17 may 2026·2 min
Anthropic creó una herramienta para traducir los pensamientos de Claude a lenguaje humano
LLMMarkTechPost

Anthropic creó una herramienta para traducir los pensamientos de Claude a lenguaje humano

Anthropic desarrolló Natural Language Autoencoders, una tecnología que traduce las activaciones internas de Claude en explicaciones textuales y revela cómo funciona la red neuronal.

17 may 2026·2 min
NVIDIA empaquetó 3 modelos en un archivo y logró un entrenamiento 360× más eficiente
LLMMarkTechPost

NVIDIA empaquetó 3 modelos en un archivo y logró un entrenamiento 360× más eficiente

NVIDIA presentó Star Elastic, un método que empaqueta tres modelos de distintos tamaños en un solo checkpoint y permite un entrenamiento 360× más eficiente.

17 may 2026·3 min
NVIDIA lanzó cuda-oxide: un compilador de código Rust para GPU
LLMMarkTechPost

NVIDIA lanzó cuda-oxide: un compilador de código Rust para GPU

NVIDIA presentó cuda-oxide, una herramienta para compilar funciones Rust directamente a código PTX para GPU. Esto simplificará el desarrollo de aplicaciones CUDA en Rust y hará más accesible la computación paralela.

17 may 2026·1 min
NadirClaw: ahorro en solicitudes de LLM con enrutamiento inteligente de prompts
LLMMarkTechPost

NadirClaw: ahorro en solicitudes de LLM con enrutamiento inteligente de prompts

NadirClaw es una herramienta de enrutamiento inteligente de prompts que clasifica las solicitudes como simples o complejas y las dirige al modelo adecuado para reducir costos.

17 may 2026·2 min
Hermes Agent de Nous Research tomó el liderazgo en consumo de tokens en OpenRouter
LLMMarkTechPost

Hermes Agent de Nous Research tomó el liderazgo en consumo de tokens en OpenRouter

El agente de AI open-source Hermes Agent, de Nous Research, superó a la plataforma de código cerrado OpenClaw y ocupó el primer lugar en OpenRouter, generando 224 mil millones de tokens al día. Esto ocurrió en solo tres

17 may 2026·3 min