MarkTechPost
Fuente de noticias de IA. Los artículos son seleccionados y adaptados por la redacción de Hamidun News.
Últimas publicaciones

StepFun lanzó StepAudio 2.5 Realtime, un modelo de voz con soporte para roleplay
El laboratorio chino StepFun lanzó StepAudio 2.5 Realtime, un modelo de voz que supera a los competidores en naturalidad del habla y adapta la voz según el escenario del usuario.

Langfuse para Ingenieros de LLM: Pipeline Completo de Trazado y Experimentos
Langfuse es una herramienta para depuración y optimización de aplicaciones LLM. Aprenda cómo configurar un pipeline completo de monitoreo, gestión de prompts y experimentos sin modelos pagos.

WorkOS presenta auth.md — protocolo abierto para registro de agentes de IA
WorkOS lanzó auth.md — un estándar abierto que permite a los agentes de IA registrarse en aplicaciones a través de un archivo Markdown sin intervención humana.

ByteDance presentó Lance: un modelo para comprensión, generación y edición de video
ByteDance lanzó Lance, un modelo abierto que en un único marco trabaja con imágenes y video: comprende, genera y edita contenido utilizando solo 3B de parámetros activos.

Cohere lanza Command A+: 218 mil millones de parámetros para agentes en dos GPUs
Cohere presentó el modelo abierto Command A+ con 218 mil millones de parámetros y capacidades multimodales, ejecutándose en dos GPUs H100 y compatible con 48 idiomas.

Perplexity Abre el Scanner Bumblebee para Proteger Sistemas de Desarrollo
Perplexity ha publicado el código fuente de Bumblebee, una herramienta para escanear vulnerabilidades en las dependencias de sistemas de desarrollo sin ejecutar ningún código.

Alibaba presentó Qwen3.7-Max: un agente con contexto de un millón de tokens
Alibaba presentó Qwen3.7-Max, el modelo agente más avanzado de Qwen con contexto de 1M de tokens y modo de razonamiento para tareas complejas multietapa.

CopilotKit redefine la arquitectura para agentes de IA en 2026
CopilotKit lanzó un nuevo stack para desarrolladores de IA agentic: protocolo AG-UI, plataforma de pruebas AIMock y servidor Pathfinder — una solución completa para entornos de producción.

OpenMythos: construyendo transformers avanzados con MLA y GQA en Colab
OpenMythos permite construir transformers recurrentes en Google Colab comparando arquitecturas MLA y GQA. El tutorial verifica estabilidad mediante análisis de radios espectrales de matrices de inyección.

Nous Research presentó CNA: gestión del comportamiento de LLM sin reentrenamiento
La empresa Nous Research presentó el método Contrastive Neuron Attribution (CNA), que permite gestionar el comportamiento de grandes modelos de lenguaje identificando y desactivando circuitos neuronales individuales sin

Ocho mejores plataformas de autenticación para agentes de IA y MCP en 2026
MCP alcanzó 97 millones de descargas de SDK al mes. Los agentes de IA están migrando masivamente de experimentos a entornos de producción, y elegir la plataforma de autenticación correcta se ha…

SuperClaude Framework ayuda a estructurar workflows para Claude API
SuperClaude Framework proporciona a los desarrolladores componentes integrados para crear workflows de IA avanzados: comandos, agentes, modos de ejecución y memoria de sesión — todo en un único sistema.

Tencent lanzó TencentDB Agent Memory, sistema de memoria local para agentes de IA
Tencent abrió el código fuente de TencentDB Agent Memory, un sistema de memoria local para agentes de IA que reduce el consumo de tokens en un 61% y aumenta la precisión en un 28%.

NVIDIA Presenta Gated DeltaNet-2: Atención Lineal con Compuertas de Memoria Separadas
NVIDIA ha creado un nuevo mecanismo de atención lineal, Gated DeltaNet-2, que mejora la gestión de memoria en grandes modelos de lenguaje mediante compuertas separadas de borrado y escritura en lugar de una única compuer

Google presentó Gemini 3.5 Flash: un modelo rápido y económico para codificación y agentes de IA
En I/O 2026, Google presentó Gemini 3.5 Flash, un modelo 75% más económico que la versión insignia, que funciona 4 veces más rápido y se desempeña mejor en codificación y automatización.

Alibaba lanza un traductor con latencia de 2.8 segundos en 60 idiomas
Alibaba presentó un modelo para traducir video y voz en tiempo real de forma simultánea en 60 idiomas, con latencia mínima y preservación de la voz del hablante.

NVIDIA presentó Nemotron-Labs-Diffusion: un modelo con decodificación triple
NVIDIA lanzó el modelo de lenguaje Nemotron-Labs-Diffusion, que combina tres modos de decodificación y procesa tokens 6 veces más rápido que Qwen3-8B.

Generación de grafos de conocimiento a partir de texto: guía práctica con kg-gen y NetworkX
Tutorial sobre la extracción automática de entidades y relaciones a partir de texto con kg-gen, la construcción de grafos de conocimiento interactivos y su análisis con NetworkX.

Turbovec: índice vectorial en Rust con el algoritmo TurboQuant de Google Research
Turbovec utiliza el algoritmo TurboQuant de Google para comprimir vectores 16x sin entrenamiento previo, lo que simplifica el despliegue de aplicaciones RAG.

Las mejores plataformas para AI agéntica en 2026: clasificación de Salesforce, Microsoft y otras
Las empresas pasan de los pilotos a producción. MarkTechPost elaboró una clasificación de las 10 principales plataformas para AI agéntica: Salesforce Agentforce, Microsoft Copilot Studio, ServiceNow y otras. Precios veri

NVIDIA desarrolló un método para entrenar redes neuronales con precisión de 4-bit
NVIDIA presentó NVFP4, una metodología para entrenar modelos grandes con precisión de 4-bit en lugar de la 8-bit estándar, reduciendo el uso de memoria a la mitad sin pérdida de calidad.

OpenAI presenta el protocolo MRC para redes de supercomputadoras con millones de GPUs
OpenAI creó un nuevo protocolo de red abierto, MRC, para grandes clústeres de AI. Distribuye datos por cientos de rutas y se recupera de fallos en microsegundos, lo que permite construir supercomputadoras con más de 100

Meta AI presentó NeuralBench — framework para probar modelos de actividad cerebral
Meta lanzó NeuralBench, un framework abierto para la evaluación estandarizada de modelos de AI basados en EEG, que reúne 36 tareas, 94 conjuntos de datos y 13,603 horas de registros cerebrales en una sola interfaz.

Cómo comprimir un modelo de lenguaje 3x: guía de FP8, GPTQ y SmoothQuant
Los desarrolladores recibieron una guía paso a paso para comprimir grandes modelos de lenguaje con llmcompressor, comparando la eficacia de la cuantización FP8, GPTQ y SmoothQuant para reducir la carga sobre el hardware.

OpenAI lanzó tres modelos de audio: traducción, transcripción y razonamiento en tiempo real
OpenAI amplió la Realtime API con tres nuevos modelos de audio para el procesamiento de voz: agentes de razonamiento, traducción multilingüe y transcripción en streaming.

Anthropic creó una herramienta para traducir los pensamientos de Claude a lenguaje humano
Anthropic desarrolló Natural Language Autoencoders, una tecnología que traduce las activaciones internas de Claude en explicaciones textuales y revela cómo funciona la red neuronal.

NVIDIA empaquetó 3 modelos en un archivo y logró un entrenamiento 360× más eficiente
NVIDIA presentó Star Elastic, un método que empaqueta tres modelos de distintos tamaños en un solo checkpoint y permite un entrenamiento 360× más eficiente.

NVIDIA lanzó cuda-oxide: un compilador de código Rust para GPU
NVIDIA presentó cuda-oxide, una herramienta para compilar funciones Rust directamente a código PTX para GPU. Esto simplificará el desarrollo de aplicaciones CUDA en Rust y hará más accesible la computación paralela.

NadirClaw: ahorro en solicitudes de LLM con enrutamiento inteligente de prompts
NadirClaw es una herramienta de enrutamiento inteligente de prompts que clasifica las solicitudes como simples o complejas y las dirige al modelo adecuado para reducir costos.

Hermes Agent de Nous Research tomó el liderazgo en consumo de tokens en OpenRouter
El agente de AI open-source Hermes Agent, de Nous Research, superó a la plataforma de código cerrado OpenClaw y ocupó el primer lugar en OpenRouter, generando 224 mil millones de tokens al día. Esto ocurrió en solo tres