MarkTechPost
Fuente de noticias de IA. Los artículos son seleccionados y adaptados por la redacción de Hamidun News.
Últimas publicaciones

Meta abrió el código de Astryx — sistema de diseño en React con soporte para agentes de AI y MCP
Meta lanzó Astryx — un sistema de diseño open-source en React y StyleX con servidor MCP y CLI, en el que ingenieros y agentes de AI trabajan con una API única y los mismos componentes. *Meta está reconocida como organiza

Liquid AI lanzó LFM2.5-230M: 213 tokens/s en Galaxy S25 y soporte para llama.cpp
Liquid AI lanzó LFM2.5-230M, un modelo abierto de 230 millones de parámetros que funciona offline en un smartphone y en Raspberry Pi, superando en seguimiento de instrucciones a competidores cuatro veces más grandes.

Datalab lanza lift, un modelo de 9.000 millones de parámetros de pesos abiertos para extraer JSON de PDF
Datalab abrió el código de lift, un modelo visual de 9.000 millones de parámetros que convierte PDF e imágenes en JSON estructurado según un esquema definido, alcanzando un 90,2% de precisión por campo en un benchmark de

Z.ai lanza GLM-5.2: millón real de tokens y dos niveles de razonamiento profundo
Z.ai lanzó GLM-5.2 con una ventana de contexto realmente funcional de 1 millón de tokens, modos High y Max, y soporte para Claude Code, Cline y OpenClaw a través de una API compatible con Anthropic.

FineWeb sin descargar terabytes: streaming, filtrado y tokenización de corpus web para LLM
Una guía práctica de FineWeb de Hugging Face: cómo trabajar con un corpus web de múltiples terabytes para entrenamiento de LLM a través de streaming, filtrado, deduplicación y tokenización — sin descargar completamente l

Zyphra lanzó Zamba2-VL: modelos visuales con respuesta 10 veces más rápida
Zyphra lanzó Zamba2-VL — VLMs abiertos con 1,2B, 2,7B y 7B parámetros con arquitectura híbrida Mamba2 + Transformer, que reduce el tiempo hasta el primer token aproximadamente 10 veces.

Moonshot AI lanza Kimi Work — agente de escritorio con enjambre de 300 subagentes
Kimi Work de Moonshot AI se ejecuta localmente en macOS y Windows, controla el navegador a través de WebBridge y coordina un enjambre de hasta 300 subagentes paralelos.

Claude Code 2026: Análisis Completo de 25 Características de la Herramienta Agentiva con Ejemplos
MarkTechPost publicó una guía sobre Claude Code 2026 con análisis de 25 características — desde CLAUDE.md y skills hasta MCP, hooks y Auto Mode — con ejemplos de código y demo.

Google lanza Gemini-SQL2: Gemini 3.1 Pro obtiene 80% en el benchmark BIRD
Google Research presentó Gemini-SQL2 basado en Gemini 3.1 Pro — el modelo logró 80,04% de precisión en el benchmark BIRD para conversión de texto a SQL.

Cómo Construir un Espacio de Trabajo de Agentes en QwenPaw con Habilidades Personalizadas y API de Streaming
Tutorial paso a paso para desplegar QwenPaw — un framework para crear agentes de IA con soporte para múltiples proveedores de modelos, habilidades personalizadas y API de streaming en Google Colab.

Moonshot AI lanza Kimi K2.7-Code: mejora del 21,8% en Code Bench v2 sobre K2.6
Moonshot AI liberó el código fuente de Kimi K2.7-Code — un modelo de codificación agencial con contexto de 256K y consumo 30% menor de tokens de raciocinio en comparación con K2.6.

Comparación de modelos TTS 2026: de comerciales a abiertos
En 2026, la elección de un modelo TTS depende de tres factores: calidad de audio, latencia de procesamiento y costo. Las soluciones comerciales ganan en naturalidad, las abiertas en control y costo.

StepFun presenta Step 3.7 Flash — un modelo Vision-Language de 198 mil millones de parámetros
StepFun lanzó Step 3.7 Flash, un nuevo modelo multimodal con 198 mil millones de parámetros, visión integrada, una ventana de contexto de 256 mil tokens y modo Advisor para agentes de código.

NVIDIA X-Token: destilación que supera a GOLD por 3,82 puntos
NVIDIA lanzó X-Token, un método de destilación de conocimiento para modelos pequeños (Llama-3.2-1B) que supera a GOLD por 3,82 puntos y mejora la precisión en matemáticas de 2,56 a 15,54%.

AgentTrove: cómo usar el dataset de 1,7 millones de trazas de agentes en Python
AgentTrove es el mayor dataset abierto de trazas de interacción entre agentes: 1,7 millones de ejemplos en formato ShareGPT. Un tutorial en Python muestra cómo procesar los datos en streaming, normalizar las acciones de

Nous Research lanzó Tool Search para Hermes Agent: la precisión aumentó un 49–74% con Opus 4
Nous Research resolvió el problema del inflado de contexto en MCP al añadir una búsqueda inteligente de herramientas. El sistema selecciona solo los esquemas relevantes y mejora la precisión en decenas de por ciento al t

Genesis AI lanza Genesis World 1.0 — una plataforma para evaluar robots 400 veces más rápido
Genesis AI lanzó la plataforma Genesis World 1.0 para la simulación de robots, que reduce el tiempo de evaluación de 200 horas a 30 minutos y reproduce el comportamiento real con un 90% de fidelidad.

NVIDIA lanzó Polar — framework para entrenar agentes de código
NVIDIA creó Polar, un framework para entrenar agentes de lenguaje mediante reinforcement learning, mejorando el rendimiento en SWE-Bench en 22.6 puntos en el entorno Codex.

UC Berkeley creó mKernel: una biblioteca unificada para sincronización de GPU en clústeres
UC Berkeley lanzó mKernel — una nueva biblioteca CUDA para sincronizar miles de GPUs en centros de datos, combinando comunicación local y remota en un único kernel persistente.

Stability AI lanza Stable Audio 3 para generación rápida de música
Stability AI presentó Stable Audio 3 — modelos para generación de música y efectos de sonido que funcionan en MacBook y GPUs de consumidor con 8GB VRAM.

ZeroEntropy presenta Zerank-2 — un reordenador ligero para búsqueda precisa
ZeroEntropy lanzó Zerank-2, un codificador cruzado compacto basado en Qwen3 que mejora significativamente la calidad de la búsqueda en sistemas RAG de dos etapas.

Sakana AI presenta DiffusionBlocks: método para entrenar redes neuronales por bloques
Sakana AI presentó DiffusionBlocks, un nuevo método que permite entrenar capas de redes neuronales residuales de forma independiente, interpretando las actualizaciones como difusión inversa.

Búsqueda vectorial en PostgreSQL: guía completa de pgvector para aplicaciones de IA
PostgreSQL se ha convertido en un competidor serio de las bases de datos vectoriales especializadas gracias a la extensión pgvector.

Perplexity AI Lanza Tokenizador 5x Más Rápido que el Estándar Hugging Face
Perplexity AI lanzó un tokenizador Unigram reescrito que acelera el procesamiento de texto 5x y reduce la carga de CPU en 5-6x en entornos de producción.

Científicos crean MEMO — un marco para expandir la memoria de LLM sin reentrenamiento
Los científicos propusieron MEMO, un marco que permite a los LLM aprender de nuevos datos sin reentrenar el modelo principal, utilizando un módulo de memoria separado.

EAGLE 3.1: Cómo corregir la inestabilidad de la decodificación especulativa en LLM
El lanzamiento conjunto del equipo EAGLE, vLLM y TorchSpec corrige un problema crítico de decodificación especulativa: la desviación de atención que ralentizaba la inferencia de grandes modelos de lenguaje en producción.

Anthropic Lanzó Claude Opus 4.8 con Workflows Dinámicos y Fast Mode Más Económico
Anthropic presentó Claude Opus 4.8 con workflows dinámicos y un fast mode más económico. La actualización está disponible en la vista previa de investigación de Claude Code.

Liquid AI lanzó LFM2.5-8B: un modelo MoE compacto con contexto de 128K
Liquid AI presentó el nuevo modelo LFM2.5-8B-A1B, un modelo MoE eficiente que activa solo 1.5B de 8.3B parámetros. Funciona en una PC de consumidor con contexto de 128K.

Hexo Labs publicó SIA — un agente que se actualiza a sí mismo durante el funcionamiento
Hexo Labs lanzó el código abierto de SIA — un sistema que se mejora a sí mismo, actualizando tanto las instrucciones del agente como los pesos de su red neuronal.

Microsoft Research lanza Webwright — agente navegador que resuelve tareas web al 60%
Microsoft Research presentó Webwright — un agente navegador que ejecuta tareas web complejas mejor que los grandes modelos de lenguaje: 60% de éxito en el benchmark Odysseys frente al 33,5% del GPT-5.4 base.