MarkTechPost
Fuente de noticias de IA. Los artículos son seleccionados y adaptados por la redacción de Hamidun News.
Últimas publicaciones

NadirClaw: ahorro en solicitudes de LLM con enrutamiento inteligente de prompts
NadirClaw es una herramienta de enrutamiento inteligente de prompts que clasifica las solicitudes como simples o complejas y las dirige al modelo adecuado para reducir costos.

Hermes Agent de Nous Research tomó el liderazgo en consumo de tokens en OpenRouter
El agente de AI open-source Hermes Agent, de Nous Research, superó a la plataforma de código cerrado OpenClaw y ocupó el primer lugar en OpenRouter, generando 224 mil millones de tokens al día. Esto ocurrió en solo tres

Comparativa de bases de datos vectoriales en 2026: nueve sistemas por costo, escala y arquitectura
Nueve bases de datos vectoriales líderes son ahora infraestructura clave para RAG y la AI agéntica. Un análisis de arquitectura, costo y escalabilidad ayuda a elegir el sistema adecuado para la tarea.

Vercel Labs presentó Zero — un lenguaje para agentes de AI que escriban, corrijan y publiquen código
Vercel lanzó Zero — un lenguaje de programación en el que el compilador genera JSON en lugar de texto para que los agentes de AI puedan escribir, corregir y desplegar programas nativos por su cuenta

Cómo Memori crea memoria persistente para agentes y LLM de múltiples sesiones
Memori es una infraestructura de memoria para aplicaciones con LLM que permite a los agentes conservar el contexto entre sesiones y trabajar con varios usuarios al mismo tiempo.

SHAP para machine learning: comparación de explainers y guía práctica
Una nueva guía muestra cómo elegir entre cuatro métodos de SHAP para interpretar modelos — del rápido Tree al versátil Kernel.

DeepMind creó un mouse con AI basado en Gemini para que los usuarios no cambien a chats
Google DeepMind presentó un mouse con AI basado en Gemini que analiza el contexto alrededor del cursor y permite dar comandos por voz sin abrir una ventana independiente.

Mira Murati presentó el primer sistema para un diálogo natural con AI en tiempo real
Thinking Machines Lab presentó el modelo TML-Interaction-Small, que escucha y responde al mismo tiempo, procesando voz, video y texto sin demoras — por primera vez, la AI puede conversar como un humano.

Nous Research presentó Lighthouse Attention para acelerar el entrenamiento de LLM
Nous Research publicó un nuevo mecanismo de atención, Lighthouse Attention, que acelera entre 1,4x y 1,7x el entrenamiento de grandes modelos de lenguaje al manejar contextos largos.

GLiGuard de Fastino Labs: un modelo de seguridad 16x más rápido que competidores más grandes
Fastino Labs lanzó el modelo abierto GLiGuard para verificaciones de seguridad de LLM: solo 300M de parámetros, pero más preciso que modelos 90 veces más grandes.

Shadow AI en el 63% de las empresas: cómo las herramientas se adelantaron a las políticas corporativas
La mayoría de las empresas todavía no tiene políticas formales de gobernanza de AI, mientras los empleados ya adoptan activamente herramientas por su cuenta, lo que crea serios riesgos de seguridad.

Nous Research aceleró el preentrenamiento de LLM 2,5 veces sin cambiar la arquitectura
Nous Research desarrolló Token Superposition Training, un método que reduce en 2,5 veces el tiempo de preentrenamiento de modelos de lenguaje sin cambiar la arquitectura ni el comportamiento en inferencia.

Zyphra lanzó el primer modelo MoE de difusión con una aceleración de 7.7x
Zyphra presentó ZAYA1-8B-Diffusion-Preview, el primer modelo MoE de difusión convertido a partir de un LLM. La inferencia se aceleró 7.7x al trasladar el cálculo de la memoria al procesador GPU.

Cómo construir un sistema de estilo MCP para agentes de AI inteligentes
Guía completa para construir un sistema de agentes de AI que abre por sí solo las herramientas adecuadas, enruta tareas y las ejecuta paso a paso.

BerriAI lanzó LiteLLM Agent Platform para agentes en producción
Ejecutar un agente de IA en un script local es sencillo. Ejecutarlo de forma fiable en producción, sincronizar entre reinicios, proporcionar entornos aislados para diferentes contextos—eso es un…

Repowise para el análisis de repositorios: análisis de grafos y código muerto
Repowise ayuda a los desarrolladores a analizar repositorios de código a nivel de todo el proyecto: construcción de grafos de dependencias, búsqueda de código muerto y contexto para AI.

NVIDIA presenta SANA-WM: un modelo para videos de 60 segundos en 720p en una sola GPU
NVIDIA presentó SANA-WM, un world model abierto que genera videos de 60 segundos en 720p con control preciso de cámara en una sola GPU.

Cómo construir un agente de toma de decisiones en streaming con replanificación online en un entorno dinámico
Un tutorial detallado sobre la creación de un agente de toma de decisiones en streaming que se adapta a obstáculos en movimiento y a objetivos cambiantes en tiempo real.

Outlines y Pydantic: cómo construir pipelines de LLM con seguridad de tipos y esquemas estrictos
Una nueva guía sobre Outlines y Pydantic muestra cómo montar pipelines de LLM con un esquema estricto, tipos de datos, recuperación de JSON y llamadas de función validadas.

Volcengine lanza OpenViking — una base de contexto basada en archivos para agentes de AI como OpenClaw
OpenViking de Volcengine propone almacenar la memoria, los recursos y las habilidades de un agente de AI como un sistema de archivos para simplificar la búsqueda de contexto, reducir el gasto de tokens y hacer observable

Diffrax y JAX: guía práctica sobre ODEs, simulaciones estocásticas y neural ODE
Un nuevo análisis de Diffrax y JAX muestra el recorrido completo, desde la configuración del entorno de cómputo y los solvers adaptativos de ODE hasta las simulaciones estocásticas, el batching con vmap y el entrenamient

BM25 vs. RAG: por qué la búsqueda por palabras clave y la búsqueda semántica dan respuestas diferentes
El análisis muestra cómo BM25 ordena los documentos según la frecuencia y la rareza de las palabras, mientras que RAG con embeddings busca por significado, por eso en producción cada vez se combinan más ambos enfoques.

Meta lanzó Tribe v2 — un modelo que predice la respuesta del cerebro a video, audio y texto
Meta liberó Tribe v2 como código abierto, un modelo que predice la respuesta de fMRI del cerebro a partir de video, audio y texto y da a los neurobiólogos una herramienta para experimentos virtuales sin nuevos escaneos.

Google ADK muestra un pipeline multi-agent para análisis de datos, gráficos e informes en Python
Una nueva guía muestra cómo montar en Google ADK un sistema multi-agent para cargar tablas, ejecutar pruebas estadísticas, generar visualizaciones y autogenerar informes en Python.

Google permite que Gemini API combine Search, Maps y funciones personalizadas en una sola solicitud
Google ha actualizado Gemini API: ahora una sola llamada puede combinar Google Search, Google Maps y funciones personalizadas, lo que permite crear flujos agénticos de varios pasos sin código de integración manual.

OpenClaw: cómo montar un runtime local y seguro para agentes de AI sin usar la nube
La nueva guía de OpenClaw muestra cómo poner en marcha un runtime local-first para un agente de AI: gateway en loopback, acceso al modelo mediante variables de entorno, exec controlado y skills determinísticas.

Microsoft mostró cómo ejecutar VibeVoice para ASR, realtime TTS y speech-to-speech
Microsoft lanzó una guía práctica en Colab sobre VibeVoice: en ella se explica paso a paso speaker-aware ASR, realtime TTS, el procesamiento por lotes de audio y la construcción de un pipeline speech-to-speech.

Hugging Face y Lambda: cómo hacer parsing y fine-tuning de reasoning traces de agentes
MarkTechPost publicó una guía práctica sobre el dataset lambda/hermes-agent-reasoning-traces: cómo hacer parsing de los pensamientos del agente, las llamadas a herramientas, generar gráficos y preparar los datos para fin

Alibaba libera Qwen3.6-35B-A3B — un modelo MoE multimodal centrado en la codificación orientada a agentes
Qwen liberó los pesos de Qwen3.6-35B-A3B: con 35.000 millones de parámetros y 3.000 millones activos, el modelo trabaja con código, imágenes y video, con énfasis en tool use, contexto largo y escenarios con agentes.

Microsoft, NVIDIA e IBM entraron en la lista de las 19 principales herramientas de AI red teaming de 2026
Un nuevo informe sobre AI red teaming reunió 19 herramientas — desde Microsoft PyRIT y NVIDIA Garak hasta IBM AIF360 — para detectar fugas de datos, ataques de jailbreak y sesgo del modelo antes de pasar a producción.