MarkTechPost
Fuente de noticias de IA. Los artículos son seleccionados y adaptados por la redacción de Hamidun News.
Últimas publicaciones

OpenAI Lanzó Privacy Filter: Modelo Abierto para Eliminar Datos Personales
OpenAI publicó Privacy Filter — un modelo de código abierto para la detección y sustitución automática de datos personales, funcionando directamente en el navegador sin infraestructura de servidor.

OpenAI y Promptflow: cómo construir pipelines de LLM con trazabilidad y evaluación de calidad
La guía muestra cómo construir un pipeline de LLM en Google Colab utilizando Promptflow, Prompty y OpenAI con configuración segura de claves, trazabilidad de ejecuciones y evaluación de calidad integrada.

Meta FAIR Lanza NeuralSet — Paquete Python para Conectar Datos Neurales y Modelos de IA
Meta FAIR abrió NeuralSet — un framework Python que combina fMRI, M/EEG, spikes e embeddings de Hugging Face en un único pipeline PyTorch para investigación Neuro-AI.

El equipo Qwen lanzó FlashQLA: aceleración de atención lineal hasta 3× en NVIDIA Hopper
QwenLM lanzó FlashQLA — una biblioteca de kernels CUDA para Gated Delta Network que proporciona ganancia de rendimiento de hasta 3× en GPU NVIDIA Hopper para preentrenamiento e inferencia agentiva.

OpenAI Privacy Filter: Cómo Construir un Pipeline de Producción para Detección y Enmascaramiento de PII
La guía de OpenAI Privacy Filter desglosa un pipeline completo para detectar y enmascarar datos personales — desde la carga del modelo hasta la edición automática de texto.

DeepSeek, Google y Meta: 10 técnicas de compresión de KV-cache en LLM para reducir memoria en inferencia
KV-cache se ha convertido en un consumidor de memoria GPU en grandes LLMs, y una nueva revisión muestra 10 enfoques — desde H2O y SnapKV hasta TurboQuant y MLA de DeepSeek — que reducen el consumo de memoria sin reestruc

Poolside lanzó Laguna XS.2 y M.1 — modelos abiertos para programación con agentes
Poolside presentó dos modelos Laguna para codificación con agentes: el XS.2 abierto se ejecuta localmente, mientras que el más potente M.1 está diseñado para tareas largas con ediciones de código, pruebas y trabajo en te

LlamaIndex ParseBench: cómo probar análisis de documentos a través de Python y Hugging Face
Un análisis práctico muestra cómo construir un pipeline de evaluación de analizadores de documentos usando el dataset LlamaIndex ParseBench: cargar PDFs desde Hugging Face, comparar texto extraído y medir calidad.

smol-audio de Deep-unlearning: Una colección de notebooks de Colab para ajuste fino de modelos de audio
Deep-unlearning lanzó smol-audio — una colección de notebooks compatibles con Colab para ajustar Whisper, Parakeet, Voxtral, Granite Speech y otros modelos de audio.

Top 10 modelos de IA física que controlan robots reales en 2026
En 18 meses, la brecha entre LLMs y la robótica real se ha reducido drásticamente: los modelos de IA física ya funcionan en fábricas, almacenes y laboratorios de investigación.

Hugging Face y Gemma 3 1B: Construyendo un Pipeline de Generación Listo para Producción en Colab
Un análisis de cómo ejecutar Gemma 3 1B Instruct en Colab a través de Hugging Face Transformers: con autorización segura, chat templates y un pipeline de inferencia reproducible.

Z.ai lanza GLM-5V-Turbo — modelo multimodal nativo para programación visual
El laboratorio chino Z.ai ha lanzado GLM-5V-Turbo — un modelo que reconoce diagramas arquitectónicos y capturas de pantalla e inmediatamente genera código funcional para sistemas de ingeniería de agentes.

Google Gemma 4, NVIDIA y OpenClaw: Agentes AI locales sin pago por token
Google y NVIDIA están promoviendo la ejecución local de Gemma 4 en RTX, Jetson y DGX Spark para que agentes AI siempre activos como OpenClaw funcionen más rápido, más barato y sin facturación de tokens en la nube.

Talkie-1930: Investigadores lanzaron un modelo 13B sin conocimiento de internet ni de la Segunda Guerra Mundial
Talkie-1930 es un modelo 13B abierto, entrenado solo en textos en inglés hasta 1931, para estudiar el pensamiento histórico, filtraciones de datos y la capacidad de IA para generalizar más allá de su era.

MarkTechPost muestra cómo construir un agente VLA ligero con modelo de mundo latente y MPC
En un nuevo tutorial, MarkTechPost explica cómo construir un agente embodied simplificado: opera en fotogramas RGB, aprende un modelo de mundo latente y planifica acciones mediante MPC.

Arcee AI Lanzó Trinity Large Thinking — Modelo de Razonamiento Abierto para Agentes IA
Arcee AI liberó los pesos de Trinity Large Thinking bajo licencia Apache 2.0 y apuesta por escenarios de agentes largos, razonamiento multietapa y uso seguro de herramientas.

NVIDIA mostró un pipeline completo de optimización de modelos con FastNAS pruning y fine-tuning
NVIDIA lanzó una guía práctica para Model Optimizer: en un único notebook Colab se demuestran el entrenamiento de ResNet20, FastNAS pruning bajo límite de FLOPs y recuperación de calidad mediante fine-tuning.

TII lanza Falcon Perception — modelo 0,6B para segmentación y búsqueda de objetos por texto
TII presentó Falcon Perception — un modelo vision-language compacto con 0,6 mil millones de parámetros que busca y segmenta objetos a partir de consultas de texto simple, superando SAM 3 en solicitudes complejas.

Google DeepMind Permite que LLM Reescriba Algoritmos de Teoría de Juegos y Supere Expertos
Google DeepMind demostró que AlphaEvolve puede reescribir código de algoritmos para juegos con información incompleta y encontrar soluciones que superan versiones manuales de expertos en la mayoría de las pruebas.

Z.AI mostró cómo construir sistemas agentic production-ready en GLM-5 con tool calling
Z.AI lanzó un tutorial detallado sobre GLM-5: desde la configuración del SDK e API compatible con OpenAI hasta streaming, tool calling, salida JSON y agente multi-turn para producción.

Netflix Abre Void — Modelo para Eliminar Objetos de Videos con Consideración de la Física de la Escena
El equipo de Netflix e INSAIT lanzó en código abierto Void — un sistema que elimina objetos de videos y simultáneamente recalcula caídas, soporte de objetos y otras consecuencias físicas.

Cómo la Inteligencia Artificial Ayuda a las Marcas de Ropa a Diseñar la Moda del Futuro
Los algoritmos ya ayudan a las marcas de moda a crear colecciones más rápidamente, pronosticar tendencias, reducir la sobreproducción y personalizar las compras, pero también plantean preguntas sobre autoría y mano de ob

Cómo Construir un Pipeline Netflix Void para la Eliminación de Objetos en Vídeo usando CogVideoX
Un análisis detallado muestra cómo implementar el modelo Netflix Void, descargar los puntos de control necesarios, preparar datos de entrada y ejecutar la eliminación de objetos del video a través de CogVideoX.

Gladstone Institutes presenta MaxToki — un modelo de IA que predice el envejecimiento celular
El modelo MaxToki de Gladstone Institutes aprende a ver no una 'instantánea' de la célula, sino su trayectoria a lo largo del tiempo, evalúa la aceleración del envejecimiento e identifica objetivos para la intervención.

TinyFish Lanzó Plataforma Web Unificada para Agentes de IA con Search, Fetch, Browser y Agent
TinyFish combinó búsqueda, renderización de páginas, sesiones de navegador y flujos de trabajo web autónomos en una única plataforma para agentes de IA con una sola clave API y pool de créditos compartido.

Google agregó Skills en Chrome y transformó prompts de IA en escenarios de un clic
Google lanzó la función Skills en Chrome: los usuarios de Gemini podrán guardar prompts frecuentemente usados como escenarios reutilizables y ejecutarlos en el navegador con un solo clic.

Google DeepMind Presenta Gemini Robotics-ER 1.6 para Autonomía y Lectura de Instrumentos por Robots
Google DeepMind actualizó Gemini Robotics-ER a la versión 1.6: un modelo para robots que comprende mejor el espacio, maneja múltiples flujos de video y puede leer instrumentos industriales complejos.

MarkTechPost desglosó el ciclo completo de entrenamiento de grandes modelos de lenguaje: desde datos hasta despliegue
MarkTechPost publicó un desglose detallado de cómo se construyen los LLMs hoy: desde el preentrenamiento en grandes corpus hasta SFT, RLHF, optimización del razonamiento y despliegue en producción.

Google presentó Gemini 3.1 Flash TTS — modelo de habla con control, diálogos e idiomas 70+
Google lanzó Gemini 3.1 Flash TTS en vista previa: el modelo sintetiza texto en 70+ idiomas, soporta diálogos con dos voces y permite controlar la entrega a través de etiquetas de audio.

Mem0 y OpenAI: cómo construir una capa universal de memoria a largo plazo para agentes de IA
Un nuevo tutorial desglosa la combinación de Mem0, modelos OpenAI y ChromaDB: extrae hechos de conversaciones ordinarias, los almacena por user_id, busca por significado semántico e inyecta en las respuestas del agente.