MarkTechPost
Fuente de noticias de IA. Los artículos son seleccionados y adaptados por la redacción de Hamidun News.
Últimas publicaciones

SmolAgents: Cómo Construir un Sistema de IA Multiagente con Código y Orquestación Dinámica
Un análisis de la implementación de SmolAgents muestra cómo los agentes de IA ligeros ejecutan código, invocan herramientas, trabajan con memoria y coordinan tareas dentro de un único sistema.

NetKet y JAX: cómo construir un modelo Transformer para sistemas de espines frustrados
La guía muestra cómo construir un pipeline de VMC de investigación usando NetKet, JAX y arquitectura Transformer para modelar una cadena de espín frustrada J1-J2.

OpenAI presentó GPT-Rosalind — un modelo de IA para biología, genómica y desarrollo de fármacos
OpenAI lanzó GPT-Rosalind — un modelo especializado para biología y farmacéutica que ayuda a acelerar el desarrollo de fármacos, análisis de datos genómicos y planificación de experimentos.

Google presentó Auto-Diagnose — un sistema de IA para encontrar causas de fallos en pruebas de integración
Google presentó Auto-Diagnose — un sistema basado en Gemini 2.5 Flash que analiza automáticamente logs de pruebas de integración fallidas e identifica la causa raíz del fallo con una precisión del 90,14%.

OpenAI GPT-OSS: Lanzamiento de Modelos Open-Weight en Colab con MXFP4 e Inferencia Avanzada
Una nueva guía explica cómo lanzar openai/gpt-oss-20b en Google Colab: instalar dependencias para Transformers, verificar GPU, habilitar cuantización MXFP4 y construir un pipeline de inferencia funcional.

Anthropic lanza Claude Opus 4.7 para programación de agentes, visión y tareas autónomas
Anthropic presentó Claude Opus 4.7 — una actualización del modelo insignia con mejoras notables en codificación de agentes, análisis de imágenes detalladas y tareas autónomas largas.

PrismML Bonsai: Cómo ejecutar un modelo de 1 bit en CUDA con GGUF, JSON y RAG
En un nuevo tutorial de PrismML Bonsai, cubrimos cómo ejecutar Bonsai-1.7B en GPU a través de CUDA y GGUF, medir velocidad, configurar chat, salida JSON estricta y un escenario RAG básico.

xAI lanza APIs Grok separadas para reconocimiento y síntesis de voz para desarrolladores corporativos
xAI ha dividido la pila de voz de Grok en APIs autónomas: Speech-to-Text y Text-to-Speech para negocios con precios agresivos, soporte multilingüe y enfoque en el mercado de aplicaciones de voz.

NVIDIA lanzó Ising — la primera familia abierta de modelos de IA para sistemas cuántico-clásicos
NVIDIA presentó Ising — una familia abierta de modelos de IA para calibración de procesadores cuánticos y corrección de errores, para acercar sistemas híbridos cuántico-clásicos útiles más a la realidad.

Por qué LoRA falla en producción y cómo RS-LoRA salva el ajuste fino de modelos
LoRA es excelente para estilo y formato, pero pierde señal al ajustar con nuevos hechos; RS-LoRA resuelve el problema cambiando la fórmula de escalado a una más estable.

OpenKB y OpenRouter muestran cómo construir una base de conocimiento IA local con búsqueda en Llama
Un nuevo tutorial explica cómo desplegar una base de conocimiento local en OpenKB, conectar un modelo abierto a través de OpenRouter y configurar de forma segura la búsqueda sin codificar claves.

OpenAI y Magika mostraron cómo construir un pipeline para reconocimiento de archivos y análisis de amenazas
La guía demuestra un pipeline práctico donde Magika determina el tipo real del archivo a partir de bytes, y OpenAI ayuda a interpretar el resultado e identificar riesgos potenciales.

Meta presentó Sapiens2 — un modelo unificado de visión por computadora para pose, segmentación y 3D
Meta Reality Labs lanzó Sapiens2 — una familia de modelos de visión para análisis humano que resuelve pose, segmentación, geometría de superficie y mapeo 3D desde una única arquitectura.

OpenMOSS lanza MOSS-Audio — modelo de audio abierto que supera alternativas mayores
OpenMOSS presentó MOSS-Audio — un modelo abierto que comprende voz, música y sonidos ambientes en una única arquitectura y supera a modelos open-source significativamente más grandes en benchmarks de audio comunes.

Embeddings de OpenAI y RL: Cómo Construir un Agente con Memoria a Largo Plazo para Respuestas Precisas
El tutorial muestra cómo entrenar un agente RL para seleccionar registros relevantes de la memoria a largo plazo, de modo que una LLM responda con mayor precisión preguntas sobre hechos almacenados.

Cómo Medir la Inteligencia Real: Los Principales Benchmarks para Agentes de IA
Las pruebas clásicas ya no reflejan las capacidades reales de las redes neuronales. Exploramos qué benchmarks realmente muestran si un agente de IA está listo para aplicaciones empresariales del mundo real.

Memoria Elástica para IA: Cómo kvcached Resuelve la Escasez de GPU
La distribución dinámica de caché KV promete reducir radicalmente el costo de alojamiento de modelos de lenguaje, permitiendo un comparticionamiento eficiente de la memoria de una sola GPU.

El Modelo de Voz de xAI Supera a GPT Realtime en Tareas Empresariales
La empresa de Elon Musk, xAI, presentó grok-voice-think-fast-1.0. El nuevo modelo superó las soluciones de OpenAI y Google en la gestión de flujos de trabajo empresariales complejos.

GitNexus: Cómo una nueva herramienta enseñó a agentes IA a comprender estructuralmente el código
Los asistentes de IA sobresalen en escribir código local, pero a menudo no comprenden la arquitectura global de proyectos. El proyecto open-source GitNexus resuelve este problema usando grafos de conocimiento y el protoc

DeepSeek-V4: Cómo los nuevos algoritmos de compresión hicieron realidad el contexto de un millón de tokens
DeepSeek presentó la cuarta generación de sus modelos. Mediante la compresión radical de atención, el procesamiento de volúmenes masivos de datos se está volviendo accesible no solo para los gigantes tecnológicos.

La Arquitectura Decoupled DiLoCo de DeepMind Resuelve el Problema de Escalabilidad de la IA
El entrenamiento de modelos de IA avanzados siempre ha sido rehén de fallos de hardware: una falla en un chip detenía todo el cluster. Una nueva arquitectura de Google DeepMind cambia las reglas del juego.

OpenMythos: reconstrucción de código abierto de la arquitectura Claude Mythos en PyTorch con 770M parámetros
El desarrollador Kye Gomez reconstruyó la presumida arquitectura Claude Mythos de Anthropic desde cero — sin filtraciones, solo basándose en investigaciones públicas.

OpenAI Amplía GPT-5.4-Cyber para Profesionales Verificados de Ciberseguridad
OpenAI abre acceso amplio a GPT-5.4-Cyber — una versión ajustada de GPT-5.4 sin restricciones estándar para miles de defensores verificados.

Moonshot AI lanza Kimi K2.6: un modelo agéntico con un enjambre de 300 subagentes
El laboratorio chino Moonshot AI ha liberado el código fuente de Kimi K2.6, un modelo agéntico multimodal que coordina de forma autónoma hasta 300 subagentes y 4.000 pasos.

Phi-4-Mini de Microsoft: implementación de cuantización, RAG y LoRA en un único notebook Jupyter
El tutorial muestra el pipeline completo con Phi-4-mini-instruct: cuantización de 4 bits, generación en streaming, razonamiento, llamada de herramientas, RAG y LoRA fine-tuning en un solo notebook.

Qwen 3.6-35B-A3B en la práctica: multimodalidad, MoE y RAG en un solo pipeline
Un análisis detallado de la implementación de Qwen 3.6-35B-A3B, desde la carga del modelo hasta RAG, tool calling y la persistencia de sesiones en flujos de trabajo reales.

NVIDIA presentó Nemotron 3 Super — un modelo abierto con 120 mil millones de parámetros
El nuevo modelo híbrido combina las arquitecturas Mamba y Attention con un enfoque Mixture-of-Experts, ofreciendo un aumento de rendimiento de cinco veces para sistemas multiagente. La brecha entre los modelos propietari

Google presentó TensorFlow 2.21 y LiteRT para AI móvil
Google presentó TensorFlow 2.21 y LiteRT, un nuevo estándar para ejecutar redes neuronales en smartphones con soporte para NPU y aceleración de GPU en plataformas móviles.

Google lanza Android Bench para evaluar la IA en el desarrollo móvil
Google puso a disposición Android Bench, la primera herramienta especializada para evaluar las capacidades de los grandes modelos de lenguaje en el desarrollo de aplicaciones para Android.

OpenAI presenta Codex Security para la detección y corrección automáticas de vulnerabilidades en el código
OpenAI lanza Codex Security, un agente inteligente para el análisis de seguridad del código que no solo encuentra errores, sino que también propone parches listos para corregirlos.