MarkTechPost
Fuente de noticias de IA. Los artículos son seleccionados y adaptados por la redacción de Hamidun News.
Últimas publicaciones

Sakana AI lanza el traductor Sakana Translate para japonés, inglés y chino
Sakana AI añadió el traductor Sakana Translate a Sakana Chat basado en modelos Namazu — con tres modos: traducción directa, revisión y diálogo con documentos.

Ajuste fino de Gemma-3 en matemáticas usando GRPO y adaptadores LoRA
Un flujo de trabajo GRPO paso a paso para ajustar Gemma-3 en el conjunto de datos GSM8K—desde la configuración del entorno y adaptadores LoRA hasta funciones de recompensa y exportación del modelo final.

Page Agent de Alibaba Gestiona Interfaces Web vía DOM sin Capturas de Pantalla y Modelos Multimodales
Alibaba presentó Page Agent — un agente JavaScript del lado del cliente que entiende comandos de texto y gestiona páginas web vía DOM sin capturas de pantalla ni código del servidor.

Anthropic lanza Claude Science Beta: Entorno multiagente para genómica y proteómica
El 30 de junio de 2026, Anthropic abrió acceso beta a Claude Science — una plataforma multiagente para canalizaciones reproducibles en genómica, proteómica y queminformática.

NVIDIA presenta ASPIRE — framework de robótica que se auto-aprende con 31% de éxito zero-shot en tareas complejas
NVIDIA lanzó ASPIRE — un framework para robots que escribe y mejora programas de control, acumula soluciones verificadas en una biblioteca de habilidades y las transfiere a nuevas tareas sin reentrenamiento.

NVIDIA HORIZON: Agente Autónomo Cierra 100% de los Benchmarks RTL en Diseño de Chips
NVIDIA presentó HORIZON — un agente que escribe y verifica independientemente código RTL para diseño de chips, logrando 100% de cumplimiento en benchmarks estándar.

Ex-líder técnico de Qwen: por qué el razonamiento híbrido fracasó y qué sigue
Zunyuan Lin, ex-líder de desarrollo de Qwen en Alibaba, explicó dónde falló el razonamiento dinámico de Qwen3—y por qué la IA agentiva requiere un enfoque de entrenamiento fundamentalmente diferente.

LlamaIndex lanzó legal-kb: búsqueda de documentos con agentes a través de cuatro herramientas en Index v2
LlamaIndex publicó la aplicación de referencia legal-kb, dando a los agentes acceso tipo archivo a una base de conocimiento mediante retrieve, find, read y grep en el motor Index v2.

NVIDIA Lanzó Nemotron-Labs-TwoTower — Modelo de Lenguaje de Difusión con Pesos Abiertos
NVIDIA ha abierto los pesos del modelo de lenguaje de difusión Nemotron-Labs-TwoTower, que combina una columna vertebral AR congelada con una cabeza de difusión para acelerar la generación de texto.

Interfaze lanzó un modelo ASR de código abierto por difusión para el reconocimiento de seis idiomas
Interfaze publicó diffusion-gemma-asr-small, el primer adaptador ASR de código abierto basado en DiffusionGemma de Google: 42 millones de parámetros, seis idiomas y un costo de inferencia ligado al número de pasos de eli

WebBrain: agente de AI open-source para navegador funciona sin nube y sin suscripción
WebBrain es un agente gratuito con licencia MIT para Chrome y Firefox que lee páginas y automatiza tareas, funcionando de forma local mediante llama.cpp u Ollama.

Anthropic Lanza Claude Fable 5 y Mythos 5: Un Modelo, Dos Niveles de Acceso
Anthropic abrió Fable 5 al público con clasificadores de seguridad completos, mientras que Mythos 5—con restricciones cibernéticas removidas—se distribuye solo a través del programa cerrado Project Glasswing.

Cómo acelerar el entrenamiento de transformers con NVIDIA Apex: FusedAdam, FusedLayerNorm y torch.amp
Guía paso a paso para compilar NVIDIA Apex desde el código fuente y aplicar FusedAdam, FusedLayerNorm y precisión mixta — mejora de hasta 2,5× en el entrenamiento de transformers.

JetBrains lanzó Mellum2 — un modelo MoE abierto de 12B para tareas rápidas en pipelines de AI
JetBrains abrió el código de Mellum2 bajo Apache 2.0 — un modelo MoE compacto con 12.000 millones de parámetros, entrenado con 10,6 billones de tokens para integrarse en pipelines de AI con múltiples modelos.

Alibaba lanzó Qwen3.7-Plus: agente multimodal con análisis de video y codificación autónoma
Alibaba lanzó en la plataforma Bailian el agente multimodal Qwen3.7-Plus — el modelo puede procesar imágenes y video, invocar herramientas e iterar sobre el código por sí solo sin intervención del operador.

PyGraphistry: análisis de grafos para detectar amenazas en datos corporativos
Investigadores publicaron un workflow de PyGraphistry en Colab que convierte datos corporativos de acceso en un grafo interactivo con anomalías basadas en ML y tres modos de visualización para investigar incidentes.

Google DeepMind lanzó DiffusionGemma — un modelo MoE abierto de 26B con generación 4 veces más rápida
Google DeepMind lanzó DiffusionGemma, un modelo abierto experimental de 26B parámetros que usa difusión de texto en lugar de autorregresión — la generación se acelera hasta 4 veces en GPU.

Microsoft SkillOpt: optimización automática de prompts en lugar de prueba y error manual
Microsoft SkillOpt optimiza prompts de AI mediante un ciclo automático de seis pasos — reflexión, selección, validation gating — y muestra una mejora medible de la precisión desde las primeras iteraciones.

North Mini Code de Cohere: modelo MoE open-weight de 30B para codificación con agentes
Cohere lanzó su primer modelo open-weight para desarrolladores: North Mini Code, con arquitectura MoE, 30B de parámetros, contexto de 256K y ejecución en una sola GPU H100.

MiniMax lanzó MSA: la atención dispersa acelera 28x el procesamiento de un contexto de 1 millón de tokens
MiniMax presentó MSA, un mecanismo de atención dispersa de dos ramas, entrenado sobre un modelo MoE de 109 mil millones de parámetros, que es 28x más rápido que el GQA estándar en un contexto de 1 millón de tokens.

Docling Parse: pipeline de parsing de PDF con precisión a nivel de caracteres y coordenadas
El tutorial muestra cómo usar Docling Parse para el análisis estructural de PDF: coordenadas de cada palabra, superposiciones visuales y exportación a JSON y CSV para sistemas RAG.

TimeCopilot: cómo crear un pipeline de pronóstico con modelos fundacionales y detección de anomalías
TimeCopilot permite crear un ciclo completo de pronóstico —desde modelos estadísticos hasta modelos fundacionales— con detección automática de anomalías y un agente LLM que explica las predicciones.

Cisco libera FAPO: optimización automática de pipelines de LLM con diagnóstico en cada paso
Cisco Foundation AI ha liberado FAPO, una herramienta basada en Claude Code que encuentra por sí sola el eslabón débil en una cadena de prompts y optimiza el pipeline hasta alcanzar la precisión objetivo.

MoonMath AI lanza un núcleo HIP de código abierto para AMD MI300X que supera al AITER v3 oficial
La startup MoonMath AI ha liberado el código fuente de un núcleo de atención para AMD MI300X que supera a la biblioteca oficial de AMD en todas las formas de tensores y modos de redondeo.

xAI lanza /goal en Grok Build: un agente autónomo planifica y verifica tareas de varios pasos
Grok Build ahora cuenta con el modo /goal: el agente recibe un único objetivo, elabora su propio plan de ejecución, avanza por una lista de verificación y comprueba el resultado en cada etapa hasta completar la tarea por

Cómo crear un agente de AI en Google Colab sin frameworks: tutorial con memoria y MCP
Tutorial paso a paso para crear un agente de AI ligero en Google Colab — con registro de herramientas, memoria de sesión, skills y servidor MCP, sin frameworks externos.

OpenAI presenta GPT-5.6 con tres niveles — Sol, Terra y Luna — y modos de razonamiento
OpenAI anunció la familia GPT-5.6 con tres modelos — Sol, Terra y Luna — y nuevos modos de razonamiento, max y ultra. Por ahora, el acceso está limitado a desarrolladores seleccionados.

Perplexity lanza Computer for Counsel — un agente de AI para equipos jurídicos
Perplexity ha lanzado un agente de AI especializado para abogados: enrutamiento a través de más de 20 modelos, integración con Microsoft 365 y Midpage, y todas las respuestas con enlaces verificables a las fuentes.

NVIDIA Open-SWE-Traces: preparación de datos para el fine-tuning de agentes de codificación
El tutorial muestra cómo trabajar con el dataset NVIDIA Open-SWE-Traces: analizar trayectorias de agentes, examinar parches de código y construir un conjunto SFT para entrenar agentes de AI.

DeepSeek lanzó DSpark — un framework que acelera la generación con DeepSeek-V4 en un 57–85%
DeepSeek abrió el código fuente de DSpark — un framework de decodificación especulativa para DeepSeek-V4 que acelera la generación en un 57–85% sin pérdida de calidad.