MarkTechPost
Fuente de noticias de IA. Los artículos son seleccionados y adaptados por la redacción de Hamidun News.
Últimas publicaciones

Meta AI Presentó Brain2Qwerty v2 — Decodificador de Texto MEG No Invasivo con 61% de Precisión
Meta AI lanzó Brain2Qwerty v2 — un pipeline basado en MEG no invasivo que decodifica oraciones mecanografiadas a partir de señales cerebrales con 61% de precisión por palabra y publicó el código de entrenamiento.

Sakana AI Lanzó Sakana Marlin — un Agente para Informes de 100 Páginas con Diapositivas
Sakana AI Introdujo su Primer Producto Comercial — el Agente Corporativo Marlin, que Funciona Autónomamente por hasta Ocho Horas y Genera Informes de hasta 100 Páginas con Diapositivas

Baidu Desarrolla CUP — Conjunto de Herramientas Python para Pipelines Backend Confiables
MarkTechPost analizó CUP — un conjunto de utilidades Python de Baidu para logging, caché, pools de threads y monitoreo de recursos Linux en un paquete.

Google Research Lanza TabFM — Modelo Foundation para Datos Tabulares con Zero-Shot
Google Research presentó TabFM — un modelo foundation para tablas que realiza clasificación zero-shot y regresión sin entrenar para cada dataset.

Linq Lanzó iMessage Apps — Pagos, Entradas y Juegos para Agentes de IA Directamente en el Chat
Linq presentó iMessage Apps — tarjetas interactivas imessage_app para pagos, compra de entradas, reserva de vuelos y juegos dentro de la mensajería.

Claude Sonnet 5 vs Opus 4.8: comparación de codificación de agentes y precios de API de Anthropic
MarkTechPost comparó Claude Sonnet 5, Sonnet 4.6 y Opus 4.8 de Anthropic: el nuevo modelo se acerca al buque insignia en codificación de agentes con precios de token Sonnet más bajos.

Anthropic reanudo operaciones de Claude Fable 5 despues de levantamiento de restricciones de exportacion
Anthropic el 1 de julio de 2026 restauro el acceso a Claude Fable 5 e introdujo un clasificador que bloquea tecnicas de jailbreak.

OpenAI Lanzó GPT-Realtime-2.1 y Versión Mini para Agentes de Voz en la API
OpenAI agregó dos modelos para agentes de voz a su API—GPT-Realtime-2.1 y GPT-Realtime-2.1-mini—reduciendo latencia p95 en al menos 25% mediante cache.

Tencent lanzó Hy3—un modelo MoE abierto con 295 mil millones de parámetros y contexto 256K
Tencent presentó Hy3—un modelo con 295 mil millones de parámetros, 21 mil millones activos por token, licencia Apache 2.0 y una puntuación de 78.0 en SWE-Bench Verified.

MarkTechPost mostró cómo construir un coautor de IA QSAR para encontrar inhibidores de EGFR
Un tutorial de MarkTechPost enseña cómo construir un coautor de IA autónomo usando Random Forest QSAR — de datos ChEMBL y RDKit a moléculas candidatas listas contra EGFR C797S.

Liquid AI lanzó LFM2.5-350M: modelo eficiente de 350M parámetros con RL escalado
Liquid AI probó que la densidad de IA es más importante que el conteo de parámetros: modelo pequeño puede ser entrenado mejor a través del aprendizaje reforzado.

Parallax: atención lineal local mejorada con corrección de covarianza
Investigadores de MarkTechPost presentaron Parallax — una nueva variación del mecanismo de atención para LLMs pequeños con calidad y velocidad mejoradas.

MiniMax M3: Nuevo Modelo con 1M Tokens, Multimodalidad y Computer Use
La empresa presentó la arquitectura MiniMax Sparse Attention que admite un millón de tokens en contexto y funciona con video, imágenes y control de computadora.

Los agentes IA autónomos funcionan 50 veces más que la búsqueda: investigación de Harvard y Perplexity
Nueva investigación de Harvard y Perplexity muestra que agentes IA realizan 26 minutos de trabajo independiente por sesión, comparado con 33 segundos para asistentes de búsqueda.

Memory OS: Pila de Memoria de 6 Capas Abierta para Hermes Agent
El nuevo proyecto Memory OS agrega memoria local persistente a Hermes Agent a través de seis capas de arquitectura, búsqueda de memoria gestionada y wiki integrada.

Google lanza Gemini 3.5 Live Translate: modelo de voz a voz para 70+ idiomas
Gemini 3.5 Live Translate traduce el habla en tiempo real, sintetizando audio con un retraso de varios segundos. El modelo está disponible en Gemini Live API, Google Meet y la aplicación Google Traductor.

Nous Research presentó constructor de perfiles Hermes Agent
Nueva interfaz Hermes Agent reemplaza configuración CLI multietapa — los usuarios ahora ensamblan perfiles de agentes en un flujo único del panel.

SpaceXAI Lanzó Grok 4.5 — Modelo de Código Clase Opus
SpaceXAI presentó Grok 4.5, modelo clase Opus entrenado con Cursor para codificación y tareas de agente, con precio de $2/$6 por millón de tokens.

Ant Group Presentó LingBot-VLA 2.0 — Modelo Abierto para Controlar Robots de Cualquier Diseño
Su modelo de 6 mil millones de parámetros entrenado en 60 mil horas de video de robótica y puede controlar una docena de tipos de manipuladores a través de un espacio de acción unificado.

NVIDIA Nemotron-Labs-3-Puzzle-75B: la compresión del modelo en un 37% duplicó la velocidad del servidor
NVIDIA lanzó una versión comprimida del LLM Nemotron-3-Super: Nemotron-Labs-3-Puzzle-75B. Gracias al método Puzzle (alternancia entre compresión y destilación), el modelo se hizo un 37% más pequeño y duplicó el throughpu

Google Research lanzó SensorFM, un modelo para 35 tareas de predicción de salud
Google Research entrenó el modelo fundacional SensorFM con 1 billón de minutos de datos de 5 millones de usuarios de Fitbit y Pixel Watch para predecir la salud.

Robbyant lanza LingBot-World-Infinity, un modelo causal para mundos interactivos
Robbyant presentó LingBot-World-Infinity, un modelo de video de 14B que funciona como un simulador interactivo y genera video en 720p a 60 cuadros por segundo.

Datalab Lift contra competidores: cómo funciona un extractor de 9B con JSON Schema
Datalab comparó su herramienta Lift de 9B con NuExtract3, LlamaExtract, Marker y Docling — y analizó cuándo el enfoque schema-first gana en la extracción de datos de PDFs.

Liquid AI Lanza Antidoom: Método FTPO Reduce Bloqueos en Modelos de Reasoning
Liquid AI abrió el código fuente de Antidoom — una herramienta que identifica el token-disparador de bucles infinitos y reentrena solo él, reduciendo la frecuencia de doom-loops del 22,9% al 1%.

Google AI Studio añadió la importación de repositorios de GitHub al modo de desarrollo Build
Google AI Studio actualizó el modo Build: ahora cualquier repositorio de GitHub puede importarse directamente y convertirse de inmediato en una aplicación editable y desplegable.

NVIDIA lanzó Audex-30B — un modelo MoE unificado de audio y texto basado en Nemotron-Cascade-2
NVIDIA integró reconocimiento de voz, traducción, síntesis de voz y generación de audio en un único modelo MoE de 30.000 millones de parámetros, conservando las capacidades de texto de Nemotron-Cascade-2.

Ant Group abre el código fuente de LingBot-Vision: un modelo de 1B para la percepción espacial de robots
Robbyant, de Ant Group, publicó LingBot-Vision, un modelo ViT de 1B entrenado para reconocer bordes de objetos sin anotación y superar a modelos más grandes en tareas de percepción espacial.

IA para Procesamiento de Documentos PDF: Guía de Herramientas 2026
Descripción general de herramientas de código abierto para convertir PDF corporativos y escaneos en JSON estructurado — esencial para que LLMs y agentes de IA funcionen con datos corporativos reales.

Meituan Lanza LongCat-2.0: Modelo MoE Abierto con 1,6 Billones de Parámetros y Contexto de 1 Millón de Tokens
La empresa china Meituan presentó LongCat-2.0 — un modelo MoE masivo con ventana nativa de un millón de tokens entrenado en ASICs nacionales.

Synthetic Sciences Lanza OpenScience — Workbench de IA Abierto para ML, Biología, Física y Química
OpenScience de Synthetic Sciences — workbench de código abierto bajo Apache 2.0 con 250+ habilidades, compatible con cualquier modelo de IA para tareas en ML, biología, física y química.