Habr AI
Fuente de noticias de IA. Los artículos son seleccionados y adaptados por la redacción de Hamidun News.
Últimas publicaciones

Nvidia, Google y Anthropic: Nemotron, fallos de Firefox y señales preocupantes para el mercado de AI
Nvidia lanzó el modelo abierto Nemotron-3-Super-120B, Anthropic encontró decenas de fallos en Firefox, y Google y ByteDance quedaron en el centro de nuevas disputas sobre los límites y los riesgos de la AI.

Claude Cowork y Chrome: 10 casos de uso para delegar la rutina repetitiva del navegador a un agente de AI
En Habr se publicó un análisis práctico de cómo Claude Cowork, junto con una extensión para Chrome, se encarga de la búsqueda de datos, el llenado de formularios, el monitoreo de precios, QA y otras tareas repetitivas en

Anthropic explicó cómo las empresas pueden implementar sistemas agénticos sin complejidad innecesaria
Anthropic mostró que a las empresas les conviene más empezar no con sistemas agénticos autónomos, sino con escenarios simples: son más baratos, más fiables y a menudo más útiles para los marketplaces.

En cinco días, Yoyo pasó de 200 líneas a un agente autónomo que escribe código por sí solo
Un experimento con el agente Yoyo mostró que 200 líneas en Rust bastaron para poner en marcha un ciclo de autoaceleración: el bot lee su propio código, escribe correcciones, abre tickets y deja lo más difícil para despué

GLiNER 2 mostró cómo los encoders compactos están alcanzando a los LLMs en NER y clasificación
Una nueva ola de encoders zero-shot, encabezada por GLiNER 2, muestra que las tareas de NER y clasificación pueden resolverse sin LLMs pesados — más rápido, más barato y con un trade-off claro de calidad.

Ollama Cloud comparado en un code review: DeepSeek v3.1 resultó superior a Qwen y GPT-OSS
El autor probó tres modelos en Ollama Cloud sobre Pull Requests reales de Python de un proyecto legacy: DeepSeek v3.1 mostró el mejor equilibrio entre profundidad, precisión y correcciones útiles.

CodeSpeak, de Andrey Breslav, creador de Kotlin, traslada el desarrollo del código a las especificaciones
El equipo de Andrey Breslav lanzó la alfa pública de CodeSpeak — una plataforma en la que el desarrollador describe un sistema en inglés y LLM generan, prueban y refactorizan código, también en proyectos de Python.

OpenAI, SoftBank y Oracle discuten por Stargate: el megaproyecto de centros de datos se atasca
Stargate, un proyecto de hasta 500.000 millones de dólares concebido como la base computacional de OpenAI, se ralentiza: los socios discuten la estructura, el dinero, el control y el ritmo de construcción.

Claude como parte del pensamiento: por qué perder una herramienta de AI afecta no solo el acceso, sino también el trabajo
Para los usuarios activos, perder una cuenta de Claude resultó ser algo más que una falla del servicio: junto con el acceso desaparecen el contexto, el trabajo acumulado y parte de la lógica habitual de trabajo.

Seldon Vault convirtió la psicohistoria de Asimov en un servicio multiagente de pronósticos con AI
Seldon Vault convierte la idea de la psicohistoria de Asimov en un servicio real de AI: siete agentes, un escéptico y un árbitro elaboran a diario pronósticos de eventos globales y evalúan su precisión.

Anthropic y ETH Zurich: un CLAUDE.md largo empeora el rendimiento del agente y eleva los costos
Un estudio de ETH Zurich sobre 138 repositorios mostró que los archivos CLAUDE.md y AGENTS.md largos a menudo reducen la tasa de éxito de los agentes de coding y, al mismo tiempo, aumentan el gasto en tokens.

Gemini 3.1 Pro superó a ChatGPT 5.4 y Claude Opus 4.6 en una prueba de generación de texto
Una comparación del autor entre tres modelos punteros en cuatro tareas literarias mostró que Gemini 3.1 Pro mantiene mejor el género, la emoción y la concisión, mientras que ChatGPT y Claude quedan apenas por detrás.

Anthropic, OpenAI y Cursor: ocho niveles de madurez de la ingeniería de agentes
Habr AI analizó ocho niveles de la ingeniería de agentes, desde tab-complete y context engineering hasta background agents y equipos autónomos que ya están cambiando el desarrollo de software.

AMD RX580 ejecutó un LLM localmente: cómo superar ROCm, Ollama y lograr inferencia en GPU
Un ingeniero mostró cómo hacer que una vieja AMD RX580 ejecute un LLM de forma estable con ROCm y Ollama, desglosando las señales falsas de actividad de la GPU, los fallos de hipMemGetInfo y el papel de Vulkan en el diag

Por qué Claude 4.6 no basta sin contexto: el principal punto ciego del desarrollo con LLM
Incluso un modelo sólido como Claude 4.6 pierde eficacia sin un contexto reunido de forma sistemática: knowledge base, conexiones entre servicios y reglas del entorno importan más que un prompt aislado.

Desarrollador crea agregador de noticias con AI, MCP, DeepSeek y bot de Telegram
Tras el ataque de drones sobre Dubái, un desarrollador creó un agregador de noticias multilingüe: 80+ fuentes, un servidor MCP para agentes de AI, un chat con AI y un bot de Telegram con resúmenes rápidos.

BorisovAI probó MoE en una RTX 4090 y mostró por qué la perplejidad compromete la evaluación de LLM
BorisovAI probó MoE con expertos plug-in en una sola RTX 4090 y descubrió que una perplejidad llamativa no garantiza una mejora real de la calidad en tareas de razonamiento.

Un experimento con LLM mostró cómo surge la “personalidad” del modelo en el espacio latente
Un experimento con una LLM modular mostró que un vector latente independiente puede almacenar no solo el estilo del texto, sino también rasgos de comportamiento estables, similares a la estructura de la personalidad del

Nvidia insinúa antes de GTC 2026 un chip óptico capaz de reconfigurar los centros de datos de AI
Antes de su presentación del 16 de marzo de 2026, Nvidia avivó las expectativas del mercado con la promesa de “un chip que sacudirá al mundo”, y la principal candidata a la sorpresa sería la fotónica de silicio.

Por qué los avances de DeepMind en AGI no responden a la pregunta clave sobre la conciencia de máquina
El autor explica por qué el aumento de la potencia de cómputo y los avances de DeepMind en AGI no equivalen a la aparición de la conciencia: la inteligencia puede imitarse, mientras que la experiencia subjetiva, por ahor

Habr AI sobre el futuro del trabajo: cómo AI y los robots pueden devolver a la sociedad a una nueva Antigüedad
Habr AI sostiene que la combinación de AI, robotización y neuroimplantes puede no solo cambiar el mercado laboral, sino dividir a la sociedad entre una clase reducida de operadores de sistemas y todos los demás.

Unity mostró cómo crear NPCs con voz, memoria y contexto del mundo
Una guía paso a paso muestra cómo crear NPCs con voz en Unity con un modelo local, memoria de diálogos, conocimiento del mundo del juego y respuestas por voz en lugar de las líneas guionizadas habituales.

Harvard: AI reduce la contratación de juniors, y en tres años eso podría afectar a toda la industria
Harvard registra una caída en la contratación de juniors tras la adopción de AI, mientras que METR apunta a una dependencia creciente de los desarrolladores experimentados respecto de los asistentes de AI, lo que amenaza

DeepSeek y GLM-5 superaron a Yandex en una prueba de 34 modelos de AI para gerentes sin VPN
Los autores de una gran prueba de escenarios de gestión concluyeron que DeepSeek V3.2 y GLM-5, disponibles en Rusia sin VPN, rinden notablemente mejor que las soluciones de Yandex y están cerca del grupo líder global.

Google lanzó Gemini Embedding 2 para RAG multimodal con video, audio y PDF
Google lanzó Gemini Embedding 2, un modelo que vectoriza texto, imágenes, video, audio y PDF en un solo espacio y simplifica la creación de RAG multimodal.

Bitrix24 enumeró ocho errores típicos al desarrollar servidores MCP para LLMs
Un desarrollador de Bitrix24 explicó por qué los servidores MCP fallan en la autorización, las cadenas de llamadas, las malas descripciones de herramientas, las pruebas, la seguridad y el desbordamiento de contexto.

Por qué la idea de world model de Yann LeCun no resuelve la principal crisis en el desarrollo de LLMs
Tras la salida de Yann LeCun de Meta, su concepto de world model vuelve a debatirse como una vía más allá de los LLMs, pero los críticos creen que la física del mundo es demasiado limitada para una comprensión real.

Montaron un pipeline de Physical AI para SO-101 sobre ROS2 y LeRobot por 30 mil rublos
Un stack open-source basado en ROS2 y LeRobot permite montar un pipeline completo de Physical AI en el SO-101 de bajo costo: teleoperación, grabación de episodios, entrenamiento de policy y ejecución en hardware.

SimpleOne lanzó SimpleGen — herramienta de AI para desarrollo y despliegue en la plataforma
SimpleOne presentó SimpleGen — una herramienta de AI para generar soluciones en su plataforma: al desarrollador le basta con preparar un repositorio, acceso a un entorno y seguir el workflow en Cursor.

Google AI Ultra: cómo convertir una suscripción en un pool de agentes paralelos y consenso entre modelos
Google AI Ultra se propone como base para un stack multiagente: ejecutar workers paralelos de Gemini, delegar rutinas y contrastar decisiones con un segundo modelo.