Habr AI
Fuente de noticias de IA. Los artículos son seleccionados y adaptados por la redacción de Hamidun News.
Últimas publicaciones

T-Bank mejoró la calidad de AI Code Completion con un filtro y eliminó sugerencias innecesarias
T-Bank implementó un filtro de dos capas para AI Code Completion: primero, un LLM evalúa si la sugerencia es pertinente; después, CatBoost afina la decisión, lo que aportó un aumento de +5,2 p. p. en Acceptance Rate.

BotHub, GPTunnel y ruGPT: cómo los agregadores rusos de AI se reparten el mercado en 2026
La comparación de BotHub, GPTunnel, ruGPT.io, Syntx AI y AI Wiz mostró que los agregadores rusos de AI compiten no por precio, sino por comodidad, pagos locales y distintos escenarios de uso.

Habr AI describió la arquitectura de un agente reflexivo: menos piloto automático, más autoverificación
Habr AI mostró cómo funciona un agente reflexivo: con borradores, pausas, rollback y autoverificación obligatoria antes de actuar sobre código, datos y procesos de negocio.

Habr AI: cómo la ingeniería de prompts en desarrollo ahorra horas, pero no sustituye la comprensión de las tareas
Habr AI analiza la ingeniería de prompts práctica para desarrollo: unas buenas instrucciones realmente ahorran horas, pero solo funcionan junto con la comprensión de la tarea, del código y de las limitaciones del proyect

Claude Code oculta el historial: se encontraron 715 sesiones en el disco, aunque la interfaz muestra 69
Un análisis interno de Claude Code mostró que la aplicación almacena cientos de sesiones antiguas de forma local, pero no las muestra en la interfaz: en el disco se encontraron 48 MB de historial y 715 chats.

Claude y Ollama ayudaron a un vendedor de Ozon a procesar certificados en un día y recuperar 1.000 SKU
Un vendedor de Ozon usó Claude y un modelo local en Ollama para reconocer 231 certificados, cargarlos en masa mediante la API y volver a poner en venta más de 1.000 SKU bloqueados en un solo día.

Claude Code sin magia: Habr analiza la arquitectura, el ruido de contexto y las prácticas de ingeniería
En Habr se publicó un análisis detallado de Claude Code: por qué el agente pierde eficacia en sesiones largas, cómo se consume el contexto y por qué conviene separar skills, hooks, subagents y la verificación.

Ollama y LiteLLM: cómo convertir un script de Python en un chat LLM completo en consola
En la segunda parte de la guía práctica, el autor muestra cómo convertir un script básico de Python con Ollama y LiteLLM en un chat en consola con bucle de diálogo, system prompt y manejo de errores.

Sber mostró cómo RAG y LLM en el IDE convierten escenarios manuales en pruebas automatizadas
Sber describió un plugin de IDE que usa RAG y LLM para buscar ejemplos en la base de código y convertir escenarios manuales en pruebas automatizadas, conservando el estilo del proyecto y las reglas internas.

VS Code 1.111 lanzó Autopilot: el agente de AI escribe, prueba y despliega por sí solo
Microsoft lanzó VS Code 1.111 con el modo Autopilot: ahora el agente de AI trabaja de forma autónoma y completa toda la tarea sin la intervención del desarrollador en cada paso.

Habr explicó por qué los modelos de lenguaje y el RAG clásico pierden la comprensión de las relaciones
Habr analiza por qué los grandes modelos de lenguaje con RAG clásico encuentran bien fragmentos de texto, pero se pierden cuando necesitan reconstruir relaciones, causalidad y dependencias ocultas.

BotHub enumeró 10 herramientas de AI gratuitas para texto, código, video, 3D y documentos
BotHub publicó una selección de 10 herramientas de AI gratuitas, con opciones para texto, código, video, modelos 3D, trabajo con documentos y tareas autónomas.

LLM en desarrollo: qué 4 enfoques usan los equipos y en qué se diferencian
Los LLM ya no se usan solo como autocompletado: el artículo analiza cuatro modos de desarrollo asistido por AI en dos ejes — cuánto código controla una persona y cómo el equipo verifica el resultado.

Cursor, Copilot y Claude Code figuran en una selección de 12 agentes AI populares para desarrolladores
La selección reúne 12 herramientas AI para código — de Cursor y Copilot a GigaCode y Snyk: editores, IDEs en la nube y servicios de seguridad con distintos precios y disponibilidad en Rusia.

OpenAI, Google y Tesla marcaron la agenda de la semana: GPT-5.4 mini, AI Studio y Terafab
OpenAI abrió GPT-5.4 mini al acceso masivo, Google convirtió AI Studio en un entorno para crear aplicaciones, y Tesla prometió su propia fábrica de chips de $20–25 mil millones.

AI Independence Bench comparó 49 modelos y midió su resistencia a la presión del usuario
El nuevo benchmark AI Independence Bench comprueba si 49 modelos de lenguaje son capaces de mantener una postura propia, no disculparse sin motivo y no estar de acuerdo con el usuario por inercia.

Cómo el CEO de la agencia digital bijobs.ru montó un sitio web de presentación en un fin de semana con Claude Code
Bogdan Nepryakhin, de bijobs.ru, contó cómo sustituyó un mes de trabajo de un diseñador y un maquetador por Claude Code en un fin de semana y gastó casi diez veces menos.

Aparece una forma de sincronizar sesiones entre PC y portátil en OpenAI Codex
OpenAI Codex no cuenta con sincronización nativa entre dispositivos, por lo que apareció la herramienta CLI codexSync para trasladar sesiones, contexto e historial entre un PC y un portátil.

Desarrollador de Python pone límites a Claude Code: configuración contra regresiones en abierto
Un desarrollador en solitario de CREATMAN reunió una configuración para Claude Code que evita que el agente se salga del alcance de la tarea y rompa proyectos, y la publicó gratis.

Gemini: cómo Google convirtió el fracaso de Bard en 750 millones de usuarios y liderazgo en AI
En 2023, un error en un anuncio de Bard borró US$ 100.000 millones del valor de mercado de Alphabet — hoy Gemini supera a GPT-5.1 en benchmarks y alcanza 750 millones de usuarios activos mensuales.

Perplexity convirtió la búsqueda con AI en un agente que arma archivos Excel y verifica datos por sí mismo
En siete minutos, Perplexity Computer armó un archivo Excel de cuatro hojas con 33 fuentes, escribió su propio script en Python y mostró cómo AI está pasando de la búsqueda al trabajo analítico real.

Un desarrollador creó un statusline para Claude Code con monitoreo de VPS en una sola sesión
Un desarrollador se cansó de adivinar el estado del contexto y la carga de los servidores durante largas sesiones con Claude Code, y creó su propio statusline directamente en claude.ai en una sola sesión.

DeepMind propuso diez escalas cognitivas para medir el progreso hacia la AGI
Google DeepMind publicó el framework "Measuring Progress Toward AGI" — diez escalas cognitivas independientes que por primera vez permiten comparar sistemas de AI de forma objetiva.

Agentes de AI vs RAG: cómo funciona ReAct y por qué se necesitan sistemas multiagente
Una sola respuesta de LLM ya no basta: hace falta una cadena de acciones. Explicamos qué son los agentes de AI, en qué se diferencian de RAG, cómo funciona ReAct y por qué se necesitan sistemas multiagente.

Lemana Tech mostró cómo combinó LLM, RAG y ML tradicional en soporte técnico
La empresa describió un esquema híbrido de soporte: clasificadores rápidos de ML procesan tickets de alto volumen, mientras que LLMs con RAG se usan donde se necesitan respuestas basadas en la Wiki y escalado inteligente

Raiffeisenbank implementó un asistente RAG en Kotlin sin Python y sin nuevas competencias
El equipo de Raiffeisenbank construyó un asistente RAG interno sobre la stack JVM — Kotlin y Spring Boot — sin Python y sin incorporar competencias adicionales al equipo.

Garage Eight: cómo AI está cambiando el trabajo de los analistas y por qué están desapareciendo los puestos junior
Un analista de Garage Eight describió seis tendencias que ya están reconfigurando la profesión: AI se queda con la rutina, eleva el listón para los juniors y hace que los gerentes sean más autónomos en el trabajo con dat

OpenClaw desglosó el trabajo multiagente en tres modos: agentes independientes, subagentes y ACP
OpenClaw explicó cómo estructura el trabajo multiagente a través de Telegram: los agentes independientes reciben memoria y workspace, los subagentes toman tareas puntuales y ACP deriva el desarrollo a herramientas CLI ex

Habr AI Demuestra Cómo la Arquitectura de Reflejos para Agentes LLM Elimina la Latencia hasta 60 FPS
Habr AI exploró una arquitectura de doble proceso, donde una capa rápida de reflejos maneja las reacciones instantáneas, mientras que el LLM se encarga de la semántica, planificación y adaptación en tiempo real.

Apple apuesta por IA local en chips serie M, no en modelos gigantes
Mientras el mercado se mide por centros de datos y clusters de GPU, Apple está impulsando un escenario diferente: ejecutar IA cerca del usuario, en dispositivos con memoria unificada y bajo consumo de energía.