Habr AI
Источник AI-новостей. Материалы автоматически отбираются и адаптируются редакцией Hamidun News.
Последние публикации

Hack The Box: как MCP Inspector превращает AI-инструменты в новую точку атаки
Разбор Kobold из HTB Season 10 показывает, как одна dev-утилита для AI-серверов может привести к RCE, LFI, повторному использованию учётных данных и полному захвату хоста через Docker.

Система на базе LLM сократила подготовку карт контроля на заводе с 2 часов до 5 минут
На металлургическом заводе LLM-система начала собирать карты контроля за 3–5 минут вместо двух часов: сработал не универсальный промт, а набор правил, привязанных к каждому ГОСТу.

Habr AI показал, как добавить память и контекст в LLM-чат на Python с Ollama и LiteLLM
В новой части туториала по Python-чату с Ollama и LiteLLM показано, как хранить историю сообщений, передавать контекст модели и ограничивать память без усложнения архитектуры.

Claude Sonnet и Jarvis Pattern: почему ИИ-агентам может хватить операционной системы
На Habr предложили строить персональных AI-агентов не вокруг сложных фреймворков, а на связке LLM, операционной системы и файловой памяти — с упором на реальные DevSecOps-задачи.

Яндекс показал, как бизнесу попасть в ответы Алисы и измерять видимость в поиске
Яндекс запустил в Вебмастере раздел «Видимость сайта в Алисе», и для бизнеса это сигнал: в ответы ассистента ведут не трюки, а сильная поисковая оптимизация, структура и точные данные.

Флант: как Go-разработчик превратил Zed и Gemini в полезного ИИ-агента
Go-разработчик из «Фланта» описал путь от медленных IDE-плагинов к связке Zed, Gemini 3 Flash и gopls-mcp, которая даёт ИИ-агенту контекст проекта и реальную пользу в коде.

Agentis Memory: Redis-совместимое хранилище с векторным поиском и локальными эмбеддингами
Agentis Memory превращает Redis-совместимое хранилище в общую память для AI-агентов: с локальными эмбеддингами, встроенным векторным поиском и без внешних API.

Habr: как synthetic data помогает обучать модели и почему self-training ведет к collapse
Синтетические данные помогают ИИ компенсировать дефицит качественного человеческого корпуса, но при бесконтрольном self-training модели начинают терять редкие случаи и разнообразие.

Почему ChatGPT и Gemini не рекомендуют ваш B2B SaaS, даже если сайт сделан нормально
Даже хороший B2B SaaS-сайт может не попасть в ответы ChatGPT, Gemini и Perplexity, если у бренда нет чёткой категории, внешних подтверждений и устойчивого цифрового профиля.

Почему ИИ в UI-дизайне важен не для продакшена, а как источник визуальных мутаций
AI-generated UI ценен не только скоростью набросков: его сила в редких визуальных сочетаниях, которые помогают дизайнерам находить новые ходы и менять сам процесс поиска интерфейсов.

Qwen и llama.cpp: как запустить локальную нейросеть без облака на компьютере или сервере
Практический материал объясняет, как запустить модель Qwen через llama.cpp на своём компьютере или сервере, чтобы работать с локальной нейросетью без облаков, подписок и утечки данных.

Anthropic и Claude Cowork: 10 рабочих задач, которые ИИ снимает с человека
Claude Cowork от Anthropic показывает, как ИИ берёт на себя утренние брифинги, КП, ответы клиентам и отчёты, возвращая до двух-трёх рабочих дней в неделю.

Directum: почему бизнес активно обсуждает ИИ-агентов, но не спешит внедрять их в процессы
Directum объясняет, почему ИИ-агенты стали главным корпоративным трендом, но массовое внедрение тормозят дорогая инфраструктура, риски ошибок и вопрос ответственности.

ClawRouter снизил расходы на LLM API с $47 до $1.80 за неделю — обзор умного роутера
Роутер ClawRouter анализирует каждый промпт по 15 параметрам и направляет к наиболее дешёвой подходящей модели — это снизило недельные расходы на LLM API с $47 до $1.80.

Агентное кодирование как зависимость: почему разработчики не могут остановиться
CTO стартапов не спят до трёх ночи без дедлайнов, CEO Y Combinator хвастается 19-часовыми сессиями — исследователи UC Berkeley видят паттерн азартных игр.

PromptPilot: планировщик задач для Claude Code и Codex, который работает пока вы спите
Российский разработчик создал планировщик задач для AI CLI — PromptPilot принимает промпты из терминала, браузера или Telegram-бота и выполняет их по расписанию с автоповтором при rate limit.

Яндекс Code Assistant для VS Code: как изменилось расширение и что даёт индексация кода
Автор обзора протестировал Yandex Code Assistant для VS Code и выделил главное: чат, diff, правила и скилы, а главное — индексацию проекта в эмбеддингах для более осмысленной работы с кодом.

Как один разработчик с Claude Code запустил geo-платформу для брендов в девяти нейросетях
Мобильный разработчик превратил интерес к GEO в полноценный продукт и с помощью Claude Code собрал платформу, которая отслеживает и помогает усиливать видимость бренда сразу в девяти нейросетях.

Luminarys AI представила платформу AI-агентов с изоляцией навыков и кластерным запуском
Luminarys AI представила платформу для запуска AI-агентов, где навыки изолируются в WebAssembly, пишутся на нескольких языках и масштабируются на кластер из разных машин.

OpenClaw на Xiaomi 11T: как старый смартфон превратили в домашний AI-сервер
Старый Xiaomi 11T с 8 ГБ ОЗУ превратили в домашний AI-шлюз на OpenClaw: через Termux и OpenRouter смартфон отвечает в Telegram, но требует аккуратной настройки и защиты.

Samsung ждет конца дефицита памяти к 2028 году — и это меняет взгляд на ИИ-бум
Samsung, крупнейший производитель памяти, ждет ослабления дефицита к 2028 году — и автор статьи видит в этом сигнал: рынок ИИ готовится не только к росту, но и к возможному охлаждению.

Raft представила фреймворк «AI Комп-Ас» для выгодного и безопасного внедрения ИИ
Компания Raft описала фреймворк AI КОМП-АС — пошаговый подход к внедрению ИИ, который помогает связать инициативы с бизнес-целями, оценить риски, ROI и путь от пилота к масштабу.

Habr AI: почему агентным системам нужны новые метрики контроля и безопасности
По мере перехода от чат-ботов к автономным AI-агентам компаниям приходится оценивать не только качество ответа, но и планирование, вызовы инструментов, риски и наблюдаемость.

PHP и RubixML переходят от массивов к GPU: как в экосистеме меняется подход к ML
PHP-сообщество всё активнее выносит машинное обучение из массивов и циклов в нативные структуры, расширения и GPU, превращая язык из вычислителя в оркестратор ML-пайплайнов.

Google выпустила Gemma 4, а Anthropic оказалась в центре утечек и исследований
Неделя в ИИ прошла под знаком релизов и утечек: Google открыла Gemma 4, Anthropic пережила утечки Claude Code и Mythos, Cursor сделал ставку на агентов, а Netflix показала видео-модель VOID.

Почему компании теряют миллионы на ChatGPT и ИИ: три главные ошибки внедрения в B2B
Компании покупают дорогие ИИ-инструменты, но сотрудники обходят запреты, уходят в личные аккаунты и делают утечки невидимыми, если внедрение строится на контроле, а не на удобстве.

Claude Code от Anthropic: как настроить ИИ-помощника для работы без навыков программирования
Гайд по Claude Code показывает, как превратить инструмент Anthropic из помощника для разработчиков в систему для заметок, базы знаний, исследований и личной автоматизации без навыков кода.

Google открыла бесплатный доступ к Veo 3.1: 10 генераций видео в месяц без подписки
Google разрешила всем владельцам Google-аккаунтов бесплатно тестировать Veo 3.1: доступно 10 генераций видео в месяц, 720p, ролики до 8 секунд и встроенный звук.

Сэм Альтман и OpenAI резко снизили план расходов на ИИ-инфраструктуру до 2030 года
OpenAI сократила ориентир по расходам на вычислительную инфраструктуру до 600 млрд долларов к 2030 году, и рынок увидел в этом переход от эйфории к более жесткой экономике ИИ.

Почему ИИ-агенты проваливаются в проде: из чего состоит зрелая LLM-система в компании
Инженерный разбор на Хабре: почему ИИ-агенты ломаются в проде — и из каких компонентов на деле состоит зрелая LLM-система, способная работать в реальной компании.