Habr AI
Источник AI-новостей. Материалы автоматически отбираются и адаптируются редакцией Hamidun News.
Последние публикации

Claude Code за год прошёл путь от беты без plan mode до миллиона токенов и 9 субагентов
За год инструменты для AI-разработки прошли путь от сырой беты к агентным системам с миллионным контекстом, а рынок вокруг Claude Code и Cursor резко ускорился и подешевел.

Ollama и LiteLLM: на Habr показали, как запустить локальный LLM-чат на Python без облака
На Habr вышел практический гайд для новичков: автор показывает, как развернуть локальную модель через Ollama, подключить её к Python через LiteLLM и получить первый ответ без API-ключей.

Островок собрал 30 паттернов инженерии ИИ-систем и показал, как их применять
Островок перевёл и адаптировал материал о 30 паттернах инженерии ИИ-систем: от проектирования LLM- и RAG-решений до оценки рисков, компромиссов и зон применения.

Raspberry Pi 5 и openLight: почему типичные AI-агенты перегружают маленькое железо
Автор разобрал, почему популярные фреймворки AI-агентов плохо подходят для Raspberry Pi 5, и собрал openLight — лёгкий runtime на Go с Telegram-интерфейсом, SQLite и детерминированной маршрутизацией.

Т-Банк поднял качество AI Code Completion с помощью фильтра и убрал лишние подсказки
Т-Банк внедрил двухслойный фильтр для AI Code Completion: сначала LLM оценивает уместность подсказки, затем CatBoost уточняет решение, что дало +5,2 п. п. к Acceptance Rate.

BotHub, GPTunnel и ruGPT: как российские AI-агрегаторы делят рынок в 2026 году
Сравнение BotHub, GPTunnel, ruGPT.io, Syntx AI и AI Wiz показало, что российские AI-агрегаторы конкурируют не ценой, а удобством, локальной оплатой и разными сценариями работы.

Хабр AI описал архитектуру рефлексирующего агента: меньше автопилота, больше самопроверки
Хабр AI показал, как устроен рефлексирующий агент: с черновиками, паузами, откатом и обязательной самопроверкой перед действиями в коде, данных и бизнес-процессах.

Habr AI: как промпт-инжиниринг в разработке экономит часы, но не заменяет понимание задач
Habr AI разбирает практический промпт-инжиниринг для разработки: хорошие инструкции реально экономят часы, но работают только вместе с пониманием задачи, кода и ограничений проекта.

Claude Code скрывает историю: на диске нашли 715 сессий, хотя в интерфейсе видно 69
Разбор внутренностей Claude Code показал, что приложение хранит сотни старых сессий локально, но не показывает их в интерфейсе: на диске нашлись 48 МБ истории и 715 чатов.

Claude и Ollama помогли селлеру Ozon за день обработать сертификаты и вернуть 1000 SKU
Селлер Ozon использовал Claude и локальную модель Ollama, чтобы распознать 231 сертификат, массово загрузить их через API и вернуть к продаже более 1000 заблокированных SKU за один день.

Claude Code без магии: Habr разобрал архитектуру, шум контекста и инженерные практики
На Habr вышел подробный разбор Claude Code: почему агент теряет эффективность в длинных сессиях, как съедается контекст и зачем разделять skills, hooks, subagents и проверку.

Ollama и LiteLLM: как превратить Python-скрипт в полноценный консольный LLM-чат
Во второй части практического гайда автор показывает, как превратить базовый Python-скрипт с Ollama и LiteLLM в консольный чат с циклом диалога, system prompt и обработкой сбоев.

Сбер показал, как RAG и LLM в IDE превращают ручные сценарии в автотесты
Сбер описал IDE-плагин, который с помощью RAG и LLM ищет примеры в кодовой базе и превращает ручные сценарии в автотесты, сохраняя стиль проекта и внутренние правила.

VS Code 1.111 запустил Autopilot: ИИ-агент пишет, тестирует и деплоит сам
Microsoft выпустила VS Code 1.111 с режимом Autopilot — ИИ-агент теперь работает автономно и завершает задачу целиком без участия разработчика на каждом шаге.

Хабр объяснил, почему языковые модели и классический RAG теряют понимание связей
Хабр разбирает, почему большие языковые модели с классическим RAG хорошо ищут фрагменты текста, но теряются, когда нужно восстановить связи, причинность и скрытые зависимости.

BotHub перечислил 10 бесплатных нейросетей для текста, кода, видео, 3D и документов
BotHub выпустил подборку из десяти бесплатных нейросетей: в ней есть инструменты для текста, кода, видео, 3D-моделей, работы с документами и автономных задач.

LLM в разработке: какие 4 подхода используют команды и чем они отличаются
LLM уже используют не только как автодополнение: материал разбирает четыре режима AI-разработки по двум осям — сколько кода контролирует человек и как команда проверяет результат.

Cursor, Copilot и Claude Code вошли в подборку 12 популярных AI-агентов для разработчиков
В подборке 12 AI-инструментов для кода — от Cursor и Copilot до GigaCode и Snyk: редакторы, облачные IDE и сервисы безопасности с разной ценой и доступностью в России.

OpenAI, Google и Tesla задали повестку недели: GPT-5.4 mini, AI Studio и Terafab
OpenAI открыла GPT-5.4 mini для массового доступа, Google превратила AI Studio в среду для сборки приложений, а Tesla пообещала свой чиповый завод на $20–25 млрд.

AI Independence Bench сравнил 49 моделей и измерил их устойчивость к давлению пользователя
Новый бенчмарк AI Independence Bench проверяет, способны ли 49 языковых моделей сохранять собственную позицию, не извиняться без причины и не соглашаться с пользователем по инерции.

Как CEO digital-агентства bijobs.ru собрал сайт-визитку за выходные с Claude Code
Богдан Непряхин из bijobs.ru рассказал, как заменил месяц работы дизайнера и верстальщика двумя выходными с Claude Code — и потратил на порядок меньше денег.

Для OpenAI Codex появился способ синхронизировать сессии между ПК и ноутбуком
У OpenAI Codex нет штатной синхронизации между устройствами, поэтому для переноса сессий, контекста и истории между ПК и ноутбуком появился CLI-инструмент codexSync.

Python-разработчик укротил Claude Code: конфиг против регрессий в открытом доступе
Разработчик-одиночка из CREATMAN собрал конфигурацию для Claude Code, которая не даёт агенту выходить за рамки задачи и ломать проекты — и опубликовал её бесплатно.

Gemini: как Google превратил провал Bard в 750 млн пользователей и лидерство в AI
В 2023 году ошибка в рекламе Bard обрушила акции Alphabet на $100 млрд — сегодня Gemini обходит GPT-5.1 в бенчмарках и достигает 750 млн активных пользователей в месяц.

Perplexity превратила AI-поиск в агента, который сам собирает Excel и проверяет данные
Perplexity Computer за семь минут собрал Excel на четыре листа с 33 источниками, сам написал Python-скрипт и показал, как AI переходит от поиска к реальной аналитической работе.

Разработчик написал statusline для Claude Code с мониторингом VPS за одну сессию
Разработчик устал угадывать состояние контекста и нагрузку серверов при длинных сессиях с Claude Code — и написал собственный statusline прямо в claude.ai за одну сессию.

DeepMind предложил десять когнитивных шкал для оценки прогресса к AGI
Google DeepMind опубликовал фреймворк «Measuring Progress Toward AGI» — десять независимых когнитивных шкал, которые впервые позволяют объективно сравнивать AI-системы между собой.

ИИ-агенты vs RAG: как работает ReAct и зачем нужны мультиагентные системы
Одного ответа LLM уже недостаточно — нужна цепочка действий. Разбираем, что такое ИИ-агенты, чем они отличаются от RAG, как устроен ReAct и зачем нужны мультиагентные системы.

Лемана Тех показала, как объединила LLM, RAG и классический ML в техподдержке
Компания описала гибридную схему поддержки: быстрые ML-классификаторы обрабатывают массовые тикеты, а LLM с RAG подключают там, где нужны ответы по Wiki и умная эскалация.

Райффайзенбанк внедрил RAG-ассистента на Kotlin без Python и без новых компетенций
Команда Райффайзенбанка построила внутреннего RAG-ассистента на JVM-стеке — Kotlin, Spring Boot — без Python и без привлечения дополнительных компетенций в команду.