Habr AI
Источник AI-новостей. Материалы автоматически отбираются и адаптируются редакцией Hamidun News.
Последние публикации

Habr AI объяснил, почему LLM не считают, не учатся в диалоге и зависят от инструментов
Habr AI объясняет, что языковые модели сами по себе умеют только работать с текстом, а память, расчеты, поиск, агенты и «цифровые сотрудники» появляются за счет внешних инструментов.

Svoi.ru сократила подготовку к тестированию на 70% с помощью AI-агентов
Команда Svoi.ru показала, как AI-агенты могут автоматизировать разбор требований и подготовку тестовой документации, сняв с QA рутинную аналитику и сократив этот этап на 70%.

Kodik объяснила, почему публичные бенчмарки языковых моделей вводят в заблуждение
Kodik разобрала слабые места популярных тестов для LLM и показала, почему для AI-редактора кода важнее собственный бенчмарк, а не красивые проценты в чужих таблицах.

Как Google DeepMind и конкуренты меняют музыку: пять ИИ-сервисов для генерации треков
Подборка из пяти ИИ-сервисов показывает, как генерация музыки по текстовому запросу перестала быть игрушкой и стала рабочим инструментом для авторов, брендов и независимых продюсеров.

WisprFlow, Whisper и GigaAM: кто лучше распознаёт русско-английскую речь
Автор сравнил пять приложений и пять моделей голосового ввода для русско-английской смеси и показал, чем локальные open source-решения уже могут заменить WisprFlow.

GPTunneL и тренд Forbes: почему AI-супераппы становятся новой точкой роста рынка
GPTunneL, выросший до 2 млн пользователей, описывает, как AI-супераппы меняют поведение аудитории, спрос корпораций и экономику рынка — от Китая и США до России.

На Habr показали, как обучить мини-LLM на C# через ILGPU и встроенную AMD-графику
На Habr вышел разбор, как собрать и обучить крошечную LLM на C# с ILGPU и OpenCL, экспортировать её в GGUF и запустить в LM Studio даже на встроенной AMD-графике.

Anthropic показала Claude Mythos Preview через system card на 244 страницы вместо релиза
Anthropic представила Claude Mythos Preview не как обычный запуск, а через 244-страничную system card, где описаны возможности модели, риски и причины ограниченного доступа.

OpenAI и Anthropic меняют расчёт стоимости языковых моделей: в 2026 важна цена задачи
OpenAI и Anthropic меняют правила тарификации LLM: в 2026 бизнесу уже мало следить за ценой токена — считать придётся полную стоимость решения задачи.

Claude Code превратили в AI-аналитика по BABOK: ассистент ведёт интервью и собирает требования
На базе Claude Code собрали AI-ассистента для бизнес-анализа по BABOK v3: он помогает вести интервью, собирать требования, не пропускать шаги и оформлять артефакты.

Claude Code и Codex: как сократить потери токенов с помощью трех markdown-файлов
Claude Code и Codex часто тратят большую часть контекста на повторную навигацию по проектам; решить это можно иерархией из глобальной карты, CLAUDE.md и памяти прошлых сессий.

LM Studio и Qwen: как локальные LLM справляются с кодингом на MacBook M4 Pro
Автор проверил локальные Qwen, Gemma и другие модели для кодинга через LM Studio на MacBook M4 Pro: в чате они уже жизнеспособны, но в агентском режиме заметно уступают облаку.

Qwen 3.5 на MacBook Pro: сравнение восьми локальных серверов для командной работы
Автор протестировал восемь MLX-серверов на MacBook Pro M2 Max с Qwen 3.5 35B и показал, что при параллельных запросах почти все решения резко теряют скорость.

Selectel: ИИ не забирает работу, но делает вход в профессию заметно сложнее
Selectel описывает новый рынок труда вокруг ИИ: вакансии не пропадают, но джунам сложнее войти в профессию, а спрос и зарплаты смещаются к тем, кто умеет работать с моделями.

Habr AI выпустил гид по ChatGPT, Claude и mcp для тех, кто только входит в тему
Habr AI объяснил без лишней теории, чем отличаются локальные и облачные модели, зачем платить за подписки, как работают агенты и почему mcp уже становится стандартом.

Йошуа Бенджио и LawZero: почему страх перед будущим ИИ отвлекает от угроз сегодня
Текст о «пари Паскаля» в ИИ объясняет, почему страх перед гипотетическим сверхразумом уводит внимание от уже реальных угроз: слежки, корпоративной власти и давления на работников.

Anthropic и Claude Opus 4.7: реальный расход токенов оказался выше заявленного
Автор замерил новый токенайзер Claude Opus 4.7 и получил рост расхода до 45–47% вместо обещанных Anthropic 0–35%, что напрямую бьёт по квотам, кешу и скорости выгорания Max-плана.

OpenAI вывела GPT-Rosalind в биологию: что умеет новая модель и где её пределы
OpenAI запустила GPT-Rosalind для задач наук о жизни и связала её с исследовательским модулем Codex, обещая ускорить гипотезы и эксперименты без ручной сборки из десятков сервисов.

Исследование Cursor показало четыре уязвимости в защите редактора кода, но не сломало авторизацию
Технический аудит Cursor выявил prototype pollution, скрытое dev-поле и утечки внутренней архитектуры, но подтвердил, что проверка подписки и доступ к премиум-моделям остаются серверными.

Anthropic выпустила Opus 4.7, а OpenAI превратила Codex в агента для работы за компьютером
Неделя в ИИ принесла сразу несколько сдвигов: Anthropic обновила Opus 4.7, OpenAI дала Codex управление компьютером, а Google и Baidu открыли новые голосовые и визуальные модели.

ChatGPT без ошибок прошёл пять медицинских кейсов, но уступил в плане действий
В сравнении пяти медицинских кейсов ChatGPT ни разу не ошибся с главным диагнозом, но заметно уступил на этапе практических рекомендаций, обследований и маршрута пациента.

Почему LLM-сервисы игнорируют ваши инструкции и как на самом деле вернуть контроль
Даже подробный промпт не гарантирует послушный ответ: материал объясняет, почему LLM ломают формат, поддаются инъекциям и требуют не только текста, но и инженерных ограничений.

Google и OpenAI упираются в предел: что будет, если в сети закончится человеческий текст
Генеративный ИИ не только съедает трафик у сайтов через AI-сводки, но и подтачивает собственную базу обучения: чем меньше людям выгодно писать, тем хуже станут интернет и будущие модели.

Как Московский кредитный банк показывает эволюцию обучения в банках — от клерков к ИИ
Московский кредитный банк проследил, как банки учили сотрудников от проверки монет и деловой переписки до персонализированного онбординга, комплаенса и ИИ-ассистентов.

OpenAI встроила технологии Sky в Codex для Mac и усилила фоновое управление приложениями
OpenAI перенесла наработки Sky в Codex для Mac: агент теперь управляет несколькими приложениями в фоне, использует собственные курсоры и точнее справляется с рутинными задачами.

Habr AI объяснил, как data-driven поиск решений меняет клиент-серверную архитектуру
В материале Habr AI разбирается, как экспертные системы с поиском решений, управляемым данными, должны строить работу с пользователем локально, в сети и через интернет.

Seedance 2.0 привлекла внимание сверхреалистичной генерацией людей и сцен
Мультимодальная система Seedance 2.0 принимает текст, изображения, аудио и видео, а на выходе создает почти кинематографические ролики, из-за которых уже спорят о рисках дипфейков.

Claude Code и Codex меняют правила: промпты уступают место инженерии контекста
Разбор о Context Engineering показывает, почему в Claude Code, Codex и агентных IDE решает уже не промпт, а то, как устроены память, системные инструкции, tools и вся сборка контекста.

Почему диффузионные модели оставляют швы на 40-мегапиксельных фото и как дать тайлам память
Материал разбирает, почему тайлинг ломает 40–150-мегапиксельные кадры в диффузионных моделях и какие механики памяти из видео-диффузии можно перенести на фото.

Любомир Горбатко представил Sessa — альтернативу трансформерам и Mamba
На Habr вышел разбор архитектуры Sessa, где автор пытается объединить сильные стороны Transformer и Mamba, чтобы лучше работать с длинным контекстом без потери управляемой памяти.