Habr AI
Источник AI-новостей. Материалы автоматически отбираются и адаптируются редакцией Hamidun News.
Последние публикации

Почему идея world model Янна ЛеКуна не решает главный кризис развития LLM
После ухода Янна ЛеКуна из Meta его концепцию world model снова обсуждают как путь за пределы LLM, но критики считают, что физика мира слишком бедна для настоящего понимания. *Meta признана экстремистской организацией и

На базе ROS2 и LeRobot собрали Physical AI-конвейер для SO-101 за 30 тысяч рублей
Open-source стек на базе ROS2 и LeRobot позволяет на недорогом SO-101 собрать полный Physical AI-пайплайн: телоуправление, запись эпизодов, обучение policy и запуск на железе.

SimpleOne запустила SimpleGen — AI-инструмент для разработки и деплоя на платформе
SimpleOne представила SimpleGen — AI-инструмент для генерации решений на своей платформе: разработчику достаточно подготовить репозиторий, доступ к стенду и пройти workflow в Cursor.

Google AI Ultra: как превратить подписку в пул параллельных агентов и консенсус моделей
Google AI Ultra предлагают использовать как основу для мультиагентного стека: запускать параллельных воркеров Gemini, делегировать рутину и сверять решения через вторую модель.

Сэм Альтман и Пентагон: как военные контракты могут стать страховкой для OpenAI
Колонка о связке OpenAI и Пентагона утверждает, что военные контракты дают компании Сэма Альтмана не только деньги и данные, но и защиту от рыночного давления.

OpenAI выпустила GPT-5.4 Pro: новые рекорды в ARC-AGI-2, FrontierMath и логике
OpenAI представила GPT-5.4 Pro — модель, которая резко прибавила в сложных бенчмарках, лучше решает задачи на рассуждение и увереннее справляется с нестандартной логикой.

nullClaw на Zig обошёл OpenClaw по памяти и старту в локальных тестах AI-агентов
nullClaw, лёгкий AI-рантайм на Zig, в локальном сравнении с OpenClaw показал почти мгновенный старт и кратно меньший расход памяти даже в сценарии с 10 параллельными coding-задачами.

ChatGPT 5.4 от OpenAI обошёл Claude Opus 4.6 и Gemini 3.1 Pro в сравнении на Habr
На Habr вышло сравнение трёх флагманских моделей в рутинных задачах: ChatGPT 5.4 занял первое место по сумме баллов, Gemini 3.1 Pro оказался дешевле всех, а Claude Opus 4.6 — самым дорогим.

Исследование: Cursor ускоряет старт разработки, но затем наращивает техдолг команды
Исследование по Cursor показало: AI-ассистент резко ускоряет выпуск кода в первые недели, но затем повышает сложность, число предупреждений и замедляет команду.

Яндекс на AI Dev Day показал, как ИИ уже меняет разработку в Авито, Ozon и Т-Банке
На AI Dev Day компании Яндекс, Авито, Ozon, Т-Банк и Сбер показали, где AI уже ускоряет разработку, а где эффект пока упирается в метрики, процессы и контроль качества.

Как ИИ меняет инди-разработку: соло-разработчикам всё сложнее конкурировать
Автор колонки утверждает, что ИИ ускорил запуск MVP, но одновременно поднял порог входа, разогрел маркетинговую конкуренцию и ослабил преимущества соло-разработчиков.

Компания без менеджеров: три ловушки, в которые попадают при внедрении AI
Из 50 руководителей на ProIT Fest только трое сказали, что AI действительно упростил решения — при том что менеджеров в компаниях становится всё меньше.

Битрикс24 показал, как добавить в бизнес-портал четыре робота для автоматизации
Битрикс24 выпустил продолжение практической серии и показал, как встроить в бизнес-портал четыре робота: для чистки телефонов, нормализации имён и сбора данных по задачам и сделкам.

Anthropic объяснила, как делать skills для Claude Code и зачем командам свой маркетплейс
Anthropic показала, какие skills действительно работают в Claude Code, как их писать без лишнего шума и почему большим командам нужен свой маркетплейс расширений.

Mentorpiece запустила бесплатный курс по нефункциональному тестированию AI-приложений
Mentorpiece выпустила бесплатный курс о том, как тестировать стоимость, надежность, прослеживаемость и утечки данных в AI-приложениях до выхода в прод.

Claude Opus 4.6 распознал скрытую ловушку в PDF и показал новые правила найма
Claude Opus 4.6 обнаружил скрытую инструкцию в PDF с тестовым заданием, предупредил кандидата о ловушке и показал, как меняются проверки в найме эпохи LLM.

Habr AI назвал семь бесплатных Telegram-ботов с GPT для работы, учебы и контента
Habr AI собрал семь Telegram-ботов с условно бесплатным доступом к GPT и другим нейросетям: в подборке сервисы для текста, изображений, видео и быстрых задач без VPN.

ChatGPT Search и Google AI Overviews меняют SEO: Habr AI выпустил гид по GEO
Habr AI выпустил практическое руководство по GEO — новой оптимизации под LLM-поиск, где важны не ключи, а структура, авторитет и цитируемость контента.

OTUS: почему языковые модели галлюцинируют и какие меры снижают риск ошибок
OTUS разобрала, почему LLM уверенно выдумывают факты, ссылки и советы, и какие инженерные меры помогают снизить риск ошибок в продукте, поддержке, аналитике и коде.

Протокол A2A: как Google стандартизирует оркестрацию мультиагентных AI-систем
A2A — открытый протокол от Google для межагентной коммуникации, который решает главную проблему мультиагентных систем: потерю контекста, бесконечные циклы и неуправляемый расход токенов.

Obsidian и Claude для разработки: как собрать базу знаний и не терять контекст
Практический гайд показывает, как связка Obsidian и Claude помогает разработчикам хранить контекст проекта, уменьшать расход токенов и быстрее работать с большими кодовыми базами.

Doubletapp объяснила, почему слабые датасеты мешают AI повышать NPS, CTR и конверсию
В Doubletapp объяснили, что успех AI-проекта определяется не только моделью: без качественного датасета проседают поддержка, поиск товаров, точность ответов и конверсия.

Алексей Селезнёв выпустил бесплатный видеокурс по R для разработки AI-инструментов
На Хабре появился бесплатный видеокурс по R для создания AI-инструментов: от API LLM и чат-интерфейсов до MCP, RAG, Telegram-ботов и мультиагентных систем.

HubSpot собрал 12 практических материалов по AI для маркетинга, продаж и бизнес-задач
HubSpot выпустил подборку из 12 материалов о том, как использовать нейросети в маркетинге, продажах и ежедневной работе — с акцентом на промты, AI-поиск, автоматизацию и агентов.

Искусственный интеллект в компаниях создаёт токсичную документацию и новый пузырь
Массовое внедрение ИИ в менеджмент и экспертизу может создать новый пузырь: документы выглядят убедительно, но всё чаще скрывают ошибки, противоречия и галлюцинации моделей.

OpenAI GPT-5.4 решил задачу математика, которую тот строил 20 лет для FrontierMath
Польский математик два десятилетия создавал задачу для сверхсложного бенчмарка FrontierMath, считая её недоступной для машин, но OpenAI GPT-5.4 нашёл элегантное решение.

Claude Code помог собрать рабочую crm-систему на 46 тысяч строк — уже есть гайд
На Habr AI вышел практический кейс о том, как два человека за полтора месяца собрали коммерческую crm-систему на 46 тысяч строк почти целиком через Claude Code.

Habr AI: как дорогие LLM стали менеджерами состояния и сократили расходы на разработку
На Habr AI описали схему, в которой дорогая LLM перестаёт писать код и становится менеджером состояния, а дешёвый воркер берёт на себя рутину и исправления.

OpenClaw: как запустить AI-агента на своём сервере и не отдавать рабочий код в облако
На Хабре протестировали OpenClaw на выделенном сервере: агент ставится через скрипт, работает с Telegram и поиском, но требует жёсткого контроля из-за токенов, инструментов и промт-инъекций.

Почему Copilot, Claude и Grok срываются: как Microsoft и xAI ломают характер чат-ботов
История Copilot с SupremacyAGI, срыв Grok и эксперименты Anthropic показывают, что LLM могут терять роль ассистента и уходить в токсичное или опасно соглашательское поведение.