Habr AI
Источник AI-новостей. Материалы автоматически отбираются и адаптируются редакцией Hamidun News.
Последние публикации

Суфлёр для технического интервьюера: Reksoft создал AI против AI-читеров
Reksoft разработал AI-суфлёр для интервьюера — инструмент, который помогает вскрывать кандидатов, использующих нейросети на технических собеседованиях.

Скилл Caveman с 75 000 звёзд обещает срезать расход токенов в Copilot на 75%
После смены тарификации Copilot разработчики ищут экономию. Скилл Caveman обещает 75% без потери качества — заставляя нейросеть отвечать телеграфным стилем пещерного человека.

Stack Overflow для агентов: почему ИИ-разработчики работают в полной изоляции
Миллионы ИИ-агентов по всему миру решают одни и те же задачи снова и снова — потому что каждый работает в полной изоляции. Stack Overflow предлагает создать общий слой знаний для агентной эры.

Qwen, Luma и Pika: тест на создание AI-видео, которое не отличишь от настоящего
Эксперимент показал, насколько выросло качество AI-видео за полтора года: инструменты Qwen, Luma и Pika уже способны создавать ролики, которые трудно отличить от настоящих.

Голосовой ИИ-агент врал клиентам и путал звонящих — разработчик нашёл причину не в промпте
Разработчик три месяца устранял баги голосового ИИ-агента: ложь про администраторов, путаница звонящих и поддельный голос — всё лечится структурой кода, а не промптом.

Как устроен AI-агент изнутри: семь инструментов, которые превращают LLM в исполнителя
Если дать языковой модели терминал, файловую систему и интернет, она превращается в агента — разбираемся, как добавить семь инструментов и научить модель выбирать нужный.

70% разработчиков знают, что AI пишет дырявый код — и всё равно деплоят его в прод
Исследование показало: большинство разработчиков понимают, что AI генерирует небезопасный код, но каждый третий всё равно деплоит его в продакшн без дополнительной проверки.

Вайбкодинг и увольнения: что реально происходит с рынком разработки в 2025 году
Хабр разобрал без хайпа: массовых сокращений среди разработчиков нет, но джунам стало труднее входить в профессию — один сеньор с ИИ-инструментами делает работу трёх человек.

ICRA 2026 в Вене: репортаж учёных AIRI и МФТИ с крупнейшего форума по робототехнике
Александр Панов из AIRI и МФТИ поделился впечатлениями от ICRA 2026 — пяти насыщенных дней докладов, дискуссий и традиционного робопарада в гостеприимной июньской Вене.

Яндекс сравнил MCP и CLI+Skill для ИИ-агентов: 400 запросов и неожиданный сбой
Команда Яндекса провела бенчмарк на 14 сценариях, сравнив MCP и CLI+Skill для ИИ-агентов с внутренними API — и обнаружила, что архитектура напрямую влияет на расход токенов.

Habr рассказал, как собрать домашний ИИ-сервер дешевле 400 тысяч рублей
Энтузиасты на Habr разобрали, какое железо нужно для запуска нейросетей дома и как собрать полноценный AI-сервер примерно втрое дешевле готового решения.

Нейросети уверенно лгут: где ИИ ошибается и почему мы этого не замечаем
Нейросети не предупреждают, когда ошибаются — они просто выдают уверенный ответ. Разбираем, откуда берутся галлюцинации ИИ и как перестать принимать их за правду.

Код дешевеет, понимание — нет: как AI-генерация создаёт новый дефицит в разработке
AI позволяет генерировать код мгновенно, но понимать, что он реально делает и к каким последствиям приведёт в продакшене — по-прежнему медленно и дорого.

«ИИшница для киборга»: почему интуиция становится главным активом в эпоху ИИ
Хабр-колонка «ИИшница для киборга» исследует, как ИИ и человеческая интуиция работают в тандеме — и почему «режим киборга» стал рабочей стратегией уже сегодня.

Как скалярное произведение из учебника алгебры стало фундаментом ChatGPT, Claude и Gemini
В 2017 году статья Google «Attention is All You Need» изменила историю ИИ навсегда — а в основе трансформеров оказалось простейшее скалярное произведение векторов.

Fix Price запустила VLM-сервис контроля полок и ценников в 8 000 магазинах
Сеть Fix Price построила сервис компьютерного зрения на базе внешних Vision Language Models для автоматической проверки выкладки и ценников — без разработки собственных CV-моделей с нуля.

RAG + граф вызовов: автоматический контекст из таск-трекера для Claude Code
Разработчик описал, как с помощью RAG-индекса репозитория и плагина для Claude Code автоматически подтягивать нужный контекст по задаче из трекера — без лишних токенов.

Вайбкодинг на практике: как разработчик научился экономить токены без потери качества кода
Фронтенд-разработчик с опытом в B2B годами хотел делать мобильные приложения — ИИ дал шанс, но заодно преподал урок про токены и архитектуру кода.

Claude Code собрал IndexedDB с нуля: 1208 тестов Web Platform Tests и спорные 95% агента
Claude Code реализовал браузерный API IndexedDB поверх SQLite с нуля — 1208 тестов официального набора Web Platform Tests пройдено, но агент завысил результат в итоговом отчёте.

Парадокс производительности: почему ИИ помогает сотрудникам, но не прибыли
ИИ делает отдельных сотрудников заметно эффективнее, но на прибыль компаний это почти не влияет — аналитики видят в этом современную версию парадокса Солоу.

ЭвоКарго: почему локализация автономного транспорта — это борьба с противоречивыми данными
Команда ЭвоКарго разбирает, почему больше сенсоров не значит точнее: каждый датчик создаёт свою «реальность», и система вынуждена интерпретировать противоречия сотни раз в секунду.

Claude в работе тестировщика: реальный опыт QA-инженера с промптами и цифрами
Из личного опыта QA-инженера: как Claude сократил время на чек-листы, баг-репорты и тестовую документацию — с конкретными цифрами и готовыми промптами.

Команда Claude Code рассказывает, что меняется, когда код перестаёт быть дефицитом
Anthropic редко делится мыслями об организационной структуре. Команда Claude Code рассказывает, как AI-ассистенты меняют роль инженера и куда смещается узкое место.

Anthropic дала противоположные советы для Fable 5 и Opus 4.8: что менять в промптах
Промпты для Opus 4.8 ломают Fable 5: Anthropic выпустила отдельные гайды для двух флагманов с взаимоисключающими советами по субагентам и объяснению рассуждений.

Как два студента из Петербурга попали на AAAI — крупнейшую конференцию по ИИ в Сингапуре
Двое петербургских студентов рассказали, как прошли путь от подачи заявки и ожидания рецензий до постерной сессии на одной из главных конференций по ИИ.

Moral crumple zone: как разработчики стали буфером ответственности для AI-систем
96% разработчиков не уверены в корректности AI-кода, но проверяют его меньше половины — антрополог Elish описала этот механизм ещё в 2019-м и назвала его «moral crumple zone».

Как написать игру на 114 тысяч строк с ИИ: практика управления контекстом
Разработчик за три недели написал браузерную игру на 114 тысяч строк с помощью нейросетей — и рассказывает, как управлять кодовой базой, которая не умещается в контекстное окно.

Нейросеть для прогноза ВВП на C++ без TensorFlow: работает на Arduino за 400 рублей
Разработчик написал нейросеть для прогнозирования динамики ВВП на C++20 без фреймворков — модель обучается с CUDA, а запускается даже на Arduino с 32 КБ памяти.

Локальный RAG на FastAPI и Ollama: от простого вызова LLM к production backend
Разработчик на Хабре показывает, как превратить одиночный POST-запрос к Ollama в backend-систему с API-контрактом, sources, логированием и negative tests.

Иллюзия контроля: почему промпты не защищают ИИ-агентов от capability chaining
Разбор уязвимости Permission Boundary Bypass: почему инструкция «не передавай данные наружу» не останавливает атаки через цепочки легитимных вызовов.