#Исследования
Подборка материалов по теме «Исследования»: релизы, исследования, бенчмарки, опенсорс.

OpenAI раскритиковала бенчмарк SWE-Bench Pro за неточность оценки
OpenAI провела анализ популярного бенчмарка SWE-Bench Pro и выявила проблемы с надёжностью оценки способностей AI-моделей к кодированию.

Дебиасинг NLP-моделей создаёт новые стереотипы для других демографических групп
Исследование arXiv показало: методы предобработки снижают предвзятость для целевых групп, но непреднамеренно усиливают её для других — и ста

LSTM превзошла Random Forest и Naive Bayes в анализе тональности твитов с ROC-AUC 0,92

MetaNCA учит нейросети самоорганизоваться без обратного распространения ошибки

Главный футурист OpenAI Джошуа Ахиам уходит из компании после девяти лет в области AI safety

Как защитить код от ИИ-атак: платформа Lightwell от IBM

Apple опубликовала Fortress — фреймворк стабилизации рекомендательных систем через обрезку признаков
Apple ML Research описала Fortress — систему, которая устраняет временную нестабильность рекомендательных моделей, выявляя и удаляя признаки

Harvard: AI-стартапы нанимают меньше джунов и делают ставку на экспертов
Рабочий доклад Harvard Business School и INSEAD показал: AI-нативные стартапы строят компактные плоские команды и нанимают почти исключитель













