Наука

Ученые: тесты моральных качеств ИИ игнорируют нормы поведения

Ученые: тесты моральных качеств ИИ игнорируют нормы поведения..

Исследователи из arXiv предупреждают: существующие оценки моральных рассуждений больших языковых моделей сосредоточены на ценностях и...


Представлена EARL — библиотека для объяснения решений ИИ в самоадаптивных системах

Представлена EARL — библиотека для объяснения решений ИИ в..

Исследователи представили EARL — Python-библиотеку для создания контрфактических объяснений в системах с обучением с подкреплением. Она...


Регулирование ИИ в ЕС, США и Китае: исследование нашло три ключевых пробела в нормах

Регулирование ИИ в ЕС, США и Китае: исследование нашло три..

Ученые из arXiv сравнили правовые режимы ЕС, США и Китая для высокорискового ИИ. В работе выявлены три системных разрыва в соблюдении норм...


Траекторные метрики PGD не заменяют стандартную оценку робастности нейросетей

Траекторные метрики PGD не заменяют стандартную оценку..

Исследователи провели траекторный анализ PGD-атак на сверточные сети и выяснили, что такие метрики, как средняя потеря и выравнивание...


AI Lock-In угрожает: исследователи призывают готовиться к рискам зависимости от ИИ

AI Lock-In угрожает: исследователи призывают готовиться к рискам..

Авторы препринта на arXiv предупреждают, что чрезмерная зависимость от систем ИИ приводит к потере навыков у людей и создает уязвимости на...


FPO: ускорение дообучения LLM в 3 раза без обратного распространения ошибки

FPO: ускорение дообучения LLM в 3 раза без обратного..

Исследователи представили метод Forward Pass Domain Adaptation (FPO), который ускоряет дообучение больших языковых моделей в 2,7–3,2 раза и...


Мультимодальные ИИ провалили тест на абстрактное мышление: люди точнее в 8 раз

Мультимодальные ИИ провалили тест на абстрактное мышление: люди..

Исследователи представили бенчмарк The Unwritten Benchmark, в котором нужно распознавать слова по звуку пера и движению руки без видимых...


Списанные GPU объединили в кластер за $22 тыс. и запустили на нём LLaMA-70B

Списанные GPU объединили в кластер за $22 тыс. и запустили на..

Исследователи собрали вычислительный кластер из 128 бывших в употреблении ускорителей V100 и в течение года использовали его для инференса...


ИИ-модели продемонстрировали умение оценивать собственную уверенность в медицинской диагностике

ИИ-модели продемонстрировали умение оценивать собственную..

Исследователи из MIT представили препринт, в котором протестировали медицинские ИИ-модели на умение отслеживать неопределенность при...


Для диалоговых ИИ создали систему против утечки отмененных ограничений

Для диалоговых ИИ создали систему против утечки отмененных..

Многоходовые диалоги с языковыми моделями позволяют отменять ограничения, но модели часто продолжают им следовать. Исследователи...