Наука
Новый метод Dataset Usage Inference определяет долю ваших данных..
Исследователи представили метод Dataset Usage Inference (DUI), позволяющий оценить, какая часть набора данных использовалась при обучении...
Новый промпт NoT улучшает этические рассуждения ИИ, снижая..
Исследователи представили метод Narration-of-Thought (NoT), который структурирует цепочку мыслей языковых моделей для более качественного...
Нейросети научились определять алгебраические свойства групп по..
Исследователи создали универсальный фреймворк на основе графовых нейросетей, который по графу Кэли определяет ключевые свойства конечных...
Теория ускоряющейся отдачи не решает проблему научных открытий —..
В новом препринте arXiv анализируется теория ускоряющейся отдачи Рэя Курцвейла. Авторы утверждают, что самоускоряющийся прогресс в...
Топологические нейросети повышают точность обнаружения..
Исследователи разработали метод, использующий топологический анализ данных для улучшения распознавания зон затоплений на спутниковых...
OpenFinGym: универсальная среда для тестирования ИИ-агентов в..
Исследователи представили OpenFinGym — единую платформу для оценки ИИ-агентов в количественных финансах, охватывающую прогнозирование,...
Алгоритмическая справедливость: исследование указало на..
Новое исследование, опубликованное на arXiv, выявило системные недостатки в подходах к алгоритмической справедливости. Авторы утверждают,...
Новый обзор указал на четыре ключевых пробела в оценке..
Исследователи проанализировали современные методы тестирования мультимодальных языковых моделей и выявили четыре важных аспекта, которые...
Температура 0 не гарантирует стабильность LLM-судей в оценках..
Новое исследование показало, что обнуление температуры выборки не делает оценки безопасности LLM-моделей детерминированными. Даже при...
LLM-агенты с инструментальными блоками справились с реальными..
Исследователи представили эмпирическое исследование агентов на базе больших языковых моделей (LLM), оснащённых специализированными...


